职位要求
具体岗位描述:
1开发开放全场景的新一代机器人多模态音视频交互模组;
2支持 2-8 MIC, 强噪声声学环境拾音;
33D智能视觉,物体, 人体, 身份, 行为等检测识别;
4提供流畅拟人的实时音视频互动图文互动能力,支持Agent/MCP/插件/指令自由扩展对话能力;
5对接产品需求,拆解机器人语音交互音频技术指标(延迟抗干扰等);
6负责前端音频算法(降噪回声消除等)选型集成联调,适配云端音视频接入;
7熟悉常用音频传输协议与编解码标准,优化云端传输稳定性与带宽占用;
8协同确定麦克风/扬声器/RGB-D布局与选型,保障软硬件适配;
9协调音频链路与机器人控制和多模态交互系统,管控整体延迟;
10输出音视频链路设计说明书测试规范等技术文档。
1本科及以上,电子工程声学信号处理等相关专业;
21年以上音频相关工作经验,机器人/智能音响音频方案经验优先;
3精通音视频前端核心算法,熟悉音视频前端处理流程;
4具备音视频算法集成与调试能力,能独立解决嵌入式平台音视频链路问题;
5了解麦克风/扬声器/RGB-D等硬件特性,有软硬件协同优化经验,
6覆盖多品类需求,全面超越传统方案。
招聘人数:1人