← 返回岗位列表
阿里巴巴
校招端到端语音智能体前沿技术研究-阿里星
北京/杭州/上海 · 校招 · 2027 届 · 博士
长期有效
任职要求
- 1、计算机科学、电子工程、人工智能、信号处理等相关专业硕士及以上学历,博士优先;
- 2、精通语音识别(ASR)、语音合成(TTS)、语音理解(SLU)等相关技术;
- 3、熟悉主流大模型及深度学习框架(PyTorch/Megatron/DeepSpeed),具备大规模模型训练与调优能力;
- 4、熟悉多模态表示学习、跨模态对齐与融合、自监督预训练方法;
- 5、具备良好的算法实现能力和工程落地经验,熟悉模型压缩、蒸馏、量化、加速等技术;
- 6、具有较强的研究能力和创新意识,曾在顶级会议(如NeurIPS、ICML、ICLR、ACL、INTERSPEECH、ICASSP等)发表过论文者优先;
- 7、良好的沟通能力和团队协作精神,能够承担高强度的研发任务。
- 【加分项】
- 1、有大规模语音-文本数据构建与清洗经验;
- 2、有端到端多模态对话系统开发经验或者实时通话经验;
- 3、了解语音前端处理(VAD、说话人分离、语音增强等);
- 4、熟悉语音大模型及其扩展应用;
- 5、有开源社区贡献经历或主导过知名开源项目者优先。
岗位描述
- 1、负责统一语音多模态大模型的设计、训练、优化,涵盖语音识别、语音合成、语音理解、文本-语音融合、跨模态检索与生成等方向;
- 2、推动语音与其他模态(文本、图像等)在统一建模框架下的深度融合,提升模型的理解、生成与交互能力;
- 3、跟踪并研究前沿的多模态学习方法,包括但不限于Transformer、对比学习、扩散模型、自监督学习、强化学习等;
- 4、参与大规模数据预处理、模型训练与推理优化,推动模型在实际场景中的高效部署;
- 5、与产品、工程团队紧密协作,将研究成果应用于智能助手、虚拟人、智能硬件、会议记录等业务场景。
- 1、计算机科学、电子工程、人工智能、信号处理等相关专业硕士及以上学历,博士优先;
- 2、精通语音识别(ASR)、语音合成(TTS)、语音理解(SLU)等相关技术;
- 3、熟悉主流大模型及深度学习框架(PyTorch/Megatron/DeepSpeed),具备大规模模型训练与调优能力;
- 4、熟悉多模态表示学习、跨模态对齐与融合、自监督预训练方法;
- 5、具备良好的算法实现能力和工程落地经验,熟悉模型压缩、蒸馏、量化、加速等技术;
- 6、具有较强的研究能力和创新意识,曾在顶级会议(如NeurIPS、ICML、ICLR、ACL、INTERSPEECH、ICASSP等)发表过论文者优先;
- 7、良好的沟通能力和团队协作精神,能够承担高强度的研发任务。
【加分项】
- 1、有大规模语音-文本数据构建与清洗经验;
- 2、有端到端多模态对话系统开发经验或者实时通话经验;
- 3、了解语音前端处理(VAD、说话人分离、语音增强等);
- 4、熟悉语音大模型及其扩展应用;
- 5、有开源社区贡献经历或主导过知名开源项目者优先。
你的简历匹配这个岗位吗?
上传简历,AI 会对照这份 JD 指出你的差距和需要补强的地方
该岗位可能会问的问题
基于 产品 岗位的常见面试问题整理
介绍一款自己喜欢的app
类型动机/岗位认知·难度简单·二面·携程
查看答题思路
选你深度使用的app+核心用户+核心价值+2-3个好的设计决策+1个改进建议
如何沟通协调五个部门的负责人来确定一个会议时间
类型专业能力·难度中等·二面·携程
查看答题思路
先发Doodle/投票选时间+对无法参加的单独沟通+提前发议程让缺席者也能贡献意见
请做一个简短的自我介绍
类型动机/岗位认知·难度简单·一面·小米
查看答题思路
姓名+学校+实习经历(1-2家)+与岗位的关联点,控制在60秒内
为什么选择投递小米产品类的产品经理岗位?
类型动机/岗位认知·难度简单·一面·小米
查看答题思路
对小米产品理念和IoT生态的理解+个人职业方向与小米业务的契合点
通过这个项目,你觉得如果未来的工作里面遇到这样的问题,你可以怎么解决
类型情景/案例·难度中等·二面·携程
查看答题思路
从失败中提炼可迁移的方法论+应用到假设的新场景+展现学习能力
更多面试题库功能即将上线
信息来源:企业官方招聘页。投递前请以官网信息为准。