腾讯
校招面向交互式长视频生成的多模态世界模型
深圳总部/北京/上海 · 校招 · 2027 届 · 本科
长期有效
任职要求
- 1、有多模态+扩散模型和大规模训练能力;
- 2、有良好的Infra优化和大模型工程能力;
- 3、在视觉、图形学顶会发表过高质量相关论文,或在相关公司大模型重大项目、开源项目中做出过重要贡献;
- 4、具有良好的学界新方法的理解和认知能力。
岗位描述
【岗位职责】
解决实时交互视频生成要求下多模态遵从、低成本部署的综合难题。
- 1. 在模型尺寸的限定情况下,如何保持优秀的多模态能力。
- 2. 如何确保流式视频模型长时间不崩坏、具备良好的空间记忆能力。
- 3. 如何通过有效的蒸馏、量化等综合手段降低流式视频模型的推理成本、延迟和提升流畅度。
【任职要求】
- 1、有多模态+扩散模型和大规模训练能力;
- 2、有良好的Infra优化和大模型工程能力;
- 3、在视觉、图形学顶会发表过高质量相关论文,或在相关公司大模型重大项目、开源项目中做出过重要贡献;
- 4、具有良好的学界新方法的理解和认知能力。
【技术方向】
多模态、视觉、语音
你的简历匹配这个岗位吗?
上传简历,AI 会对照这份 JD 指出你的差距和需要补强的地方
该岗位可能会问的问题
基于 设计 岗位的常见面试问题整理
请描述你的设计流程,从拿到需求到输出最终方案
查看答题思路
1. 理解需求:和 PM 对齐业务目标和用户场景 2. 竞品分析:同类产品怎么做的 3. 用户调研:目标用户的实际痛点 4. 低保真原型:快速验证交互流程 5. 高保真设计:视觉细节 + 组件规范 6. 开发交付:标注 + Design Token + 走查 7. 上线后复盘:数据验证设计假设
你怎么理解 Design System,以及为什么要用它
查看答题思路
1. Design System = 设计语言 + 组件库 + 规范文档的集合 2. 价值:保证一致性(所有页面看起来像同一个产品)、提高效率(开发-设计对齐)、可维护(改一处全局更新) 3. 核心组成:Design Token(颜色/间距/字体)、组件(按钮/表单/卡片)、模式(导航/搜索/反馈)
你的作品集中最满意的项目是哪个,为什么
查看答题思路
1. 选一个最有深度的,不是最漂亮的 2. 设计目标:为谁解决什么问题 3. 设计过程:展示 sketches → wireframes → final(体现思考) 4. 设计决策:为什么选这个方案而非其他 5. 结果:数据反馈(转化率/满意度/留存)
为一个老年人使用的健康监测 App 设计首页,你会考虑哪些特殊需求
查看答题思路
1. 可读性:大字号(≥18px)、高对比度、避免低饱和配色 2. 交互:大点击区域(≥48px)、避免双击/长按/滑动等复杂手势 3. 信息架构:只展示最核心信息(血压/心率/用药提醒),不要信息过载 4. 容错:误操作可撤销,关键操作二次确认 5. 语音输入:考虑老年人打字不便
你怎么衡量一个设计的好坏
查看答题思路
1. 不只是好看——设计是解决问题的工具 2. 可用性指标:任务完成率/时间/错误率 3. 商业指标:转化率/留存率/NPS 4. 主观评估:用户访谈/可用性测试中的反馈 5. 强调「设计是假设,数据是验证」
更多面试题库功能即将上线
信息来源:企业官方招聘页。投递前请以官网信息为准。