腾讯
校招应用研究中心ARC Lab-决策与行动模型
深圳总部/北京/上海 · 校招 · 2027 届 · 博士
长期有效
任职要求
- 1、相关专业(计算机、人工智能等)在读博士
- 2、卓越的研究背景,在顶级学术会议或期刊(如 CVPR, ICCV, NeurIPS, ICML, ICLR, SIGGRAPH 等)发表过 2 篇以上高水平论文。
- 3、在开源社区有显著贡献,核心项目在 GitHub 上获得累计 100 + stars。
岗位描述
【岗位职责】
【背景】
视觉-动作(VA)大模型在具身智能与复杂游戏和交互视频智能体领域展现出巨大潜力,是迈向通用人工智能的核心路径。然而,当前 VLA 策略的训练与评测高度依赖于手工搭建的物理仿真。而此式世界模型其能够通过海量无标注视频数据,隐式学习物理世界的时空动态规律。本课题旨在研究智能和世界模型无缝交互的 VA 智能体并探索两者的双向交互机制。
【挑战】
- 1、如何构建高效且可执行的视频动作模型:现有的端到端模型往往面临推理延迟高、动作空间映射不精确的问题,难以在实时交互视频或高频具身控制中应用。
- 2、如何利用视频动作模型解决长程复杂任务:智能体在长路径规划中极易产生“错误累积”,导致在完成分步骤、跨时域的复杂任务(如长达数分钟的游戏关卡或连续家庭作业)时失效。
- 3、面向复杂交互的多智能体协同机制:在开放世界或复杂交互视频中,智能体并非孤立存在。多智能体间的协作干预、资源竞争与信息非对称,使得协同策略的训练极具挑战。
【具体工作】
通过解决高效执行、长程推理及群体协作等关键科学问题,确立新一代具身智能的技术范式。本项研究不仅旨在产出具有国际影响力的顶会成果,更力求在模型性能上突破 SOTA 瓶颈,为构建具备世界模型能力的交互智能体提供核心理论与技术支撑。
【任职要求】
- 1、相关专业(计算机、人工智能等)在读博士
- 2、卓越的研究背景,在顶级学术会议或期刊(如 CVPR, ICCV, NeurIPS, ICML, ICLR, SIGGRAPH 等)发表过 2 篇以上高水平论文。
- 3、在开源社区有显著贡献,核心项目在 GitHub 上获得累计 100 + stars。
【技术方向】
多模态、视觉、语音
你的简历匹配这个岗位吗?
上传简历,AI 会对照这份 JD 指出你的差距和需要补强的地方
该岗位可能会问的问题
基于 运营 岗位的常见面试问题整理
我提到了电竞方面,另一个面试官就问我对于ig战队(lol)的看法,然后一道情景题:公司和ig方面有合作,怎样运营才能吸引ig粉丝使用我们产品
查看答题思路
1. 电竞营销=粉丝经济,核心是社区运营而非传统广告 2. 跨界合作:战队/选手/IP 联名,借粉丝流量 3. 内容策略:比赛直播/选手日常/粉丝二创/社区活动 4. 案例:用 STAR 讲一个电竞相关的运营策划
另一个面试官看我的专业(偏设计)就问我愿不愿意做产品设计方向,让我发作品集 大概就这些 #咪咕#<a href="/creation/subject/928d551be73f40db82c0ed83286c8783" target="_blank" class="s
查看答题思路
1. 核心概念:一句话说清这个问题的底层逻辑 2. 方法论/框架:用 STAR 原则或专业框架结构化回答 3. 实际案例:结合一个具体场景说明 4. 量化结果:用数据佐证你的观点
你认为内容运营需要具备哪些能力
查看答题思路
1. 内容运营=创作有价值的内容→分发到正确渠道→吸引目标用户→促成转化 2. 核心能力:选题能力(知道用户想看什么)、写作能力、数据分析能力(用数据迭代内容策略) 3. 生命周期:选题→创作→审核→发布→分发→数据回收→优化→二次传播 4. 优质内容标准:原创/有用/有趣/有共鸣/有行动引导
谈谈你理解的内容生命周期
查看答题思路
1. 真诚:为什么对这个方向感兴趣(具体经历/瞬间) 2. 匹配:你的能力和这个岗位的契合点 3. 成长:你希望从这个岗位学到什么 4. 贡献:你能为团队带来什么
自我介绍
查看答题思路
1. 我是谁(姓名+学校+专业,15秒) 2. 我做过什么(最相关的 1-2 个经历,30秒) 3. 为什么适合这个岗位(能力匹配,15秒) 4. 总时长控制在 1 分钟以内 5. 避免:念简历、说「我学习能力强」这种空话
更多面试题库功能即将上线
信息来源:企业官方招聘页。投递前请以官网信息为准。