腾讯
实习面向长程、复杂决策问题的具身智能体的研究
深圳总部 · 实习 · 博士
长期有效
任职要求
- 1.基本要求
- ●计算机、人工智能、机器人、自动化等相关专业在读硕士/博士
- ●扎实的数学基础与良好的编程能力(Python/PyTorch)
- 2.技能要求(满足一项或多项即可)
- ●有LLM/VLM预训练、微调或推理优化经验,熟悉思维链(CoT)、检索增强生成(RAG)等技术
- ●有强化学习、模仿学习或机器人操作策略学习经验,了解相关算法(如PPO、SAC、Diffusion Policy等)
- ●有记忆网络(如LSTM、Transformer-XL、Memformer)或知识图谱构建经验,关注时空记忆建模
- ●有多智能体系统(Multi-Agent System)研究经验,熟悉通信协议与分布式决策算法(如MADDPG、QMIX等)
- ●熟悉ROS/ROS2,有真实机械臂或移动机器人实验经验
- ●有3D视觉、SLAM或仿真环境(Isaac Sim、MuJoCo、PyBullet等)使用经验
- ●有模型压缩、加速部署经验(量化、蒸馏、TensorRT等)
- 3.加分项
- ●在CoRL、RSS、ICRA、NeurIPS、ICML、CVPR、AAAI等顶会/顶刊发表过论文
- ●有开源项目贡献或大规模模型部署工程经验
- ●具备跨学科背景(如控制理论、认知科学 × 深度学习)
- 4.素质要求
- ●对具身智能、多智能体系统有浓厚兴趣,具备自驱力与独立研究能力
- ●良好的团队协作、沟通能力与英文学术写作能力
- 此课题同时招聘应届实习生和低年级实习生。
岗位描述
【岗位职责】
课题背景
在人工智能从数字空间向物理空间跨越的背景下,本课题致力于构建一种能够处理长程复杂任务且具备协作能力的具身智能决策智能体(Agent)。当前,大语言模型与视觉大模型在逻辑推理与跨模态理解上已展现出类人潜质,但将这种的推理能力转化为机器人在真实物理环境中的闭环执行力,仍是人工智能领域亟待解决的问题。本课题的开展,立足于解决具身智能在执行需要数十个步骤、跨越较长时间跨度且环境高度动态的任务时,因缺乏物理常识、反馈校验机制、时空记忆管理以及多机协同能力而导致的决策链条断裂与效率瓶颈问题。
课题价值
本课题的研究价值在于打通了数字世界逻辑推理与物理世界精确执行之间的壁垒,对于构建真正具备认知能力的具身智能体具有深远的理论意义。本课题的研究包括面向环境突变的动态重规划能力、多维时空记忆压缩检索机制、多智能体通信及协作策略。该研究可赋能于非结构化环境下的复杂作业通过提升智能体处理长程复杂任务的成功率与鲁棒性,能够显著推动通用机器人产业的智能化升级,具有极高的社会经济效益与战略落地价值。
课题挑战
- 1.物理世界状态一致性挑战:在真实世界执行长程任务时,环境状态具有动态演变特性,要求智能体必须具备实时状态校验与动态重规划的能力。
- 2.推理延迟与实时性约束挑战:复杂的思维链(CoT)及搜索算法会引入显著的计算延迟。在物理交互场景中,过长的延迟可能引发安全风险或导致环境状态失效。
- 3.时空记忆的构建挑战:维护复杂动态环境下执行长程任务的时空记忆系统,需考虑时空经验的选择性遗忘与压缩、建立高效索引机制、时空信息统一表征与推理。
- 4.多智能体协作挑战:异构智能体任务动态分配策略与带宽受限通信不稳定下的任务共识机制。
具体工作(一项或多项)
- 1.面向长程任务的时空记忆机制研究:设计高效时空记忆表征与压缩检索方法,实现智能体对历史状态与子任务的长周期记忆与动态调用,支持复杂任务中的步骤跟踪与异常恢复。
- 2.动态环境下的实时状态校验与重规划:研究基于实时感知的状态监测与任务执行偏差检测,结合启发式搜索与LLM推理实现动态重规划策略,提升智能体在物理世界中的鲁棒性。
- 3.多智能体协作策略与通信机制:探索异构智能体在带宽受限、通信不稳定环境下的任务分配与共识算法,实现多机协同完成复杂长程任务。
- 4.推理延迟优化与实时决策:研究模型量化、知识蒸馏、异步推理等加速方案,降低思维链(CoT)与搜索算法的延迟,满足物理交互的实时性要求。
- 5.多模态感知与空间认知对齐:融合视觉、语言与力触觉信息,实现精准的空间关系理解与操作执行,支撑非结构化环境下的复杂作业。
- 6.仿真环境构建与真机验证:搭建长程任务仿真平台(如具身智能基准测试),设计多步骤任务场景,完成sim-to-real迁移实验,撰写技术报告。
【任职要求】
- 1.基本要求
●计算机、人工智能、机器人、自动化等相关专业在读硕士/博士
●扎实的数学基础与良好的编程能力(Python/PyTorch)
- 2.技能要求(满足一项或多项即可)
●有LLM/VLM预训练、微调或推理优化经验,熟悉思维链(CoT)、检索增强生成(RAG)等技术
●有强化学习、模仿学习或机器人操作策略学习经验,了解相关算法(如PPO、SAC、Diffusion Policy等)
●有记忆网络(如LSTM、Transformer-XL、Memformer)或知识图谱构建经验,关注时空记忆建模
●有多智能体系统(Multi-Agent System)研究经验,熟悉通信协议与分布式决策算法(如MADDPG、QMIX等)
●熟悉ROS/ROS2,有真实机械臂或移动机器人实验经验
●有3D视觉、SLAM或仿真环境(Isaac Sim、MuJoCo、PyBullet等)使用经验
●有模型压缩、加速部署经验(量化、蒸馏、TensorRT等)
- 3.加分项
●在CoRL、RSS、ICRA、NeurIPS、ICML、CVPR、AAAI等顶会/顶刊发表过论文
●有开源项目贡献或大规模模型部署工程经验
●具备跨学科背景(如控制理论、认知科学 × 深度学习)
- 4.素质要求
●对具身智能、多智能体系统有浓厚兴趣,具备自驱力与独立研究能力
●良好的团队协作、沟通能力与英文学术写作能力
【加分项】
此课题同时招聘应届实习生和低年级实习生。
【技术方向】
其他
你的简历匹配这个岗位吗?
上传简历,AI 会对照这份 JD 指出你的差距和需要补强的地方
该岗位可能会问的问题
基于 运营 岗位的常见面试问题整理
我提到了电竞方面,另一个面试官就问我对于ig战队(lol)的看法,然后一道情景题:公司和ig方面有合作,怎样运营才能吸引ig粉丝使用我们产品
查看答题思路
1. 电竞营销=粉丝经济,核心是社区运营而非传统广告 2. 跨界合作:战队/选手/IP 联名,借粉丝流量 3. 内容策略:比赛直播/选手日常/粉丝二创/社区活动 4. 案例:用 STAR 讲一个电竞相关的运营策划
另一个面试官看我的专业(偏设计)就问我愿不愿意做产品设计方向,让我发作品集 大概就这些 #咪咕#<a href="/creation/subject/928d551be73f40db82c0ed83286c8783" target="_blank" class="s
查看答题思路
1. 核心概念:一句话说清这个问题的底层逻辑 2. 方法论/框架:用 STAR 原则或专业框架结构化回答 3. 实际案例:结合一个具体场景说明 4. 量化结果:用数据佐证你的观点
你认为内容运营需要具备哪些能力
查看答题思路
1. 内容运营=创作有价值的内容→分发到正确渠道→吸引目标用户→促成转化 2. 核心能力:选题能力(知道用户想看什么)、写作能力、数据分析能力(用数据迭代内容策略) 3. 生命周期:选题→创作→审核→发布→分发→数据回收→优化→二次传播 4. 优质内容标准:原创/有用/有趣/有共鸣/有行动引导
谈谈你理解的内容生命周期
查看答题思路
1. 真诚:为什么对这个方向感兴趣(具体经历/瞬间) 2. 匹配:你的能力和这个岗位的契合点 3. 成长:你希望从这个岗位学到什么 4. 贡献:你能为团队带来什么
自我介绍
查看答题思路
1. 我是谁(姓名+学校+专业,15秒) 2. 我做过什么(最相关的 1-2 个经历,30秒) 3. 为什么适合这个岗位(能力匹配,15秒) 4. 总时长控制在 1 分钟以内 5. 避免:念简历、说「我学习能力强」这种空话
更多面试题库功能即将上线
信息来源:企业官方招聘页。投递前请以官网信息为准。