← 返回岗位列表

腾讯

校招

内容服务-多模态理解与生成

深圳总部 · 校招 · 2027 届 · 博士

长期有效

任职要求

  • 1、相关专业(计算机、人工智能等)在读的博士和优秀硕士;
  • 2、具备较强的学习能力、清晰的逻辑思维能力和出色的沟通能力,有强烈的好奇心和自驱力;
  • 3、具有多模态内容理解,多模态生成与编辑,机器学习算法基础,有图像生成与编辑、agent,音视频生成和编辑方向顶级论文者优先。

岗位描述

【岗位职责】

课题背景:

随着多模态大模型的发展,人工智能正从单一模态理解逐步迈向跨模态的通用智能能力。在开放世界场景中,模型需要同时处理文本、图像、视频、音频等多源信息,并在不同模态之间建立统一的语义理解与知识关联。如何让模型具备从感知、语义理解到推理决策的综合能力,成为当前多模态智能研究的重要方向。本课题聚焦多模态大模型的统一表征与推理能力,探索构建跨模态理解与知识整合框架,为多模态智能在真实业务场景中的应用提供技术基础。

课题挑战:

多模态大模型在开放环境中的应用仍面临多方面挑战。首先,不同模态信息在表达形式和语义空间上存在差异,如何实现文本、图像、视频、音频等多模态数据的有效对齐与联合表征,是实现统一理解的关键问题。其次,在复杂场景下,模型不仅需要完成基础感知与语义理解,还需要具备跨模态的时空推理与知识整合能力,这对模型结构与训练方式提出更高要求。此外,多模态模型在实际应用中还需具备良好的鲁棒性、泛化能力与可控性,如何构建合理的数据体系与评测方法,刻画模型能力边界并保障安全可靠,也是研究的重要挑战。

具体工作:

参与多模态大模型相关研究,包括跨模态对齐与联合表征方法探索、多模态推理能力实验验证,以及数据与评测体系的构建;结合具体任务场景,评估模型在内容理解、交互问答等任务中的表现并持续优化。

【任职要求】

  • 1、相关专业(计算机、人工智能等)在读的博士和优秀硕士;
  • 2、具备较强的学习能力、清晰的逻辑思维能力和出色的沟通能力,有强烈的好奇心和自驱力;
  • 3、具有多模态内容理解,多模态生成与编辑,机器学习算法基础,有图像生成与编辑、agent,音视频生成和编辑方向顶级论文者优先。

【技术方向】

大语言模型、NLP

你的简历匹配这个岗位吗?

上传简历,AI 会对照这份 JD 指出你的差距和需要补强的地方

该岗位可能会问的问题

基于 运营 岗位的常见面试问题整理

我提到了电竞方面,另一个面试官就问我对于ig战队(lol)的看法,然后一道情景题:公司和ig方面有合作,怎样运营才能吸引ig粉丝使用我们产品

类型专业能力·难度中等·一面·咪咕动漫
查看答题思路

1. 电竞营销=粉丝经济,核心是社区运营而非传统广告 2. 跨界合作:战队/选手/IP 联名,借粉丝流量 3. 内容策略:比赛直播/选手日常/粉丝二创/社区活动 4. 案例:用 STAR 讲一个电竞相关的运营策划

另一个面试官看我的专业(偏设计)就问我愿不愿意做产品设计方向,让我发作品集 大概就这些 #咪咕#<a href="/creation/subject/928d551be73f40db82c0ed83286c8783" target="_blank" class="s

类型专业能力·难度中等·一面·咪咕动漫
查看答题思路

1. 核心概念:一句话说清这个问题的底层逻辑 2. 方法论/框架:用 STAR 原则或专业框架结构化回答 3. 实际案例:结合一个具体场景说明 4. 量化结果:用数据佐证你的观点

你认为内容运营需要具备哪些能力

类型专业能力·难度简单·一面·搜狐
查看答题思路

1. 内容运营=创作有价值的内容→分发到正确渠道→吸引目标用户→促成转化 2. 核心能力:选题能力(知道用户想看什么)、写作能力、数据分析能力(用数据迭代内容策略) 3. 生命周期:选题→创作→审核→发布→分发→数据回收→优化→二次传播 4. 优质内容标准:原创/有用/有趣/有共鸣/有行动引导

谈谈你理解的内容生命周期

类型动机/岗位认知·难度简单·一面·搜狐
查看答题思路

1. 真诚:为什么对这个方向感兴趣(具体经历/瞬间) 2. 匹配:你的能力和这个岗位的契合点 3. 成长:你希望从这个岗位学到什么 4. 贡献:你能为团队带来什么

自我介绍

类型动机/岗位认知·难度中等·一面·咪咕动漫
查看答题思路

1. 我是谁(姓名+学校+专业,15秒) 2. 我做过什么(最相关的 1-2 个经历,30秒) 3. 为什么适合这个岗位(能力匹配,15秒) 4. 总时长控制在 1 分钟以内 5. 避免:念简历、说「我学习能力强」这种空话

更多面试题库功能即将上线

信息来源:企业官方招聘页。投递前请以官网信息为准。