北京、深圳InternshipEntry-levelPosted Today
Omni模型算法实习生北京、深圳实习互联网 / 电子 / 网游职位描述1. 前沿多模态模型辅助研发:参与通用人形机器人 Omni 多模态大模型研发,协助开展文本、视觉、语音、动作等多模态统一表征、理解、推理相关实验验证,跟进前沿多模态算法复现与效果对比。
2. 算法实验与架构迭代支撑:协助研究员完成跨模态对齐、时序建模、流式交互、多模态生成等核心模块实验,参与模型小规模调参、消融实验、结果分析,输出标准化实验报告。
3. 多模态数据与训练辅助工作:参与多模态数据集清洗、标注校验、数据配比、质量评估;协助完成预训练、微调、偏好对齐等流程脚本开发,跟进小规模训练任务,记录训练日志、定位基础训练异常。
4. 机器人场景落地配套工作:配合工程师完成大模型与机器人感知、认知模块联调测试,完成交互场景功能验证、效果记录,整理场景落地问题清单。
5. 端侧推理优化辅助:协助开展模型量化、蒸馏、推理测速等基础实验,整理不同硬件平台下的时延、性能数据,撰写优化对比文档。
6. 前沿技术调研沉淀:跟进多模态大模型领域的学术与产业前沿进展,定期输出技术调研简报;协助整理专利、实验材料、技术文档。职位要求1. 计算机、人工智能、自动化、数学、电子信息等相关专业,在读硕士研究生或本科高年级学生,可保证连续实习 3 个月及以上,每周到岗不少于 4 天;
2. 掌握 Transformer、LLM、VLM、多模态生成模型基础原理,了解大模型预训练、微调、对齐基础流程;
3. 熟练使用 Python、PyTorch,具备基础算法代码实现、实验复现、数据分析能力;
4. 具备严谨的实验习惯,擅长梳理实验数据、撰写文档,沟通协作顺畅,学习能力强;
5. 能主动跟进 AI 前沿技术,乐于动手验证各类算法方案。
加分项
1. 有多模态大模型、VLM、视频 / 语音模型相关课程项目、竞赛、科研论文产出;
2. 有开源多模态项目复现、小规模模型训练、数据集搭建实操经历;
3. 了解流式多模态、实时音视频交互、机器人 / 自动驾驶多模态落地场景;
4. 熟悉模型量化、推理加速、分布式训练基础操作;
5. 实习周期 6 个月及以上优先。投递
