算法实习生· 2026-08-17
即梦 AI 团队招算法实习生,方向包括 AI Agent / Agent Harness、Agent 模型后训练(Agentic RL / Reward Modeling),参与有大量真实用户的 AI 创作产品。
我们是即梦 AI 团队,正在寻找对 AI Agent / 多模态创作 / 大模型后训练感兴趣的算法实习生。如果你对 Agent 不只是停留在 Demo,想真正参与一个有大量真实用户的 AI 创作产品,欢迎来一起做一些有挑战、也能真正落地的事情。 你会做什么? 1️⃣ AI Agent / Agent Harness 一起探索下一代 AI 创作 Agent 的能力边界,包括但不限于: - Agent Memory / Skills - Agent Evaluation - Self-Evolving Agent 如果你对 Self-Evolving Agent、Agent Learning、长期记忆、Skill Learning 这些方向感兴趣,会有很多可以深入探索的问题。 2️⃣ Agent Model Post-Training 参与面向 Agent 场景的大模型后训练,包括: - Agent SFT / 数据合成 - Agentic RL - Rubrics-based RL - Reward Modeling / Unified Reward System 从数据构造、训练,到 Evaluation、Badcase 分析和下一轮迭代,都有机会完整参与。 你可能会喜欢这里,如果你: ✨ 对 Memory / Skills / Self-Evolving Agent 很感兴趣 ✨ 想参与真实的大模型 Post-Training 和 Agentic RL ✨ 喜欢快速迭代、做实验、分析 Badcase,然后继续把系统做得更好
1、本科及以上学历在读,计算机或人工智能等相关专业优先; 2、熟悉上述职位描述中涉及到的一种或多种技术栈并有深入的研究或项目经验;具备扎实的机器学习、深度学习与概率统计理论基础,对底层原理有深入理解; 3、熟练掌握至少一种主流深度学习框架(如 PyTorch),并具备大规模分布式训练(如 DeepSpeed / Megatron-LM)的实战经验; 4、主动积极、有创业精神,具备出色的沟通协作能力和问题解决能力,对通过技术创造一流产品充满热情。