大模型评测算法实习生· 2026-07-27
快手可灵AI招聘VLM视觉语言大模型评测算法实习生,参与多模态模型专项评测与自动化评测链路建设,一对一资深算法导师带教。
【职位描述】 1、负责VLM视觉语言大模型专项评测,针对图文匹配、细粒度视觉理解、逻辑推理、OCR识别、多轮对话一致性、视觉幻觉抑制等维度,设计科学、可落地的评测方案,精准定位模型缺陷,助力模型能力迭代。 2、调研MM-Bench、SEED-Bench、MME等行业主流VLM评测基准与数据集,完善各能力维度评测指标体系,沉淀标准化评测规范。 3、参与自动化评测链路与评测工具开发,使用Python实现批量推理、自动校验、坏例归集与指标统计,输出可视化分析报告,提升模型迭代效率。 4、对接算法研发团队,同步准确率、F1、幻觉率等核心数据,输出评测结论与优化建议,参与模型基线建设、版本回归测试与模型对比评测。 【我们的福利】 1、一对一资深算法导师带教,系统化学习工业级VLM评测方法论,成长路径清晰。 2、足额实习补贴、节日福利,提供转正及互联网大厂内推资源。 3、团队技术氛围浓厚,高频前沿技术分享,可积累高含金量多模态核心项目经历。 【投递说明】 投递命名格式:到岗时间+可实习时长+姓名+院校 简历小贴士:简历优先突出VLM评测、多模态项目、数据集实战、自动化脚本开发经历,附带GitHub、评测报告等成果者优先。
1、本科及以上在读,计算机、人工智能、计算机视觉、统计等相关专业优先,具备扎实的深度学习基础。 2、熟悉Transformer架构,了解VLM图文对齐基本范式,了解LLaVA、CLIP、BLIP等主流视觉语言模型者优先。 3、关注多模态前沿技术,能够阅读相关顶会论文,熟练使用Python、PyTorch完成数据处理、模型推理及脚本开发。 4、逻辑清晰、责任心强,可承担多版本模型并行评测任务,善于总结问题、复盘坏例,跨团队沟通协作顺畅。 5、可稳定实习3个月及以上,每周在岗4天及以上;有VLM评测、多模态项目、自动化工具开发、Docker/K8s使用经验者优先。