多模态 VLM 视觉语言评测(外包驻场)· 2026-08-03
可灵大模型团队招 VLM 视觉语言评测外包,北京线下驻场,可长期稳定合作
工作模式:线下驻场、可长期稳定合作 业务方向:可灵视觉语言大模型能力迭代、专项评测、数据体系建设 【岗位亮点】 对接可灵核心多模态业务,专注 VLM 视觉语言模型评测工作,参与工业级大模型版本迭代、能力验收与问题闭环。 团队技术规范成熟、流程标准,上手有专人带教,工作内容纯粹为技术评测,无杂活、无行政事务。 项目稳定、需求长期持续,适合想要深耕多模态评测、积累工业级项目经验的同学。 【工作内容】 1、负责 VLM 视觉语言模型通用能力评测,覆盖图文对齐、视觉推理、细粒度识别、场景理解、OCR 能力、幻觉问题排查等维度。 2、基于 MM-Bench、SEED-Bench 等主流评测基准,参与评测数据集筛选、测试用例扩充、能力指标整理。 3、针对模型输出结果进行精细化质检、坏例收集、问题归类,输出结构化评测结论与迭代建议。 4、配合算法团队完成版本回归测试、能力对比、专项实验复盘,协助沉淀评测规范与 SOP 文档。 【岗位福利】 1、长期稳定项目,工作内容专业对口,持续积累工业级 VLM 评测经验。 2、团队技术氛围好,有正式员工同步带教,快速熟悉多模态评测体系。
1、本科及以上学历,计算机、人工智能、统计、CV 相关背景优先,有大模型 / 多模态项目经验优先。 2、了解 VLM、图文匹配、视觉理解基础概念,熟悉 Transformer、多模态基础原理。 3、具备基础数据分析能力,会使用 Python 做简单数据处理、结果统计,能看懂评测指标。 4、细心严谨、理解力强,具备良好的问题归纳能力,能稳定跟进版本迭代节奏。 5、可北京线下驻场,能长期稳定合作者优先,有大模型评测、标注体系建设经验加分。 投递说明:简历命名格式「VLM外包+姓名+可到岗时间+可合作时长」