MENU王一彤CONTACT
AI TRAINER PORTFOLIO LOADING
Welcome To
my
world
AI LARGE MODEL TRAINER

WHO TURNSAI DATA

INTO BETTER MODELS?

王一彤

AI DATA & MULTIMODAL EVALUATION

14 个月智谱 AI 训练师经历,覆盖 Agent 数据生产、视频理解、文生图评测与文生视频评测,擅长将评测规则、团队协作和 Human-in-the-loop 自动化流程转化为可交付、可复盘的项目结果。

AI trainer mascot
11 人评测团队2 万+ 双盲打分40+ 小时 / 周
Skills

能力像便签一样清楚贴出来

01

多模态评测体系

能围绕文本遵循、运动质量、画面质量、事实性等维度设计任务集、评分规则和竞品对标方案。

  • ✦GSB + 1–5 分量化评分
  • ✦双盲评测与分差仲裁
  • ✦文生图 / 视频 / 音视频评测

02

评测团队管理

可统筹评测员排期、抽检质检、争议复核、报告产出和算法复评,推动项目按周稳定交付。

  • ✦统筹 11 人评测组
  • ✦16 周零延期
  • ✦一致率约 82%→90%

03

Human-in-the-loop 自动化

将模型批量初判、裁判复核和人工精修组合成分流流水线,通过 AI 辅助编程落地 CSV、Web 看板与飞书推送,支持离线验证、小流量和全量上线。

  • ✦双 LLM 一致性分流
  • ✦Codex / Claude Code / Cursor
  • ✦每周减少 40+ 小时重复劳动

04

建筑与绘画审美

建筑学训练与绘画积累,让我从空间、构图、色彩和光影理解画面。能将视觉感受拆解为具体问题,为 AI 图像评测、审美分歧仲裁与视觉创作提供依据。

  • ✦建筑学本科,具备空间与构图训练
  • ✦绘画与 PS 实践,独立完成海报、封面和排版
  • ✦参与审美分歧仲裁,定位色彩、光影与画面问题
Project Files

项目经历,像一墙可展开的档案。

点击档案卡查看 STAR + Badcase,保留求职证据链,也保留一点纸张翻开的探索感。

看创作作品集
文生视频评测

2026.03 - 2026.05

智谱 CogVideoX 文生视频项目助理

为企业级商用版 CogVideoX-2 大版本上线完成评测集构建、多轮内部迭代评测和竞品对标,辅助 PM 推进交付。

CogVideoX-2GSB 评分VBench竞品对标
  • 小组 9,000+ 条评测
  • 产出约 18 份报告
  • 统筹 11 名评测员
  • 100+ 条 Badcase 归因
文生图评测

2025.11 - 2026.02

文生图评测组长(CogView4 与 GLM-Image)

承担日常迭代评测、中文文字专项、竞品对标和 GLM-Image 发布前回归,统筹 11 人评测组稳定交付。

CogView4GLM-Image双盲评测Badcase 闭环
  • 1 万+ 评测用例
  • 2 万+ 人次双盲打分
  • 一致率 82%→90%
  • Badcase 率 24%→15%
视频理解数据

2025.07 - 2025.10

多模态视频理解 Caption 质检

为 GLM-4.1V-Thinking / GLM-4.5V 视频理解训练产出数据,负责 10 秒短视频 6 维元标签和双层描述质检。

GLM-4.5VCaption双 LLM 分流QA
  • 质检 2,000+ 条
  • 事实性合格率 ≥98%
  • 人效提升约 60%
  • 周产能 450→750 条
Agent SFT 数据

2025.03 - 2025.06

AutoGLM 多场景 Agent SFT 数据标注

为 AutoGLM 沉思提供工具调用、多步推理等 Agent 能力的 SFT 训练数据,覆盖旅游规划、餐饮预订和出行助手。

AutoGLMAgent SFTJSON 校验新人 SOP
  • 约 2 万+ 轮次
  • 约 1,400 session
  • 整体准确率 95%+
  • JSON 通过率 99%
Folder Index

时间线像文件夹,记录项目成长路径。

2026.03 - 2026.05北京 / 全职实习

智谱 CogVideoX 文生视频项目助理

智谱 AI · 文生视频评测

为企业级商用版 CogVideoX-2 大版本上线完成评测集构建、多轮内部迭代评测和竞品对标,辅助 PM 推进交付。

  • 小组 9,000+ 条评测
  • 产出约 18 份报告
  • 统筹 11 名评测员
  • 100+ 条 Badcase 归因
2025.11 - 2026.02北京 / 全职实习

文生图评测组长(CogView4 与 GLM-Image)

智谱 AI · 文生图评测

承担日常迭代评测、中文文字专项、竞品对标和 GLM-Image 发布前回归,统筹 11 人评测组稳定交付。

  • 1 万+ 评测用例
  • 2 万+ 人次双盲打分
  • 一致率 82%→90%
  • Badcase 率 24%→15%
2025.07 - 2025.10北京 / 全职实习

多模态视频理解 Caption 质检

智谱 AI · 视频理解数据

为 GLM-4.1V-Thinking / GLM-4.5V 视频理解训练产出数据,负责 10 秒短视频 6 维元标签和双层描述质检。

  • 质检 2,000+ 条
  • 事实性合格率 ≥98%
  • 人效提升约 60%
  • 周产能 450→750 条
2025.03 - 2025.06北京 / 全职实习

AutoGLM 多场景 Agent SFT 数据标注

智谱 AI · Agent SFT 数据

为 AutoGLM 沉思提供工具调用、多步推理等 Agent 能力的 SFT 训练数据,覆盖旅游规划、餐饮预订和出行助手。

  • 约 2 万+ 轮次
  • 约 1,400 session
  • 整体准确率 95%+
  • JSON 通过率 99%

Contact

LET'S BUILD SOMETHING SMART

Resume
AI trainer mascot