你好,我是

你的名字

创意开发者 / 设计师

专注于打造沉浸式的数字体验,用代码将创意变为现实。

向下滚动

让设计与代码对话

我是一名专注于大模型数据建设与评测的AI训练师,致力于在数据质量与模型能力之间搭建可靠的桥梁。

拥有从需求分析、规则文档编写、任务下发到数据标注、质检、验收及交付的全流程实操经验。在训练数据建设方面,擅长SFT数据构建、偏好数据构建、CoT推理数据及多轮对话数据处理,曾带领团队完成多个AI情感对话与语音合成项目的数据交付。

在模型评测领域,参与过单模型能力下钻、双模型对比及多模型横向评测,能够独立完成评测指标体系设计、评测集构建、BadCase归因分析及评测报告输出,并将评测数据转化为可视化图表与场景化选型建议。熟练运用SFT、DPO、RAG、ReAct和Agent等大模型技术原理,并擅长借助Trae IDE、Claude Code、DeepSeek等AI工具搭建自动化工作流,持续提升数据处理与评测效率。具备中英韩三语能力,能够胜任跨语言的数据建设与评测任务。

智能客服AI助手优化项目

围绕垂类智能客服场景,拆解售后业务逻辑,将用户模糊表述梳理为可被AI理解的细粒度意图体系。针对商品瑕疵、物流纠纷、鉴定争议等高频问题,整理标准处理流程并提炼专家型回复策略,累计梳理高频问题20+类、标准话术500+条。对客服AI生成内容进行准确性、专业性、情绪安抚度和任务完成度评分,针对答非所问、事实错误、语气生硬等问题进行Bad Case归因。累计分析用户咨询对话3000+组,输出深度诊断报告4份,协助提升知识库覆盖率约15%,AI助手在售后复杂场景中的准确率提升约30%。

图片Caption描述标注项目

面向多模态大模型训练,对商品、风景、人物、美食等图片进行图文描述标注,支持图像理解与生成模型的图文对齐能力建设。基于图片内容输出结构化自然语言描述,覆盖整体简要、主体描述、环境描述三个层级,确保描述准确、细节清楚,并覆盖主体、动作、场景、风格与可见关系。从准确性、完整性、简洁性三个维度评估描述质量,按照评分细则完成等级划分并补充错误类型标签。参与疑难Case专项讨论,整理漏标、误标、描述过泛、主客体混淆等Badcase,推动标注规范迭代;结合图文相似度模型完成自动分类分流和描述预生成,标注效率提升约50%,自动质检命中率提升约30%。

多模态生成模型评测项目

面向文生图、文生视频、图生视频模型输出结果进行系统评测,从图像质量、视频流畅度、语义一致性等维度判断生成内容是否满足训练与上线标准。设计并执行多模态生成内容评测方案,围绕清晰度、色彩、构图、物理真实性、帧间连贯性、动作自然度、指令遵循度、主体完整性和场景逻辑合理性等维度进行评分标注。组织双人独立评分与交叉抽检,设置分歧阈值并引入第三评审仲裁,通过一致性校验识别规范漏洞并推动评分标准迭代。对构图失衡、色彩失真、肢体畸变、物理不合理、视频卡顿、主体漂移等典型问题进行归因标注,沉淀Badcase库并输出评测质量报告;同时开发单文件HTML离线插件,实现标注团队人效数据自动化分析、风险人员标记、网页预览、CSV导出及智能分析报告生成。

大模型技术
SFTDPORAGReActAgent
开发工具
Trae IDE/WorkClaude CodeCodexDeepSeekChatGPTVisual Studio CodeLibtvMiniMaxHubObsidian
语言能力
英语 CET-4韩语 三级

责任心强,具备稳定的任务交付和团队协作能力。面对复杂或表述模糊的标注规则,能够通过试标、案例讨论和标准校准统一团队认知;严格执行抽检、复核与问题仲裁流程,保障数据一致性和交付质量。

上海电机学院

机电一体化 · 2021 - 2024

韩国庆南大学

机械工程 · 2024 - 2025

精选项目

01 / 06

Drag or Scroll to browse  |  Click to expand  |  Scroll to go back  |  ← → navigate

思考分享

全部文章

开始对话

有项目想要合作?或者只是想打个招呼?随时联系我。

发送邮件 已复制!