专注于 Agent、AI 评测与 AI 原生产品体验,擅长将复杂技术能力转化为清晰的产品叙事与可落地的用户体验。
我关注如何把模型能力转化为用户能够理解、信任并真正使用的产品——从 Deep Research Agent、LLM 评测流程,到无代码模型微调和 AI 图像生成工作流。
- Agent 产品: Deep Research、多智能体协作、Research Plan、Trace 分析
- 模型与 Agent 评测: Benchmark、Rubric 设计、自动评测与 Bad Case 归因
- AI 原生工作流: MCP、Agent Skills、CLI 工具、RAG、Prompt 与 Loop Engineering
- 产品交付: MVP 定义、交互设计、用户研究与数据驱动迭代
| 产品 | 产品简介 | 我的工作 |
|---|---|---|
| 语鲸 LingoWhale | 聚合信息收集、阅读、总结、原文定位与知识理解的 AI 阅读工作台 | 参与 AI 新闻推荐优化相关的产品工作 |
| Deep Research Agent | 自动制定研究计划、检索多源信息并生成可溯源长报告 | Agent 产品链路、交互设计与评测体系 |
| ERNIE-Image 体验站 | 将图像生成模型转化为低门槛、场景化的在线创作体验 | MVP 定义、交互设计与 Agent Skill 场景 |
| We0.ai | AI 网站生成与获客平台 | 产品定义、用户引导与 AI Coding Benchmark |
| 项目 | 项目简介 | 我的工作 |
|---|---|---|
| CLI Trainer | 通过 Agent Skill 在 AI Studio 完成 SFT、LoRA、DPO 训练 | 训练流程、兼容规则、状态反馈与失败恢复 |
| Xinghe Image | 使用 ERNIE-Image 生成封面、文章配图、信息图和小红书图文 | 场景设计、Prompt 预设与内容生产工作流 |
| Nomi | 结合微信小程序、Raspberry Pi 与便携照片打印的 AI 记忆相机 | 产品流程、小程序前端与软硬件打印闭环 |
| Kiveiv 官网 | 展示 Kiveiv 数据智能与本体解决方案的简洁企业官网 | 信息结构、视觉体系、响应式前端和移动端/微信体验优化 |
- 参与多智能体自动评测工作流,包括 Rubric 设计、分歧分析与 Bad Case 迭代
- 参与 AI Studio ERNIE-Image 体验站的产品定义与交互设计;上线后关联模型 API 累计调用 26.8 万+,单日峰值 3.6 万+
- 参与 Deep Research Agent 的评测体系与产品链路建设,覆盖结果质量、执行轨迹、引用溯源与效率
- 参与 We0.ai 从 0→1 的产品建设;项目获得 Product Hunt 精选、参展 WAIC,并获得奇绩创坛投资
- 阿里云 AI Bot 大赛全国冠军
LLM Evaluation · Multi-Agent · Deep Research · RAG · MCP · Agent Skills
Prompt Engineering · Vibe Coding · SQL · Python · HTML/CSS/JavaScript
ENFJ、AIGC 玩家、播客重度听众。喜欢认识有趣的人,也享受独立思考。工作是我的一部分,但不是全部。
📘 查看我的个人说明书与项目记录
这里记录了我的经历、项目、沟通偏好、生活兴趣,以及正在探索的问题。
我持续关注一个简单的问题:怎样让 AI 系统从“能够生成”,走向“帮助用户可靠地完成真实任务”?


