PROJECTS · CASE STUDIES × 3

三个产品, 一个方法论。 THREE CASES, END TO END

每个案例都完整讲清楚四件事:问题是什么、架构怎么设计、评测怎么驱动、最后做成了什么

Multi-Agent · 企业服务 · 独立完成 2025.12 — 2026.08 · 九个月

全球商业洞察 Agent

GLOBAL BUSINESS INSIGHT AGENT

企业出海最缺的不是数据,而是「可溯源的判断」。从印尼田野调研与 30+ 企业访谈出发, 定义四项产品指标;Harness + Multi-Agent 架构协同 Search Planner / Insight / Report / Critic; 覆盖 195 国、2,367 个分层信源与 71,904 Chunk 知识库;代码硬门禁 + LLM-as-Judge 五轮迭代, 综合评分 +13%,硬门禁通过率 100%。

Multi-AgentRAG信源工程LLM-as-JudgeVercel 部署
+13%综合评分提升 +25%Actionability 100%硬门禁通过率
对话推荐 · 知识图谱 · 独立完成 2026.07 — 2026.08 · 六周冲刺

知香 · 香水导购 Agent

FRAGRANCE SHOPPING AGENT

「知识图谱负责理解,真实商品源负责供给」——自然语言找香、多轮澄清偏好记忆, 覆盖 1,971 款香水 / 346 品牌 / 504 香原料的知识图谱接入拼多多与淘宝联盟; 设计四级分级召回策略,三轮迭代基础集评分 +39%。

知识图谱对话推荐分级召回Taro / React / SSE
+39%基础集评分提升 1,971款香水知识图谱 2 平台真实商品源接入
AI 数据生产 · 学术成果 · 主导完成 2024.01 — 2025.05 · 十七个月

国际气候谈判 LLM 智能标注系统

LLM ANNOTATION SYSTEM FOR CLIMATE NEGOTIATIONS

用 LLM 重塑社会科学数据生产:基于 6.2 万历史标注完成 Prompt / Few-shot / SFT 三路线验证并推动转向; 协同北大王选所设计 Expert-Augmented 架构;组建并管理 11 人标注团队构建 「预标注—审读—归因—回流—迭代」闭环;复杂任务 Recall 54% → 87.9%,超人工基线, 成果入选 2025 Asian PolMeth Conference。

SFT 微调Expert-Augmented数据闭环团队管理
54%→87.9%复杂任务 Recall 45,051条互动数据自动生成 1995-2024覆盖时间跨度扩展

// 更多佐证材料:教育与获奖见 关于页 ↗ · 完整简历可下载 PDF