两个月业余时间拿下 KDD Cup 冠军:大众点评团队的 Agent 打怪记
项目分享 2 次阅读

两个月业余时间拿下 KDD Cup 冠军:大众点评团队的 Agent 打怪记

KDD Cup 2026 放榜了,大众点评技术部拿下了 DataAgents 赛道的冠军和季军。这比赛在数据挖掘圈的分量不用多介绍,全球顶级赛事,能站上领奖台的都是狠角色。更让我好奇的是他们的打法:两个月,业余时间,把自家产品沉淀的能力搬过来打比赛,还真打赢了。

这赛道到底考什么

DataAgents 赛道考的是"数据智能体"——给你一包乱七八糟的异构数据,里面有数据库、PDF 报告、JSON、图表甚至视频,再抛给你一个高层次的自然语言问题,让 AI 自己拆解任务、选工具、调数据、推理,最后给出答案。

听着简单,做起来全是坑。真实数据有"异构鸿沟",一份 PDF 里的数字和数据库里的对不上是常事;推理链路又是非线性的,得并行分支、迭代循环、结果汇聚。中间还有干扰信息专门等着误导你。一句话,考的是 Agent 在真实乱局里的生存能力。

他们的打法:把家底搬出来

团队把做"问点仔"(大众点评的 AI 助手)时积累的 Agent Harness 能力直接迁移到赛题上,业余时间搭了一套完整的 Agent 运行时:支持多类型数据文件自主探索,SQL、Python 分析工具自己选自己执行,还加了错误反馈、超时控制、自动重试这些保命机制。

针对视频和非结构化文档这两个老大难,他们又专门做了多模态视频理解子智能体和非结构化文档 ETL 子智能体,给主智能体打辅助。说白了,不是比赛时临时抱佛脚,而是平时工程化沉淀的东西正好用上了。

对我们做项目有啥启发

第一,底层能力要可复用。他们赢在 Harness 不是为比赛现写的,而是产品里磨过的。你做副业、做开源项目也一样,把通用能力抽象出来,关键时刻能省一半时间。

第二,稳定性和容错比"聪明"更重要。长链路任务里,能自动重试、能超时兜底的 Agent,比一个偶尔惊艳但经常翻车的强太多。

第三,比赛代码他们已经在 GitHub 开源了(搜 kddcup2026_champion 就能找到)。想学 Agent 工程化的,直接去看冠军代码,比自己瞎琢磨快得多。这波,属于是既赢了奖杯,又给行业留了份教材。

分享

评论 (0)

评论通过后显示

暂无评论,来写第一条吧 ✍️