亲测对比:抓GitHub万星仓库,Claude Code vs 豆包差距有多大?
作者:程序员罗尼 | 发布:2026-05-06 | 原文:https://mp.weixin.qq.com/s/BwBIifPo372Ah-JZ67iSlw
🎯 本次测试任务
今天我做了一个小测试,让Claude Code和豆包完成同一个任务:
去 GitHub 抓取所有星标超过1万的仓库,分析后生成一份 HTML 格式的报告。
✅ Claude Code表现:拿到完整数据,结果超出预期
符合要求的仓库一共有5000多个,虽然GitHub本身有「单次最多返回1000条结果」的限制,Claude Code还是自己想到了可行方案:按不同星标区间拆分请求,把所有仓库完整抓了下来,后续分析也完全是基于全量数据完成的。
最终生成的HTML报告内容维度很丰富,包含:
- 项目整体总览
- 编程语言分布统计
- Star数量分布统计
- 多维度对比雷达图
- 每年新增万星仓库数量统计
- 头部组织拥有万星仓库数量排名
- 全量仓库列表(自带分页+搜索框,支持关键词检索)
- Tag筛选功能,点击即可过滤仓库
整体体验下来:数据完整,页面交互没有bug,排版也正常,完成度非常高。
❌ 豆包表现:基础数据出错,结果不够理想
豆包从第一步就出了问题:它统计出来的万星仓库只有200多个,基础数据就错了,后续结果自然受影响。
最终生成的报告只有「按领域划分」「按语言划分」两个维度,内容比较单薄,排版也只是勉强能用。
(题外话:两个AI生成的报告都是典型的AI蓝黑暗调风格,这点倒是一致😂)
💬 个人体验总结
就这么一个不算复杂的任务,Claude Code的表现明显更好。
平心而论,豆包平时日常娱乐聊天用着还是挺顺手的,但一碰到这种需要严谨逻辑、解决实际问题的任务,表现确实不够好。国内大模型还有不小的进步空间,继续加油吧~
- 本文采用「人言兑.md」自动排版,主题: 山吹 -
END