亲测对比:抓GitHub万星仓库,Claude Code vs 豆包差距有多大?

作者:程序员罗尼 | 发布:2026-05-06 | 原文:https://mp.weixin.qq.com/s/BwBIifPo372Ah-JZ67iSlw


🎯 本次测试任务

今天我做了一个小测试,让Claude Code豆包完成同一个任务:

去 GitHub 抓取所有星标超过1万的仓库,分析后生成一份 HTML 格式的报告。


✅ Claude Code表现:拿到完整数据,结果超出预期

符合要求的仓库一共有5000多个,虽然GitHub本身有「单次最多返回1000条结果」的限制,Claude Code还是自己想到了可行方案:按不同星标区间拆分请求,把所有仓库完整抓了下来,后续分析也完全是基于全量数据完成的。

最终生成的HTML报告内容维度很丰富,包含:

  • 项目整体总览
  • 编程语言分布统计
  • Star数量分布统计
  • 多维度对比雷达图
  • 每年新增万星仓库数量统计
  • 头部组织拥有万星仓库数量排名
  • 全量仓库列表(自带分页+搜索框,支持关键词检索)
  • Tag筛选功能,点击即可过滤仓库

整体体验下来:数据完整,页面交互没有bug,排版也正常,完成度非常高。


❌ 豆包表现:基础数据出错,结果不够理想

豆包从第一步就出了问题:它统计出来的万星仓库只有200多个,基础数据就错了,后续结果自然受影响。

最终生成的报告只有「按领域划分」「按语言划分」两个维度,内容比较单薄,排版也只是勉强能用。

(题外话:两个AI生成的报告都是典型的AI蓝黑暗调风格,这点倒是一致😂)


💬 个人体验总结

就这么一个不算复杂的任务,Claude Code的表现明显更好。

平心而论,豆包平时日常娱乐聊天用着还是挺顺手的,但一碰到这种需要严谨逻辑、解决实际问题的任务,表现确实不够好。国内大模型还有不小的进步空间,继续加油吧~

  • 本文采用「人言兑.md」自动排版,主题: 山吹 -
END