一句话判断
与 v2 相比,v3 将代码内容内联、重新爬取最新版本,数据量增长约 9 倍,适合训练代码模型,值得点开原文查看具体格式和下载方式。
核心信息
BigCode 社区发布 The Stack v3,这是目前最大的开放代码数据集:114 TB 原始数据、770 种语言、2.24 亿个仓库,约 5T tokens。与 v2(2024年,68 TB 原始数据,约 550B tokens,618 种语言)相比,v3 实现了 10 倍 token 增长,内容直接内联(不再需要从 Software Heritage 获取),并重新爬取 GitHub 至 2025 年 8 月,仅包含星数≥5 的 fork。
原始内容
相关动态
OpenCode爆炸增长数据
Y Combinator 在播客中披露,OpenCode(开源替代 Claude Code 和 Codex 的 AI 编码工具)自年初起增长至 460 万周活用户、1300 万月活用户,年化收入约 4000 万美元,处理了 7 万亿 tokens,CEO Jay V 谈到 Anthropic 争议和 20 倍增长驱动因素。
Atomic Agent GAIA基准胜Hermes
Atomic Agent在GAIA Level 1基准测试中以69.8%正确率超越Hermes的58.5%,速度快1.6倍(3h12m vs 5h10m),使用相同4-bit Qwen-3.6-35B模型和Apple M4 Max硬件,开源MIT许可。
Grok 4.5 在发票处理测试中击败竞品
Ramp 测试了 Grok 4.5 等模型在 150k 张真实发票上的表现,Grok 4.5 获得最高完美提取率,击败了 Gemini Flash 3.6、GPT 5.6 Terra 和 Sonnet 5。
Grok 集成 Google Workspace
Grok 已集成到 Google Workspace,通过侧边栏插件在 Sheets、Slides、Docs 中提供数据解释、公式书写、演示生成、文档起草等功能,无需频繁切换标签页,组织可批量部署。
Claude Opus 5 在 3D 编码测试中超越 Fable 5,价格仅为其三分之四
Anthropic 发布了 Claude Opus 5,官方称其为 '思慎且主动的模型',性能接近 Claude Fable 5 但价格仅为后者一半。Opus 5 在 frontier-bench v0.1(43.3%)、gdpval-aa v2(1861)、arc-agi-3(30.2%)、zapier automationbench(...