一句话判断
阐述开源生态发展的重要宣言,为行业合作提供参考
核心信息
一群强大的共识推出声明称“我们相信、我们关心”,被认为是开源生态的重要宣言。原文基于作者情感表达,未包含技术数据或具体事件
原始内容
A big day for open models, I feel like I can relax a little, soak it in. An incredibly powerful coalition said "we believe, we care." That's rare on any topic.
相关动态
01
Kimi K3 性能接近 Claude
Moonshot AI 的 Kimi K3 在 DeepSWE 基准上与 Anthropic 的 Claude Fable 5 性能接近,单次任务成本约为后者的三分之一,在多次尝试场景下实现超越。
观察
02
Claude Opus 5 发布:接近 Fable 5 的智能程度,价格只有一半,与 Opus 4.8 保持同价
Anthropic 发布 Claude Opus 5,定价与 Opus 4.8 持平(输入 $5/M tokens,输出 $25/M tokens),性能接近 Fable 5 但成本仅为其半数,定位为高频可用的高端模型。基准测试显示其在 Frontier-Bench v0.1 编码任务中超越 Opus 4.8 超过一倍,ARC-AGI-3...
值得跟进
03
Meta 发布 Llama 3 8B
Meta 发布 Llama 3 8B 与 70B 两款模型,参数量分别为 8B 和 70B。 在 MMLU 基准上,8B 版本比 Llama 2 提升 5%,70B 版本提升 3%。
观察
04
BestBlogs 早报 07-25: Claude Opus 5 等
Anthropic 发布 Claude Opus 5 旗舰模型,Frontier-Bench 得分超前代两倍,ARC-AGI 3 是次优模型三倍,但网络安全能力落后。Moonshot 开源 Kimi K3 开放权重模型;火山引擎开源 SearchCLI Agent 搜索技术;AMD 发布 MI455X 等硬件。
观察
05
Sakana AI 发布 Fugu 模型
Sakana AI 发布新模型 Fugu,参数量为 1B,在 MMLU 基准上达到 75% 准确率,比同规模模型高出 5 个百分点。该模型采用高效训练技术,但未开源。
观察