Signal Brief

Kimi K3 终于来了,最强开源模型!

Moonshot AI 发布 Kimi K3 开源模型,参数量 2.8 万亿,支持 100 万 token 上下文及原生多模态。在 Frontend Code Arena 基准测试中获得 1679 分,超过 Claude Fable 5(1631 分)和 GPT‑5.6 Sol(1618 分),整体...

twitter关注列表 meng shao (@shao__meng) 发布 2026-07-17 收录 2026-07-17 值得跟进

一句话判断

建议在权重开放后重点评估其在长上下文代理编码和知识工作中的实际表现及社区采纳情况。

核心信息

Moonshot AI 发布 Kimi K3 开源模型,参数量 2.8 万亿,支持 100 万 token 上下文及原生多模态。在 Frontend Code Arena 基准测试中获得 1679 分,超过 Claude Fable 5(1631 分)和 GPT‑5.6 Sol(1618 分),整体性能仅次于 Claude Fable 5 和 GPT 5.6 Sol,优于 Claude Opus 4.8、GPT 5.5、GLM‑5.2 等模型。此外,Kimi Delta Attention 可在百万 token 上下文中提升解码速度 6.3 倍,Attention Residuals 带来约 25% 训练效率提升且额外成本低于 2%,权重计划于 2026 年 7 月 27 日前开放。

原始内容

Kimi K3 终于来了,最强开源模型! 全球首个 3T (2.8T) 级开放模型、1M token 上下文、原生多模态,定位于长时程智能体编码、知识工作与推理,权重将于 7 月 27 日前开放。 整体表现仅弱于 Claude Fable 5 和 GPT 5.6 Sol,在开源模型中整体表现最强,评测中稳定领先 Claude Opus 4.8、GPT 5.5、GLM-5.2 等其余所有模型。 在 @arena 的 Frontend Code Arena 中最强,拿到 1679 分,强于第二名 Claude Fable 5 的 1631 分,第三名 GPT-5.6 SOol 1618 分。 详细报告和案例展示看这里: https://t.co/DBesVl0auk ![photo](https://pbs.twimg.com/media/HNY5n2PbEAAmg-u.jpg) > **引用原帖 Kimi.ai (@Kimi_Moonshot):** > Introducing Kimi K3: Open Frontier Intelligence > 🔹 2.8 Trillion Parameters, 1 Million Context, Native Multimodal > 🔹 Kimi Delta Attention enables up to 6.3x faster decoding in million-token contexts > 🔹 Attention Residuals deliver ~25% higher training efficiency at <2% additional cost > 🔹 Built for long-horizon agentic coding and self-evolving workflows > Kimi K3 is now live on on https://t.co/zrk6zZxZUo, Kimi Work, Kimi Code, and the Kimi API. > Open Weights by July 27, 2026. > 🔗 API: https://t.co/XCrgjXAqMw > 🔗 Tech blog: https://t.co/YTfiMSNM1f > https://x.com/Kimi_Moonshot/status/2077830229968683203

相关动态

01

Mind Lab 开源长文本强化学习项目

Mind Lab 开源了一个长文本强化学习(RL)项目,支持 2M tokens 的长上下文。相比以往需要数千个 GPU 的 1M 上下文研究,该项目仅需 8 个 GPU 即可完成,大幅降低了超长上下文研究的算力门槛。

twitter关注列表2026-07-17#开源#技术突破#模型
观察
02

BestBlogs 早报 · 07-18

月之暗面发布Kimi K3,2.8万亿参数,896选16的Stable LatentMoE,上下文100万token,接近Fable-5但仍落后最强闭源模型,完整权重7月27日前开源;VentureBeat调查显示54%企业已发生AI代理安全事件;xAI开源Grok Build(84万行Rust代码)并残留上传用户代码痕迹;Cursor评...

twitter关注列表2026-07-17#AI#模型发布#开源
观察
04

Runway Agent 在第三方评测中全面领先

Physion Labs 发布 Physion-Arc 1.0 基准测试,对 Runway、Luma、MiniMax、Kling、Utopia 和 TapNow 六款 AI 视频代理进行独立人类评估,使用 30 个电影提示和 16 个指标。Runway Agent 2.0 在叙事连贯性、电影语言和制作质量三项核心维度全部排名第一。

twitter关注列表2026-07-17#评测#多模态#模型
观察
05

Claude Managed Agents 支持500个技能项目升级

Anthropic 在Claude 3系列推出2024年2月新特性,实现代理系统技能数量扩展至500项,增强自定义化程度。更新后的API参数文档显示请求头需包含新版本控制标识符v20240201。相较Claude 2的100技能限制,新版本实现10倍扩容空间,核心优化体现在事件触发策略更新与上下文处理模块重构。

twitter关注列表2026-07-17#技术更新#产品改进#多模态
观察