Signal Brief

Introducing Kimi K3: Open Frontier Intelligence

Kimi.ai 发布 Kimi K3 大模型,拥有 2.8 万亿参数、1 百万上下文长度和原生多模态支持,采用 Delta Attention 将百万token 解码速度提升 6.3 倍,并通过 Attention Residuals 实现训练效率提升 25% 以下降成本 2%,计划 2026 年 ...

twitter关注列表 Emad (@EMostaque) 发布 2026-07-16 收录 2026-07-16 值得跟进

一句话判断

Delta Attention 在百万token 语境中的 6.3 倍加速及训练效率提升是同类开源模型中罕见,值得跟踪其开源落地对代理编程的影响。

核心信息

Kimi.ai 发布 Kimi K3 大模型,拥有 2.8 万亿参数、1 百万上下文长度和原生多模态支持,采用 Delta Attention 将百万token 解码速度提升 6.3 倍,并通过 Attention Residuals 实现训练效率提升 25% 以下降成本 2%,计划 2026 年 7 月 27 日开放权重。

原始内容

something something recursive self improvement https://t.co/4KyjeK0Bwq ![photo](https://pbs.twimg.com/media/HNXwlvqXwAEodaI.jpg) > **引用原帖 Kimi.ai (@Kimi_Moonshot):** > Introducing Kimi K3: Open Frontier Intelligence > 🔹 2.8 Trillion Parameters, 1 Million Context, Native Multimodal > 🔹 Kimi Delta Attention enables up to 6.3x faster decoding in million-token contexts > 🔹 Attention Residuals deliver ~25% higher training efficiency at <2% additional cost > 🔹 Built for long-horizon agentic coding and self-evolving workflows > Kimi K3 is now live on on https://t.co/zrk6zZxZUo, Kimi Work, Kimi Code, and the Kimi API. > Open Weights by July 27, 2026. > 🔗 API: https://t.co/XCrgjXAqMw > 🔗 Tech blog: https://t.co/YTfiMSNM1f > https://x.com/Kimi_Moonshot/status/2077830229968683203

相关动态

01

Mind Lab 开源长文本强化学习项目

Mind Lab 开源了一个长文本强化学习(RL)项目,支持 2M tokens 的长上下文。相比以往需要数千个 GPU 的 1M 上下文研究,该项目仅需 8 个 GPU 即可完成,大幅降低了超长上下文研究的算力门槛。

twitter关注列表2026-07-17#开源#技术突破#模型
观察
02

BestBlogs 早报 · 07-18

月之暗面发布Kimi K3,2.8万亿参数,896选16的Stable LatentMoE,上下文100万token,接近Fable-5但仍落后最强闭源模型,完整权重7月27日前开源;VentureBeat调查显示54%企业已发生AI代理安全事件;xAI开源Grok Build(84万行Rust代码)并残留上传用户代码痕迹;Cursor评...

twitter关注列表2026-07-17#AI#模型发布#开源
观察
04

Astribot发布Lumo-2

Astribot发布了40亿参数的Lumo-2机器人基础模型,推理速度比前代快2.71倍,支持人类视频和多机器人身体。该模型在105个未见物体上取得更好结果,并在22项涵盖 motion prediction、memory、physical reasoning、long tasks、fine hand control的真实操作任务中表现最...

twitter关注列表2026-07-17#技术#模型发布#AI
观察
05

杨植麟在 GTC 2026 演讲:如何扩展 Kimi K2.5

月之暗面在 GTC 2026 宣布开源三个替代 Transformer 基础组件:MuonClip 优化器(数据效率接近翻倍)、Kimi Linear 线性注意力(3:1 混合全注意力,首个全面超越全注意力的架构)、Attention Residue 残差连接(提升 24% Token 效率)。同时披露 Agent Swarm 支持 10...

twitter关注列表2026-07-17#技术突破#模型发布#开源
观察