Signal Brief

Kimi K3 模型发布

Kimi 发布 K3 模型的权重和技术报告,该模型为 2.8T MoE,支持原生视觉理解,上下文窗口达 1M tokens。新架构在单位算力下的智能提升约 2.5 倍,且开放高性能注意力核、MoE 通信库及大规模 Agent 环境运行基础设施。

twitter关注列表 Kimi.ai (@Kimi_Moonshot) 发布 2026-07-27 收录 2026-07-27 观察

一句话判断

建议查看技术报告以掌握其在大规模 Agent 环境中的运行实现。

核心信息

Kimi 发布 K3 模型的权重和技术报告,该模型为 2.8T MoE,支持原生视觉理解,上下文窗口达 1M tokens。新架构在单位算力下的智能提升约 2.5 倍,且开放高性能注意力核、MoE 通信库及大规模 Agent 环境运行基础设施。

原始内容

Releasing the model weights and technical report of Kimi K3. Kimi K3 is our most capable model: a 2.8T MoE model with native visual understanding and a 1M-token context window. New model architecture: 2.5x the intelligence per unit of compute, not just more params. Alongside Kimi K3, we're opening up more of the stack behind it — high-performance attention kernels, MoE communication library, and infrastructure for running agent environments at scale. Model weights: https://t.co/7m7eEg6Y0B Tech report: https://t.co/yeu6cjpMCT Tech blog: https://t.co/YTfiMSNM1f ![photo](https://pbs.twimg.com/media/HOPlk-WbQAAMkwd.jpg)

相关动态

02

Kimi开源FlashKDA内核

Kimi团队开源了FlashKDA(基于CUTLASS的Delta Attention内核),在H20上相比flash-linear-attention基线实现了1.72x-2.22x的预填充加速,可作为即插即用后端。

twitter关注列表2026-07-27#开源#技术突破#模型发布
观察
03

Kimi K3 开源模型发布

Kimi.ai 发布 Kimi K3,一个 2.8T 参数的 MoE 开源模型,具备原生视觉理解和 1M token 上下文窗口。采用新架构实现每单位计算智能提升 2.5 倍,并开源高性能注意力内核、MoE 通信库和 Agent 运行基础设施。这是目前最大的开源模型。

twitter关注列表2026-07-27#模型发布#开源#大模型
值得跟进
04

Kimi K3 全球首个开源 3T 级模型发布

Moonshot 发布 Kimi K3,为全球首个开源 3T 级模型,拥有 2.8T 参数、1M token 上下文、16/896 专家激活,性能仅次于 Fable 5 和 GPT-5.6 Sol,原生支持文本、图像和视频理解,缩放效率是 Kimi K2 的约 2.5 倍,已在 ModelScope 上线。

twitter关注列表2026-07-27#模型发布#开源#大模型
观察