一句话判断
建议查看技术报告以掌握其在大规模 Agent 环境中的运行实现。
核心信息
Kimi 发布 K3 模型的权重和技术报告,该模型为 2.8T MoE,支持原生视觉理解,上下文窗口达 1M tokens。新架构在单位算力下的智能提升约 2.5 倍,且开放高性能注意力核、MoE 通信库及大规模 Agent 环境运行基础设施。
原始内容
相关动态
Kimi K3 模型发布(2.8万亿参数)
Moonshot AI在Hugging Face上发布了Kimi K3模型,拥有2.8万亿参数,需1.6TB硬盘空间下载。
Kimi开源FlashKDA内核
Kimi团队开源了FlashKDA(基于CUTLASS的Delta Attention内核),在H20上相比flash-linear-attention基线实现了1.72x-2.22x的预填充加速,可作为即插即用后端。
Kimi K3 开源模型发布
Kimi.ai 发布 Kimi K3,一个 2.8T 参数的 MoE 开源模型,具备原生视觉理解和 1M token 上下文窗口。采用新架构实现每单位计算智能提升 2.5 倍,并开源高性能注意力内核、MoE 通信库和 Agent 运行基础设施。这是目前最大的开源模型。
Kimi K3 全球首个开源 3T 级模型发布
Moonshot 发布 Kimi K3,为全球首个开源 3T 级模型,拥有 2.8T 参数、1M token 上下文、16/896 专家激活,性能仅次于 Fable 5 和 GPT-5.6 Sol,原生支持文本、图像和视频理解,缩放效率是 Kimi K2 的约 2.5 倍,已在 ModelScope 上线。
通义千问K3发布
MoonshotAI 发布Kimi-K3大模型(700B参数,支持多模态并行调度能力),宣称在 위해서는性测试上超越前代版本