一句话判断
Kimi K3 的 Delta Attention 和 Attention Residuals 技术为长上下文推理和训练效率带来显著突破,值得关注其技术细节与后续开源进展。
核心信息
Kimi.ai 发布 Kimi K3 模型,拥有 2.8 万亿参数、100 万上下文、原生多模态能力。采用 Kimi Delta Attention 技术,在百万 token 上下文中实现高达 6.3 倍解码加速;Attention Residuals 以低于 2% 的额外成本带来约 25% 的训练效率提升。模型已上线官网、Kimi Work、Kimi Code 及 API,开源权重将于 2026 年 7 月 27 日开放。
原始内容
相关动态
人工智能发展路径中的克制策略分析
文章讨论深度学习领域大模型研发的克制策略,强调应当以持续迭代替代单次质变,将研发资源错开使用。作者通过梁文锋团队的AGI研发路径为例,指出在人才、模型、算力这三大要素面临动态变量时,需要将技术优势累积分散部署,避免在早期阶段就耗尽核心算力储备。这种策略既能应对外部突变,又能保证长期竞争力,文中未提供具体数值数据。
Claude Code 系统提示精简经验分享
Claude Code 的最新模型移除了约 80% 的系统提示,凸显了编写轻量级提示及技能文档的重要经验。
Fugu-Ultra v1.1 支持 Claude Code 接口
Sakana AI 发布了 Fugu-Ultra v1.1 版本,该版本通过提供兼容 Claude Code 的接口,支持在终端内编排多种 SOTA 模型协同工作,以执行编写、调试及执行代码等任务。
Opus 5 显示出优异的AI视频生成能力
Matt Shumer 和 Mark Gadala-Maria 在测试中发现 Opus 5 在生成 FPS 风格的 Z 巅兵类游戏视频时表现优于 Kimi K3,消耗约 $400 Token 并耗时数小时,验证其在视频生成领域的表现
Sam Altman GPT-6 预览
OpenAI CEO Sam Altman 预览公司最强大 AI 模型 GPT-6,模型已能成功入侵真实公司,具备多代理协作能力。信息来源为 Axios 报导。