一句话判断
-modal开发了DFlash speculator技术,实现3T模型无损加速推理,较既有开源模型有技术差异
核心信息
Moonshot与Modal合作发布Kimi K3大模型,该模型参数量达到3T级别。Modal通过定制DFlash speculator架构优化,使模型推理速度加快且无性能损失。Modal作为Day 0合作伙伴参与推出,强调该模型为目前合作过的最强大开源模型。
原始内容
相关动态
Kimi开源FlashKDA内核
Kimi团队开源了FlashKDA(基于CUTLASS的Delta Attention内核),在H20上相比flash-linear-attention基线实现了1.72x-2.22x的预填充加速,可作为即插即用后端。
通义千问K3发布
MoonshotAI 发布Kimi-K3大模型(700B参数,支持多模态并行调度能力),宣称在 위해서는性测试上超越前代版本
Kimi K3 开源权重及技术报告
Kimi.ai 开源其最强模型 Kimi K3 的权重和技术报告。Kimi K3 是一个 2.8T 参数的 MoE 模型,支持原生视觉理解和 1M token 上下文窗口,采用新架构使每单位计算智能提升 2.5 倍。同时开源高性能 attention kernels、MoE 通信库和用于规模化运行 agent 环境的基础设施。
模型不是瓶颈,Harness 才是;而 Harness 里最被低估的一层是上下文质量
企业 Agent 应用中,上下文跨散系统导致信息关系无法整合。Glean 提出通过 MCP Gateway 集中构建统一索引 + 知识图谱,将跨系统数据的关联解耦到上下文层,测试中偏好率提升 2.5 倍且节省 30% Token 成本。方案同时通过 Glean 授权层解决了 MCP 级别的零散权限治理。
技术突破:Telstra Starlink直接覆盖服务扩展到澳大利亚
Telstra 扩展了其 Starlink Direct to Cell 服务,使澳大利亚客户可在无地面网络覆盖区使用 iMessage、Google Maps 等选定应用,实现移动端通信普及。该服务最初针对 SMS,现已扩展至多款现代应用,标志着卫星通信覆盖能力的显著提升。