一句话判断
相比 1T 旗舰模型,仅用 1/12 的活跃参数即达到同等性能,值得关注其 MoE 架构效率。
核心信息
Ant Ling 团队发布 Ling-3.0-flash 混合推理 MoE 模型,124B 总参数,每个 token 仅激活 5.1B 参数,在多数基准测试中匹敌或超越其 1T 参数的旗舰模型。
原始内容
相关动态
月之暗面300人做出开源大模型K3,引发纳斯达克震荡
文章对比了OpenAI(4500人扩至8000人)与月之暗面(300人、无传统层级)的组织哲学。月之暗面用300人开发出2.8万亿参数的开源模型K3(896专家MoE,每次激活16个,Delta Attention,自研优化器),Arena前端盲测第一,输入$3输出$15。发布后纳斯达克跌1%,同时月之暗面启动港股IPO筹备。
Ling-3.0-flash 免费提供
AntLingAGI 发布 Ling-3.0-flash(124B总参数/5.1B活跃参数),该混合推理MoE模型以1/8总参和1/12活跃参匹配或超越其1T旗舰模型,在Nous Portal免费提供一周。
Offloop 发布多智能体调度框架 D1
Offloop 发布了多智能体框架 D1,通过小型调度模型控制 Agent 动作、停止时机及人工介入。在基准测试中,D1 在 GDPval 表现优于 Claude Code 和 Codex,并在处理任务遇到瓶颈时能自动升级至人工处理。
微软发布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash 公开预览
微软宣布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash 模型进入公开预览。MAI-Image-2.5-Pro 是最高保真度图像模型,定价为文本输入每百万 token 5 美元、图像输入每百万 token 8 美元、图像输出每百万 token 106 美元。MAI-Voice-2-Flash 速度是 MAI-V...
研究者用GPT-5.6解决6个Erdős问题
研究者Shouqiao Wang使用OpenAI的GPT-5.6 Sol Ultra在Codex环境中,在5天内提出了6个Erdős问题的证明方案,并公布了完整的研究过程。工作流程包括多次迭代:尝试、失败、诊断、新方法、证明草稿、对抗性审计、修复。