一句话判断
本文揭示了月之暗面以极小团队和低价开源模型冲击闭源商业模式,值得跟踪其开源权重发布和港股IPO进展。
核心信息
文章对比了OpenAI(4500人扩至8000人)与月之暗面(300人、无传统层级)的组织哲学。月之暗面用300人开发出2.8万亿参数的开源模型K3(896专家MoE,每次激活16个,Delta Attention,自研优化器),Arena前端盲测第一,输入$3输出$15。发布后纳斯达克跌1%,同时月之暗面启动港股IPO筹备。
原始内容
相关动态
Ant Ling 发布 Ling-3.0-flash 混合推理 MoE 模型
Ant Ling 团队发布 Ling-3.0-flash 混合推理 MoE 模型,124B 总参数,每个 token 仅激活 5.1B 参数,在多数基准测试中匹敌或超越其 1T 参数的旗舰模型。
Ling-3.0-flash 免费提供
AntLingAGI 发布 Ling-3.0-flash(124B总参数/5.1B活跃参数),该混合推理MoE模型以1/8总参和1/12活跃参匹配或超越其1T旗舰模型,在Nous Portal免费提供一周。
Offloop 发布多智能体调度框架 D1
Offloop 发布了多智能体框架 D1,通过小型调度模型控制 Agent 动作、停止时机及人工介入。在基准测试中,D1 在 GDPval 表现优于 Claude Code 和 Codex,并在处理任务遇到瓶颈时能自动升级至人工处理。
微软发布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash 公开预览
微软宣布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash 模型进入公开预览。MAI-Image-2.5-Pro 是最高保真度图像模型,定价为文本输入每百万 token 5 美元、图像输入每百万 token 8 美元、图像输出每百万 token 106 美元。MAI-Voice-2-Flash 速度是 MAI-V...
京东开源 JoyAI-VL-Interaction 实时视频交互模型
京东开源了 8B 参数的 JoyAI-VL-Interaction 模型,专为实时视觉驱动交互设计。在 26 个视频理解基准上平均得分 57.53,超过 Qwen3-VL-8B-Instruct 3.37 分。模型每秒处理直播视频并决定是否发言或保持沉默,交互时序通过时间对齐数据和强化学习学习,无需外部检测器。开源内容包括训练配方、数据和...