一句话判断
AMD MI355X在大型MoE模型上实现Nvidia B200的性能差距,提供了低成本的硬件替代方案,值得关注。
核心信息
MiniMax团队宣布AMD MI355X GPU现已达到与Nvidia B200相当的MiniMax-M3推理性能,并发布了两份技术博客,详细介绍了为该公司428B MSA稀疏MoE多模态基础模型提供的ATOM+ATOMesh全栈协同优化方案。优化方案包括EAGLE3猜测解码(降低生成延迟)、MSA对齐的Page-16 KV缓存(支持1M超长上下文)、分层FP8量化(防止视觉/MoE精度下降)以及分布式P/D分离架构(适用于大规模集群)。
原始内容
相关动态
karminski 开源 VibeGamer 项目
项目团队在 GitHub 上开源了 VibeGamer,这是一个旨在协助游戏策划师设计独特而有趣的 AI 角色的框架。该项目包括 AI 未来事件预测、生成 OST(原声音乐)、使用 Stable Diffusion 生成环境设计的功能模块。原始提交包含了 Hugging Face Inference 接口和 Colab 集成等技术实现细节...
Devin 破解三个未解决数学猜想
Devin(AI编程助手)在一天内破解三个未解决数学猜想:驳斥了开放约40年的Graffiti猜想154,证明了同样开放约40年的Graffiti猜想39和40,并驳斥了开放约20年的Brandt's Regular Supergraph Problem。
BestBlogs 早报 · 07-23
OpenAI 推出面向企业的语音与聊天 AI Agent 平台 Presence,具备策略、护栏、升级规则和模拟评测等闭环系统,其自有电话支持已能独立解决 75% 的来电问题,并在 10 天内将人工转接率降低 15 个百分点,目前仅面向符合条件的企业限量开放。早报还涵盖 NVIDIA Rubin GPU 架构、Anthropic 2 亿美...
谷歌二季度 AI 增长战报
Google CEO Sundar Pichai announced Q2 results, noting Alphabet revenue rose 24% YoY, Google Cloud grew 82%, Gemini app reached 950M monthly active users, model APIs proce...
Yann LeCun 转发介绍 Patch Policy 架构
Gaoyue Zhou 团队提出 Patch Policy 架构,允许基于 transformer 的策略直接使用密集视觉 token,无需大语言模型,在操纵任务中比微调 7B VLA 性能高 18%,参数量仅为其 0.7%。