Signal Brief

微软发布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash 公开预览

微软宣布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash 模型进入公开预览。MAI-Image-2.5-Pro 是最高保真度图像模型,定价为文本输入每百万 token 5 美元、图像输入每百万 token 8 美元、图像输出每百万 token 106 美元。MAI-Voi...

twitter关注列表 🚨 AI News | TestingCatalog (@testingcatalog) 发布 2026-07-23 收录 2026-07-23 观察

一句话判断

相比 MAI-Voice-2,Flash 版本速度提升 2 倍、成本降低 32%,且集成 Dynamics 365 可降低 GPU 成本 89%,值得关注价格和性能在客服场景的应用。

核心信息

微软宣布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash 模型进入公开预览。MAI-Image-2.5-Pro 是最高保真度图像模型,定价为文本输入每百万 token 5 美元、图像输入每百万 token 8 美元、图像输出每百万 token 106 美元。MAI-Voice-2-Flash 速度是 MAI-Voice-2 的 2 倍,成本降低 32%,定价为每百万字符 15 美元,并集成 Dynamics 365 Contact Center,可降低 GPU 成本最高 89%。

原始内容

MICROSOFT 🔥: New MAI-Image-2.5-Pro and MAI-Voice-2-Flash models have been announced! MAI-Image-2.5-Pro is now in public preview. Pro is our highest-fidelity image model to date, priced at $5 per 1M text input tokens, $8 per 1M image input tokens, and $106 per 1M image output tokens. MAI-Voice-2-Flash is now in public preview. Flash is 2x faster than MAI-Voice-2 and 32% cheaper, priced at $15 per 1M characters. ![photo](https://pbs.twimg.com/media/HN7sYO5XsAAm0_7.jpg) > **引用原帖 Mustafa Suleyman (@mustafasuleyman):** > MAI-Voice-2-Flash launches today! Flash is 2x faster than MAI-Voice-2 and 32% cheaper, at $15 per 1M characters. > MAI-Voice-2-Flash is also in public preview and powers Dynamics 365 Contact Center, our enterprise platform for call center agents, and reduces GPU costs up to 89%. > More here... > https://t.co/JVU42BGuQ7 > https://x.com/mustafasuleyman/status/2080336147256127960

相关动态

01

OpenAI 推出桌面版 ChatGPT Voice 语音控制功能

OpenAI 在 macOS 和 Windows 桌面应用中推出 ChatGPT Voice 功能,基于 GPT-Live 模型,支持用户通过语音控制电脑、同时指挥多个 agents,实现语音交互与任务协调。该功能面向 Plus、Pro、Business、Edu 和 Enterprise 计划用户,全球逐步上线。

twitter关注列表2026-07-23#AI#产品更新#模型
观察
03

月之暗面300人做出开源大模型K3,引发纳斯达克震荡

文章对比了OpenAI(4500人扩至8000人)与月之暗面(300人、无传统层级)的组织哲学。月之暗面用300人开发出2.8万亿参数的开源模型K3(896专家MoE,每次激活16个,Delta Attention,自研优化器),Arena前端盲测第一,输入$3输出$15。发布后纳斯达克跌1%,同时月之暗面启动港股IPO筹备。

twitter关注列表2026-07-23#模型发布#大模型#开源
观察
05

京东开源 JoyAI-VL-Interaction 实时视频交互模型

京东开源了 8B 参数的 JoyAI-VL-Interaction 模型,专为实时视觉驱动交互设计。在 26 个视频理解基准上平均得分 57.53,超过 Qwen3-VL-8B-Instruct 3.37 分。模型每秒处理直播视频并决定是否发言或保持沉默,交互时序通过时间对齐数据和强化学习学习,无需外部检测器。开源内容包括训练配方、数据和...

twitter关注列表2026-07-23#模型发布#技术突破#开源
观察