一句话判断
新增信息:桌面版首次支持语音实时操控多 agents,并基于 GPT-Live 模型实现低延迟交互,与网页版纯文本模式有本质区别。
核心信息
OpenAI 在 macOS 和 Windows 桌面应用中推出 ChatGPT Voice 功能,基于 GPT-Live 模型,支持用户通过语音控制电脑、同时指挥多个 agents,实现语音交互与任务协调。该功能面向 Plus、Pro、Business、Edu 和 Enterprise 计划用户,全球逐步上线。
原始内容
相关动态
英美政府安全机构联合评估Kimi K3网络安全能力
英美政府安全机构联合发布报告,对比Kimi K3与美国前沿模型的网络安全能力。Kimi K3在模拟攻击中平均步骤17,而美国最强模型达28.5;在ExploitBench中,Kimi K3评分32.2%,美国领先模型76.2%,GLM-5.2为24.4%。
微软发布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash 公开预览
微软宣布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash 模型进入公开预览。MAI-Image-2.5-Pro 是最高保真度图像模型,定价为文本输入每百万 token 5 美元、图像输入每百万 token 8 美元、图像输出每百万 token 106 美元。MAI-Voice-2-Flash 速度是 MAI-V...
Agent Identity and Access Management Challenges
探讨有效无限数量代理管理的安全性问题,包括权限继承、生命周期管理、审计实践等技术挑战,强调当前IAM体系无法应对代理的爆发性扩张特性
Gemma 4 下载量突破 3 亿
Google Gemma 宣布 Gemma 4 模型下载量已突破 3 亿次。
硅谷公司敦促不要切断中国开源AI模型
近200家硅谷公司(包括Proton和Y-Combinator)联合敦促特朗普政府不要切断对中国开源权重AI模型的访问,否则可能损害美国下一代初创企业。