Signal Brief

ChatGPT 桌面版上线语音控制功能

OpenAI 发布 ChatGPT 桌面版语音功能,由 GPT-Live 驱动,支持语音控制电脑并协调 ChatGPT Work 和 Codex 多智能体协作,今日起在 macOS 和 Windows 面向 Plus、Pro、Business、Edu、Enterprise 订阅用户全球推出。

twitter关注列表 Berryxia.AI (@berryxia) 发布 2026-07-23 收录 2026-07-23 观察

一句话判断

首次在桌面端实现语音驱动多智能体协作,值得尝试语音控制代码与工作流自动化。

核心信息

OpenAI 发布 ChatGPT 桌面版语音功能,由 GPT-Live 驱动,支持语音控制电脑并协调 ChatGPT Work 和 Codex 多智能体协作,今日起在 macOS 和 Windows 面向 Plus、Pro、Business、Edu、Enterprise 订阅用户全球推出。

原始内容

CHATGPT 桌面版已经可以使用语音功能,可以直接对话控制电脑,并且可以使用Work、或者Codex等! Mac&Windows,订阅用户基本都可以使用了,Plus Pro 企业教育等,你就说烧不烧token吧! > **引用原帖 OpenAI (@OpenAI):** > ChatGPT Voice is now in the desktop app. > Control your computer and direct multiple agents running in ChatGPT Work or Codex, using just your voice. > It's powered by GPT-Live, so it can speak, listen, and coordinate work in the app at the same time. > Rolling out globally today on macOS and Windows to Plus, Pro, Business, Edu, and Enterprise plans. > https://x.com/OpenAI/status/2080378182469857576

相关动态

01

FLUX 3 将极大影响机器人智能和学习

Black Forest Labs 发布 FLUX 3 统一多模态模型,支持图像、视频、音频和动作预测。其 Self-Flow 架构使机器人微调数据减少一半,相比早期模仿视频实验,机器人训练数据减少 10 倍,通过大规模视频预训练隐式学习物理规律。

twitter关注列表2026-07-23#模型发布#多模态#技术突破
观察
02

Black Forest Labs 发布 FLUX 3 统一多模态模型

Black Forest Labs 发布 FLUX 3,采用统一架构同时处理图像生成、视频、原生音频和机器人动作预测。视频已开放早期访问,后续将开放权重,并与 mimic、Audi 合作在真实机器人上运行。团队认为物理世界智能与内容创作可共享同一视觉基础模型。

twitter关注列表2026-07-23#模型发布#多模态#技术突破
观察
03

Sonilo 发布音频模型 1.0

Sonilo 发布了视频原生音频模型 Sound Effects 1.0,可自动从视频同步音频,支持三分钟输入并可根据文本生成独立音频素材。该模型与现有的 Video2Music 和 Text2Music 工具集成,Fal 独家提供 Day Zero API,并在基准测试中声称超越领先模型。

twitter关注列表2026-07-23#产品发布#技术突破
观察
04

OpenAI 推出桌面版 ChatGPT Voice

OpenAI 在桌面应用上推出 ChatGPT Voice 功能,基于 GPT-Live 1 全双工语音模型,支持语音控制多个 agent,面向 Plus、Pro、Business、Edu 和 Enterprise 计划的用户,覆盖 macOS 和 Windows 平台,iOS 可通过配对远程访问。

twitter关注列表2026-07-23#AI#产品发布#技术更新
观察