一句话判断
建议关注其在美国的使用情况以评估功能效果
核心信息
OpenAI 开始向美国用户滚动 ChatGPT 健康功能,支持连接 Apple Health 与医疗记录,每周有超过 3 亿人进行健康相关提问。该功能基于 GPT‑5.5 Instant 与 GPT‑5.6 Sol 两代模型,经数百名医师评估,且不使用连接的医疗数据进行模型训练或广告定位。
原始内容
相关动态
多代理系统中消除代理冗余工作的进展
Offloop开发了D1调度模型,降低多代理系统的冗余成本,在GDPval基准测试中达成SOTA,与Claude Code和Codex相比效率提升显著,关键数据未明确具体值量值数据(如2.4万亿年收入、技术细节)未具体说明,属于中等价值资讯。
Google DeepMind推出Gemini 3.5 Flash Cyber,轻量化模型专为安全团队设计
Google DeepMind开发Gemini 3.5 Flash Cyber以提升代码漏洞检测效率。该模型通过测试自家代码库(如Google Chrome和Android代码库),展现出捕捉标准模型忽略的复杂漏洞能力,无营销性言论或质量评价。Google DeepMind推出Gemini 3.5 Flash Cyber, Google ...
Atomic Agent 开源本地智能体发布
Atomic 发布开源本地智能体 Atomic Agent,基于 llama.cpp 运行 Qwen、Gemma、Llama 模型,通过 ARIA 快照操作浏览器、编辑文件、执行 shell 命令,具备持久化跨会话记忆,采用稳定前缀缓存降低成本及 TurboQuant 将 KV 缓存压缩 6.4 倍,在 GAIA Level 1 基准上以...
Harness Handbook论文提升编码代理规划胜率
Harness Handbook论文提出使用静态分析和LLM辅助的BGPD流程,构建从运行时行为到源码位置的映射,在60个修改请求上规划胜率从28.3%提升至38.3%和从26.7%提升至45.6%,规划器token使用下降12.7%和8.6%,文件级和符号级F1在24个对比中全面优于GPT-5.5和Opus 4.8参考计划,定位失败减少...
Introducing the Qwen-Audio-3.0-TTS.
阿里巴巴推出了 Qwen-Audio-3.0-TTS 文本转语音模型,提供实时版和高质量版两个版本,支持细粒度标签控制、自然语言指令、16 种语言、noise 鲁棒输出,最长 3 分钟长语音,并已登顶 Artificial Analysis TTS 排行榜。