Signal Brief

腾讯ारा Hy3 正式版发布,Agent 能力与自拍偷拍场景落 Occasionally

腾讯混元发布 Hy3 正式版,经过 270 位专家盲测后幻觉率下降,多轮承接改善,并将模型以 Apache 2.0 开源且降低 API 价格,示范国产模型在办公、开发与游戏afone 实际落地。

twitter关注列表 ginobefun (@hongming731) 发布 2026-07-06 收录 2026-07-07 值得跟进

一句话判断

新模型已正式发布并公开源码,对国产 AI 生态与应用落地具有直接指导意义,值得深入阅读与实验。

核心信息

腾讯混元发布 Hy3 正式版,经过 270 位专家盲测后幻觉率下降,多轮承接改善,并将模型以 Apache 2.0 开源且降低 API 价格,示范国产模型在办公、开发与游戏afone 实际落地。

原始内容

BestBlogs 早报 · 07-07 # 腾讯混元 Hy3 / Claude J-space / AI 自我验证 / Workers Cache / Agent CLI [1] ★ 精讲|腾讯混元 Hy3 发布:Agent 能力和产品体验跃升 腾讯混元 Hy3 从 preview 走到正式版,重点不是榜单宣传,而是 Agent 与真实生产力任务的稳定性:270 位专家盲测、幻觉率下降、多轮承接改善,以及 Apache 2.0 开源和更低 API 价格,给国产模型落地一个可核查样本,也适合观察模型如何进入办公、开发和游戏场景。 来源:腾讯混元 https://t.co/t33WbVtLtp [2] ★ 精讲|E242|最快半年 AI 跑通自进化?与陈天桥首席科学家聊聊硅谷模型必争之地 [播客] 硅谷 101 这期把 AI 自我进化从概念拉回工程问题:嘉宾认为最快半年可跑通一次闭环,但持续递归提升的关键是自我验证,避免递归漂移。Apodex 的发现模型、多个子 Agent 互验、科学品味训练,都是理解下一阶段模型竞争的好入口。 来源:硅谷 101 https://t.co/84j0sL4cwO [3] ★ 精讲|Claude 心智中心的 J-space:Anthropic 如何观察隐藏推理与安全信号 [视频] Anthropic 用 Jacobian 找到 Claude 可被语言描述的内部活动集合 J-space:它像工作区,暴露未说出口的中间步骤与联想。关掉它后模型仍能流畅回答简单问题,却会在需推理匹配语言的任务上失效;监控它也可能帮助发现隐藏操纵和假数据等安全信号。 来源:Anthropic https://t.co/nK8sL8ayIZ [4] 您的 Worker 现在可以拥有前置缓存 Cloudflare 推出了 Workers Cache,这是一个分层缓存,位于 Worker 入口点之前,使服务器渲染的应用程序能够在命中时提供缓存的响应而无需调用 Worker,从而降低延迟和 CPU 成本。 来源:The Cloudflare Blog https://t.co/6POW1QIRyO [5] 自动训练研究框架:让智能体接手大模型优化 本文介绍一套 Agent 驱动的 LLM 微调自动化框架 AutoResearch-LLM,通过三阶段流水线(场景诊断→方案设计→自动化实验)将调参经验沉淀为 SKILL.md,并在 1688 电商任务上落地验证,提供了从理论到工程的可复用方法论。 来源:阿里云开发者 https://t.co/OHyOP8DVXa [6] 为什么 Agent 时代,大家都在做 CLI? 本文深入分析 AI Agent 时代 CLI 复兴的结构性原因,阐释其与 MCP、SKILL 的分层关系,并提出 AI 友好的产品设计原则。 来源:阿里技术 https://t.co/jJSZKndGuc [7] AI 写代码越来越快,质量谁来守?网盘主端 FE 的 AICR 准入实践 百度网盘主端 FE 团队分享了如何在 CI/CD 流水线中嵌入多 Agent AI 代码审查准入系统,以应对 AI 生成代码占比超 55%后的质量保障挑战,并给出模型选型、误报治理与耗时控制的实战经验。 来源:百度 Geek 说 https://t.co/aGKHG7TsfA [8] Builders Unscripted:Derya Unutmaz 谈 Codex、生物学与个性化医疗的数字孪生 [视频] Derya Unutmaz 解释了 Codex 和前沿推理模型如何让生物医学研究者快速原型化流式细胞术工具、免疫模拟器、CRISPR 设计应用,并通向个性化医疗中的数字孪生愿景。 来源:OpenAI https://t.co/j9guU6gwXK [9] 戛纳金狮首届 AI Craft 落定:可灵给出全球顶级商业广告交付答卷 本文报道可灵 AI 在戛纳国际创意节拿下首届 AI Craft 奖项,通过获奖案例与商业化数据,论证 AI 视频生成已跨越从工具到工艺的临界点。 来源:腾讯科技 https://t.co/EUfCIjh4VK [10] AI 季报 26Q2:从 coding 到 RSI,强者愈强的未来? 文章通过访谈 MoE Capital 合伙人,深度复盘 2026 年 Q2 AI 行业关键进展,聚焦前沿智能推进(OpenAI/Anthropic 竞争、RSI、物理 AI)与智能扩散趋势(企业模型选择、交互创新)。 来源:晚点 LatePost https://t.co/xeaN8z2lak --- https://t.co/88ZBr47sdT · 发现真正适合你的高质量内容 BestBlogs 是 AI 驱动的私人阅读助手,帮助你发现真正适合你的高质量内容,欢迎体验。 在线阅读:https://t.co/HY78CMe6Hs > **引用原帖 ginobefun (@hongming731):** > https://t.co/wnOMYk0KG7 > https://x.com/hongming731/status/2074273394070360247

相关动态

02

AI 代码生成大势所趋

Greg Isenberg 发文指出,相比一年前的手写代码实践,如今大多数工程代码已由 AI 生成,标志着编程范式的根本转变。他援引了 Google 75% 新代码由 AI 生成、Anthropic 90%+ 代码由 Claude 编写、GitClear 代码重复率上升 81% 复用率下降 70% 等具体数据,并引用 Dario Amod...

twitter关注列表2026-07-18#技术突破#行业动态#分析
观察
03

BestBlogs 早报 · 07-18

月之暗面发布Kimi K3,2.8万亿参数,896选16的Stable LatentMoE,上下文100万token,接近Fable-5但仍落后最强闭源模型,完整权重7月27日前开源;VentureBeat调查显示54%企业已发生AI代理安全事件;xAI开源Grok Build(84万行Rust代码)并残留上传用户代码痕迹;Cursor评...

twitter关注列表2026-07-17#AI#模型发布#开源
观察
05

Claude Managed Agents 支持500个技能项目升级

Anthropic 在Claude 3系列推出2024年2月新特性,实现代理系统技能数量扩展至500项,增强自定义化程度。更新后的API参数文档显示请求头需包含新版本控制标识符v20240201。相较Claude 2的100技能限制,新版本实现10倍扩容空间,核心优化体现在事件触发策略更新与上下文处理模块重构。

twitter关注列表2026-07-17#技术更新#产品改进#多模态
观察