Digest Issue

AI HOT 早报

本时段,腾讯混元正式发布了其旗舰模型 Hy3,以 Apache 2.0 协议开源并降低 API 价格,性能大幅提升。同时,Anthropic 在 Claude 中发现了类似“全局工作空间”的 J-space,为模型可解释性带来突破。此外,中国拟限制 AI 模型出口,与美国形成呼应,或将导致全球 AI...

59条精选信号
7个情报板块
morning简报时段
2026年07月08日 00:01生成时间

本期判断

本时段,腾讯混元正式发布了其旗舰模型 Hy3,以 Apache 2.0 协议开源并降低 API 价格,性能大幅提升。同时,Anthropic 在 Claude 中发现了类似“全局工作空间”的 J-space,为模型可解释性带来突破。此外,中国拟限制 AI 模型出口,与美国形成呼应,或将导致全球 AI 市场加速分裂。

腾讯混元 Hy3 发布

01

腾讯混元Hy3模型开源发布,性能大幅提升

腾讯混元正式发布 Hy3 模型(295B MoE,21B 活跃参数,256K 上下文)。该模型已开源(Apache 2.0 协议),并在 OpenRouter 和 OpenCode 平台免费提供至7月21日,API 价格降低。性能提升显著,盲测得分 2.67/4,超越 GLM-5.1 (2.51/4);多轮对话错误率降至 7.9%,MRCR 升至 75.1%;执行效率平均缩短 34%,文档处理 token 节省 47.4%。专注于代码、推理和长上下文,并已应用于腾讯内部产品。

#Tencent Hunyuan#ModelScope#OpenRouter

模型发布与更新

01

Google DeepMind发布Gemma 4技术报告

Google DeepMind 发布 Gemma 4 技术报告,模型参数从 2.3B 到 31B,涵盖密集和 MoE 架构。12B 模型采用无编码器设计,2.3B 模型性能匹配 Gemma 3 27B。31B 模型在 Arena Text 排名 43,AIME 2026 达 89.2%,GPQA Diamond 84.3%。

#Google DeepMind
02

ModelScope开源LingBot-Vision系列模型

ModelScope 开源 LingBot-Vision 光学特性系列模型,包含 1B ViT-g 和多尺度学生模型。1B ViT-g 在 NYUv2 深度 RMSE 0.296 领先 7B DINOv3 (0.309);0.3B ViT-L 学生模型性能接近 7B DINOv3,参数量少 23 倍。

#ModelScope
03

DeepSeek V4支持100万上下文

DeepSeek V4 开源两种变体,可扩展上下文至 100 万 tokens,通过注意力改进和 Mega MoE 加速计算。

#DeepSeek
04

Meta发布首个自研图像生成模型Muse Image

Meta 发布首个自研图像生成模型 Muse Image,将替代依赖的 Midjourney 和 Black Forest Labs。支持编辑、生成、删除对象等功能,消费者免费使用,高级用户需订阅 Meta One。内部测试显示其优于 Nano Banana 2 但落后于 GPT Image 2。

#Meta
05

NVIDIA发布30B音频MoE模型Audex

NVIDIA 发布 Audex,一个 30B 总参数/3B 活跃参数的音频-文本 MoE 模型,基于 Nemotron-Cascade-2。在 BigBenchAudio 等基准上取得高分(90.0, 95.6, 90.3),同时保持文本推理能力,训练使用 157.4B 音频 tokens 和 320.5B 文本 tokens。

#NVIDIA#ModelScope
06

MiniMax M3性价比达Sonnet 5七成

MiniMax 最新模型 M3 性能达 Sonnet 5 的 79%,价格仅为十分之一。通过 Kilo 的 Token Plan Plus,用户可以每月 20 美元获得 1.7B tokens,远低于 Claude Code Max 的每月 200 美元。

#MiniMax#kilocode
07

Qwen开源AgentWorld模型及基准

Zikai 分享 Qwen-AgentWorld 见解:8B dense 是有效学习的最小模型;最佳输入格式为 playwright 的 accessibility tree;Qwen 开源了 Qwen-AgentWorld-35B-A3B (MoE,35B/3B active,256K context) 和 AgentWorldBench。

#Qwen

研究突破与可解释性

01

Anthropic发现Claude内部工作空间J-space

Anthropic 研究团队在 Claude 中发现一组名为 J-space 的内部神经模式,类似人脑的“全局工作空间”。该区域占模型总活动的不到十分之一,因果影响模型行为,移除后会大幅降低多步推理、总结等能力。通过 J-lens 可读取 Claude 的“内部想法”,检测其编造数据或隐藏目标,有助于提升模型可解释性和安全性。

#Anthropic#Anthropic-research
02

General Intuition开源多玩家世界模型MIRA

General Intuition 与 Kyutai Labs 合作开源 MIRA,通过 10k 小时公开机器人数据训练,可实时运行 20 FPS 的四名玩家对战场景。该模型未用于 Rocket League 开发,计划在 ICML 展会展示其技术成果。

#General Intuition#Kyutai Labs
03

Harness Engineering:AI自改进主战场

Lilian Weng 博客阐述 Harness Engineering 作为 AI 递归式自改进 (RSI) 的主战场。文章归纳了 Workflow Automation 等三类基础模式,探讨了 Context Engineering、Meta-Harness 等方向,并指出弱评估器、记忆生命周期等七大瓶颈。

#Lilian Weng
04

无需微调验证器提升AI准确性

Stanford、NVIDIA 和 UC Berkeley 论文提出无需训练的验证器,通过读取连续校准分数而非离散评分提升准确性,在 Terminal-Bench V2 (86.5%)、SWE-Bench Verified (78.2%)、RoboRewardBench (87.4%)、MedAgentBench (73.3%) 等基准上取得显著提升。

#Stanford#NVIDIA#UC Berkeley
05

Beyond Language Modeling论文ICML展示

David Fan 团队在 ICML spotlight 展示 Beyond Language Modeling 论文,研究了将视觉作为一等公民进行多模态预训练的方法,探索了 Transfusion-style 模型从头训练的设计空间,涉及视觉表示、数据、世界建模、架构和扩展行为等方面。

#David Fan
06

Agentic Coding Harness底层解析

SemiAnalysis 深入解析 Agentic Coding Harness 底层实现,指出 LLM 无状态,每次请求需重建系统提示、工具定义和消息历史,通过 HTTP POST 循环实现工具调用和本地执行。强调不同 harness 仅区别在上下文管理策略和 UI 设计,智能上限由底层模型决定。

#SemiAnalysis

平台与产品更新

01

Claude Fable 5免费试用延期,多项基准领先

Anthropic 宣布将 Claude Fable 5 的免费试用期延长至 7 月 12 日,Pro/Max/Team/企业版用户可免费使用,但最多占每周额度 50%,之后转为按量计费。在 Artificial Analysis 的 Harvey LAB-AA 法律基准测试中,Fable 5 以 14.2% 的通过率遥遥领先;在六项行业 AI 能力指数中也全面领先。但其每任务成本高达 19 美元,远高于 Gemini 3.1 Flash-Lite 的 0.02 美元。

#Anthropic#Artificial Analysis
02

Cloudflare推AI Agent支付网关与Workers Cache

Cloudflare 推出 Monetization Gateway 和 Workers Cache。Monetization Gateway 基于开源 x402 协议,实现 AI Agent 的微支付,允许开发者对 API、数据集等资源收费(如 $0.01/次调用),支持稳定币结算,无需注册或 KYC。Workers Cache 则在 Worker 入口前提供分层缓存,通过缓存响应减少重复代码执行,计费上缓存命中仅收请求费。

#Cloudflare#AYi_AInotes
03

Anthropic将Claude Cowork扩展至移动/网页端

Anthropic 将 Claude Cowork 从桌面端扩展到移动端和网页端,允许用户在后台执行任务并跨设备检查审批。同时发布 120 万次匿名使用数据 (5月11日至31日,覆盖 60 万+ 组织),显示大部分 Cowork 活动并非编程。

#Anthropic
04

Claude Code官方口述史披露

Anthropic 发布长篇口述史,记录 Claude Code 从 2021 年内部研究原型到 2025 年 2 月正式发布、再到 2026 年全面爆发的全过程。访谈涵盖小团队策略、20%可用即发布、信任逐步让渡等关键判断。

#Anthropic
05

Factory发布模型路由Router

Factory 发布 Router 模型路由功能,在数周生产中实现 43% 的总成本节省,61% 的会话成本降低至少 80%。

#Factory AI
06

Google Gemini Managed Agents更新

Google 更新 Gemini API Managed Agents,新增后台任务、远程 MCP 支持、函数调用、凭据刷新和免费层访问,使代理更接近生产环境。

#Google
07

Anthropic工程师分享Claude开发策略

Anthropic Claude Code 工程师 Thariq Shihipar 在 AI Engineer World's Fair 演讲中提出“解除 Claude 束缚”概念,认为模型能力需通过工具调用释放,并透露 Claude Code 已砍掉 80% 系统提示词,同时分享“找到未知”方法论。

#Thariq Shihipar#Anthropic

商业与政策

01

中国拟限制AI模型海外访问及投资

消息称,中国商务部正与阿里巴巴、字节跳动、智谱等公司讨论限制先进 AI 模型(含闭源及开源权重)出口,并考虑将 AI 泄露列为国家安全犯罪,同时收紧外国对中国 AI 初创公司的投资。此举与美国限制 AI 访问相呼应,可能导致全球 AI 市场分裂。在此背景下,DeepSeek 和 Zhipu AI 正在研发定制 ASIC 推理芯片,但面临制造和内存访问限制。

#Reuters#rohanpaul_ai
02

微软裁员4800人,因AI支出挤压

微软裁员 4800 人(占 2.1%),涉及商业运营和 Xbox,原因系 AI 基础设施支出(预计 2026 年达 1900 亿美元)挤压现金流。Azure 业务增长但 Xbox 利润率仅约 3%。

#Microsoft#rohanpaul_ai
03

Groq员工以股权换薪挽救公司

Groq 创始人 Jonathan Ross 透露,公司濒临破产时,80% 员工同意以股权换取薪资,将薪资降至法定最低(工程师从数十万降至 5-6 万美元),离职率仅 5-10%,后续与 NVIDIA 达成 200 亿美元合作。

#Groq#Jonathan Ross
04

Anthropic资本效率优于OpenAI

America's 贵仁基金经理指出 Anthropic 的资本效率远高于 OpenAI,其每 token 成本比 OpenAI 低 80% 以上,直接影响两家公司的结构性回报率模型。

#rohanpaul_ai
05

BIS警告AI泡沫风险及金融冲击

国际清算银行 (BIS) 报告警告 AI 泡沫风险,指出超大规模企业 2025 年债券发行超 1000 亿美元,私人信贷基金 AI/IT 敞口五年内翻四番至约 15%,杠杆供应链可能引发从科技到信贷市场的金融冲击。

#BIS

基础设施与芯片

01

SemiAnalysis: TSMC核心竞争力是EDA/IP生态

SemiAnalysis 分析指出,台积电 (TSMC) 的核心竞争力在于其 EDA/IP 生态体系而非芯片工艺,Samsung 和 Intel 也在追求类似建设。

#SemiAnalysis
02

NVIDIA压缩MoE模型提升吞吐量

NVIDIA 论文将混合 MoE 模型 Nemotron-3-Super 压缩为 Puzzle-75B-A9B,通过联合结构搜索等技术,在 8×B200 节点上实现约 2 倍父模型吞吐量,H100 上 1M token 并发从 1 提升至 8,同时保持推理、编码、长上下文和智能体基准准确率。

#NVIDIA
03

SpaceX申请发射10万颗Gen3卫星

SpaceX 向 FCC 申请发射 100,000 颗 Gen3 低轨卫星,配置两个带宽,轨道高度 323-327.5 km 与 473-477.5 km,倾角 26-96.9°,不同于此前 100 万颗 AI 卫星申请。

#SpaceX#Elon Musk
04

数据中心建设成中美AI供应链焦点

Sar Haribhakti 指出数据中心建设为美国 AI 产业供应链提供市场驱动机会,而北京计划投资 2950 亿美元推进数据中心建设,阻止建设将削弱美国关键技术领先地位。

#Sar Haribhakti

基准与评测

01

ARC Prize公布AGI-3首批获奖者

ARC Prize 公布 ARC-AGI-3 Milestone #1 的三位获奖者:tufalabs (1.21%, $25K)、Reki (0.867%, $7.5K)、Md Boktiar Mahbub Murad (0.864%, $5K)。所有获奖者均开源了解决方案。

#ARC Prize