Digest Issue

AI HOT 午报

本期重点关注 xAI 开源 Grok Build 代理平台以解决隐私危机,以及 DeepSeek 亮眼的近 5 亿美元年营收与 2027 年 IPO 计划。新模型如 Inkling、LingBot-VLA 2.0 不断涌现,同时 Arena 引入事实评分,表明行业在技术开源、商业拓展和模型可信度评估...

9条精选信号
4个情报板块
noon简报时段
2026年07月16日 04:00生成时间

本期判断

本期重点关注 xAI 开源 Grok Build 代理平台以解决隐私危机,以及 DeepSeek 亮眼的近 5 亿美元年营收与 2027 年 IPO 计划。新模型如 Inkling、LingBot-VLA 2.0 不断涌现,同时 Arena 引入事实评分,表明行业在技术开源、商业拓展和模型可信度评估上持续深化。

模型发布

01

美国团队发布 Inkling 大模型

美国团队 Thinking Machines 发布了 Inkling,这是一款采用 975B/A41B MoE 架构的多模态大模型,已开源完整参数。在 IFBench(79.8% vs Claude 63.5%)和 FORTRESS Benign(95.9% vs Claude 55.1%)上超越部分闭源模型,但在整体基准上仍逊色于 GLM 5.2。

#Thinking Machines
02

LingBot-VLA 2.0 开源机器人模型

LingBot-VLA 2.0 是一款开源具身模型,通过 60K 小时精选机器人和人类数据训练,支持从单臂机器人到人形平台的多种配置,显著提升了机器人在复杂长期任务上的性能。

#LingBot-VLA
03

Qwen-Audio-3.0-Realtime 实时语音模型

阿里通义实验室发布 Qwen-Audio-3.0-Realtime 实时语音交互模型,具备高表现力共情对话、流畅双工交互和 Agentic 工具调用能力,在 Artificial Analysis 评测的 Speech Reasoning 子项中位列第一。

#Alibaba Tongyi Lab#Artificial Analysis

智能体与平台

01

xAI 开源 Grok Build 代理

SpaceXAI (xAI) 开源了 Grok Build 代理平台代码(Apache 2.0 许可),并为所有用户重置额度,删除了旧代码数据,以应对此前 CLI 自动上传 Git 仓库至 Google Cloud 导致的数据隐私危机。项目完整披露了 Agent Harness 源码,架构包含 Leader 会话管理、Session Actor 等七层设计,支持 95% 历史摘要压缩和 9 项目标停止正则检测,并设置了双层重试控制。此举将开源 harness 确立为 2026 年编码代理的信任新基线。

#SpaceXAI#xAI#AYi_AInotes
02

Boris Cherny 谈 Agent 自动化

Boris Cherny 指出,在 AI Agent 时代,将领域知识编码为基础设施(如 CLAUDE.md、REVIEW.md、skills、lint 规则、CI 步骤)比以往更关键,能让 Agent 零上下文高效工作。他强调,代码审查因框架或架构模式不符而拒绝 PR,实属自动化建设的失败。

#Boris Cherny

商业与人事

01

DeepSeek 年营收近 5 亿美元

DeepSeek 年营收接近 5 亿美元,已融资 74 亿美元,计划 2027 年在上海科创板 IPO。其 V4 API 访问的毛利润超过 50%,创始人 Liang Wen-feng 通过有限合伙结构控制公司,投资者锁定 5 年且无投票权,公司正计划第二轮融资从中东投资者吸收美元资金。

#DeepSeek

基准与评测

01

Arena 增加模型事实评分

Arena 在其排行榜中加入了基于真实用户对话的事实核查评分,衡量模型可靠性。通过抽样验证超过 200 万条模型在真实对话中提出的可验证主张,覆盖约 13 万文本竞赛和 4 万搜索竞赛。启用事实权重后,GPT-5.5 在文本竞赛中上升 13 名,Muse Spark 下降 13 名,GPT-5.5-search 在搜索竞赛中登顶。

#Arena