一句话判断
论文提出了理解 AI 严谨性的新框架,对思考当前 AI 能力的边界和失败预测有启发,值得原文阅读。
核心信息
Google 发表论文指出,AI 的主要问题不是严谨性过多或过少,而是工程严谨性过多,科学和哲学严谨性不足。论文提出三种严谨性:概念严谨性、可靠知识和可靠性能,并以此框架讨论智能、可重复性、预测、解释、基准和已部署系统等问题。
原始内容
相关动态
Gemini 3.6 Flash发布,具备AI代理能力,Gemini 3.5 Flash-Lite支持agentic工作流
Google推出Gemini 3.6 Flash及Gemini 3.5 Flash-Lite两模型,分别针对效率与成本效益,Gemini 3.6 Flash在编码、知识工作和多模态任务中提升效率,Gemini 3.5 Flash-Lite支持agentic工作流,输出速度可达~350token/sec
Gemini 3.5 Flash-Lite 发布
Logan Kilpatrick 宣布 Google 发布 Gemini 3.5 Flash-Lite,这是最小最快的 Gemini 模型,速度近 350 tokens/s,比 Gemini 3 更智能,与 Gemini 2.5 Flash 同成本但更智能,超越 3.1 Flash-Lite。
Octen 专为 AI agent 优化的搜索 API
Octen 发布了专为 AI agent 设计的搜索 API 栈,包括索引、排名和服务层,实现每次搜索 62ms,每 1000 次调用 1 美元,不同于传统搜索 API 的人类查询模式。
Kimi K3 表现亮眼及 AI 领域多项动态
Kimi K3 在自治法律工作基准上几乎超越 Claude Fable 5 两倍,并修复了 15 个 Codex 和 Fable 拒绝修复的严重安全漏洞。开放权重模型在长周期网络能力上落后闭源前沿的时间从 6-10 个月缩短至 4-7 个月。American companies 能以中国竞争对手十分之一的成本部署 Kimi K3,但 K3...
CoreWeave 实测 NVIDIA Vera Rubin NVL72:性能提升 10 倍
CoreWeave 公布了 NVIDIA Vera Rubin NVL72 的实测性能,在 DeepSeek-R1 推理任务上每兆瓦每秒处理 token 数比 Blackwell 提升 10 倍。