Grok 4.5 集成 Microsoft Outlook
Grok 4.5 现可直接在 Microsoft Outlook 中使用,支持总结邮件线程与附件、识别决策与待办任务、以用户语气起草回复、搜索网络和 𝕏,以及整理、归档、删除或标记邮件。
围绕 AI 的精选动态、来源摘要和重要性判断。
Grok 4.5 现可直接在 Microsoft Outlook 中使用,支持总结邮件线程与附件、识别决策与待办任务、以用户语气起草回复、搜索网络和 𝕏,以及整理、归档、删除或标记邮件。
美国法官批准Anthropic支付1.5亿美元给作者,作为其使用盗版书籍训练Claude的版权和解金。这是美国版权案件中最大和解,涉及700万本盗版书,91%作者已领取份额。法院裁定训练属于合理使用,但存储盗版副本构成侵权。
Logan Kilpatrick 宣布 Google 发布 Gemini 3.5 Flash-Lite,这是最小最快的 Gemini 模型,速度近 350 tokens/s,比 Gemini 3 更智能,与 Gemini 2.5 Flash 同成本但更智能,超越 3.1 Flash-Lite。
Artificial Analysis 发布了对 Google Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 的基准测试结果。Gemini 3.6 Flash 智能指数保持 50 未变,但时间减半至 1.3 分钟,成本下降 18% 至 $0.50;Gemini 3.5 Flash-Lite 智能指数提升...
Octen 发布了专为 AI agent 设计的搜索 API 栈,包括索引、排名和服务层,实现每次搜索 62ms,每 1000 次调用 1 美元,不同于传统搜索 API 的人类查询模式。
Claude Fable 5、GPT 5.6 Sol、Kimi K3和Axiom Math四款AI模型在IMO 2026中获得满分42/42。Fable 5用1次尝试最快,Sol用1次尝试最便宜,K3用4次尝试消耗大量token,Axiom Math在Lean中证明了所有题目。学生需9小时完成6题,Fable和Sol用时不到4小时。
NVIDIA 宣布其 102.4 Tbps 的 Spectrum-6 以太网交换机已开始向全球 AI 工厂出货,首批客户包括 CoreWeave、Microsoft、Nebius、SpaceX AI 和 Tesla。
Qoder发布Qwen3.8-Max-Preview大模型,参数量2.4T,显著增强Coding与Cowork能力,商业版价格折扣至0.01x单位价格。
华尔街日报报道,中国开源模型Kimi K3和Qwen 3.8 Max因低成本、高性能和可定制性,开始被美国公司采用,对OpenAI和Anthropic的商业模式构成威胁,引发安全警告和商业竞争讨论。
Google 发表论文指出,AI 的主要问题不是严谨性过多或过少,而是工程严谨性过多,科学和哲学严谨性不足。论文提出三种严谨性:概念严谨性、可靠知识和可靠性能,并以此框架讨论智能、可重复性、预测、解释、基准和已部署系统等问题。
数据平台 Databricks 正在进行一轮 30 亿美元的 Series M 融资,估值达 1880 亿美元,由 Coatue 领投。
Kimi K3在Arena前端/WebDev人类盲测中以1679 Elo排名第一,领先Fable 5(1631)和GPT-5.6 Sol(1618),但在综合智能指数中仅排第四(57.1分),落后Fable 5(59.9)和GPT-5.6 Sol(58.9)。K3定价15美元/百万输出tokens,远低于Fable 5的50美元,并计划7...
Anthropic宣布从7月20日起,Claude Fable 5将纳入Max和Team Premium计划,但限制为50%的使用额度。Pro和Team Standard用户将通过使用额度继续访问,并获一次性$100信用额度。公司称需求难以预测,因此分阶段推出并持续增加容量。
月之暗面发布Kimi K3,2.8万亿参数,896选16的Stable LatentMoE,上下文100万token,接近Fable-5但仍落后最强闭源模型,完整权重7月27日前开源;VentureBeat调查显示54%企业已发生AI代理安全事件;xAI开源Grok Build(84万行Rust代码)并残留上传用户代码痕迹;Cursor评...
Artificial Analysis数据显示,Grok 4.5每次任务成本仅0.31美元,而Claude Fable 5为2.75美元、Claude Opus 4.8为1.80美元、GPT-5.6 Sol为1.04美元、Kimi K3为0.95美元,Grok 4.5成本分别低约9倍、6倍、3倍和3倍;在FrontierSWE上,Grok...
Astribot发布了40亿参数的Lumo-2机器人基础模型,推理速度比前代快2.71倍,支持人类视频和多机器人身体。该模型在105个未见物体上取得更好结果,并在22项涵盖 motion prediction、memory、physical reasoning、long tasks、fine hand control的真实操作任务中表现最...
Sakana AI 发表论文《Diffusing Blame》,提出一种训练神经网络的方法,该网络严格遵循 Dale 原理(每个神经元要么兴奋要么抑制),无需反向传播。该方法基于 Error Diffusion 扩展,通过模数错误路由在图像分类和强化学习任务(Ant、Humanoid、HalfCheetah、Craftax)上取得有竞争力...
Jim Fan团队发布RoboTTT,将机器人模型上下文原生扩展到8000时间步(5分钟),推断成本恒定,性能较前沿提升三个数量级。采用测试时训练(TTT)技术,内部小模型持续压缩历史,实现无限学习。在电路板组装任务中,机器人能从人类视频一次性模仿学习,并在线自我纠错。上下文缩放实验表明,8K步预训练性能优于1K步62%,且未饱和。
作者和Tobi Lutke分析AI代码替代趋势,指出大量低效人力资源可能被AI替代,核心阻力是系统集成问题。认为替代阻力不是技术瓶颈,而是与现有人工工作质量和流程的适配问题。
在一系列包含20000次对话和7000名参与者的实验中,AI模型在说服力上超越了人类冠军辩手和专业募捐者,即使人类获得准备、培训和高达1000英镑的奖金也无法赶上。AI的优势来自速度和信息量,当限制到人类水平时差距消失;无限制时AI说服捐赠货币的效果是专业募捐者的近三倍。