OpenAI Launches Aix Shell Micro
OpenAI 发布了其首款硬件产品 Codex Micro,一款售价 230 美元的桌面控制器,用于管理工作流程。
围绕 产品发布 的精选动态、来源摘要和重要性判断。
OpenAI 发布了其首款硬件产品 Codex Micro,一款售价 230 美元的桌面控制器,用于管理工作流程。
LiveKit 在自家推理平台 LiveKit Inference 上部署 Google Gemma 4 31B 模型,在实时语音应用中实现接话延迟比 GPT-4.1 低 5.2 倍(192 毫秒对 1006 毫秒)、成本约六分之一(省 83%)的效果;酒店前台场景测试中任务完成率达 88%,超过 GPT-4.1(73%)和 Gemini...
InternVLA-A1.5 新模型在 ModelScope 上发布了四个检查点,其中包含 2.69B 参数的基础版本以及 LIBERO、RoboTwin 2.0、DOMINO 的任务特定版本。该模型在六项仿真基准赛中报告了最佳整体成绩,分别为 LIBERO 98.9、LIBERO-Plus 84.8、RoboTwin 2.0 93.2。...
AI/ML API 上线了 Kimi K3 模型,与 Claude Fable 5 均支持 1M-token 上下文窗口。在 vibe-coding 测试中,Kimi K3 以 1/4 的价格($3.11 对比 $12.23)在代码生成任务中表现优于 Claude Fable 5。
Google发布Gemini API管理代理更新,新增免费层可用性、预算警报功能和计划执行触发器。免费层支持无账单开发,预算控制通过max_total_tokens参数防止成本失控,计划任务通过cron调度实现自动化。
Google 在 Google Vids 中推出 Gemini Omni 和个人化头像功能,用户可通过简单提示生成高质量视频剪辑并创建数字化身,需要上传自拍和语音录音制作看起来和声音像自己的虚拟形象。此功能面向 Google AI Pro、Ultra 和 Workspace 商业客户开放,个人化头像仅限特定 Google 账号下 18 岁...
DoorDash 宣布开放 CLI 工具 dd-cli 的有限 beta 版本,允许 AI 代理直接从命令行搜索商店、查找优惠、下单和结账,早期访问面向美国和加拿大的 macOS 开发者,需通过 waitlist 申请。
Raft 发布 1.0 版本,将多智能体系统转变为具有独立记忆、角色和共享线程的长期协作者,agent 可相互审查工作。Raft 内部超过 100 个命名 agent 处理 99% 的工作,beta 阶段有超过 20000 名构建者,平均每个人类对应约 4 个 agent。
xAI 开源 Grok Build 源代码,仓库约 80 万行,包含完整提示词、自研与移植工具,以及记忆做梦、防死循环、hashline、Leader 单进程等模块。
SpaceXAI 开源了 Grok Build harness CLI,并将数据保留功能默认设置为关闭状态。该版本实现了本地优先运行能力,允许用户使用自有推理后端,并已删除此前保留的所有编码数据,同时重置了所有用户的用量限制。
Anthropic 宣布为美国 K-12 教育工作者推出 Claude for Teachers,提供免费高级 Claude 功能、教学技能库,并连接 Learning Commons 以获得全美各州学术标准及 OpenSciEd 等课程资源。教师可集成 ASSISTments、Canva Education 等第三方工具,利用 Clau...
AWS Newsroom 宣布 OpenAI 的 GPT-5.6 系列模型(Sol、Terra、Luna)已在 Amazon Bedrock 上正式可用,提供从旗舰推理到快速推理的三个层次。
Anthropic 延长 Claude Fable 5 的免费试用期至 7 月 12 日。从 7 月 1 日起,Pro、Max、Team 和企业版用户可在订阅额度内免费使用 Fable 5,但最多占每周额度的 50%。支持网页、手机、桌面客户端、Claude Code、Cowork、Design 及 Microsoft 365 插件。企业...
腾讯发布最新编码模型 Hy3,此模型已完全开源,支持 256K 上下文,且用户反馈其性能优于 Hy3 Preview。
SemiAnalysis分析指出,台积电的核心竞争力在于其EDA/IP生态体系而非芯片工艺工艺(PPA、EUV、良率)。Samsung和Intel也在追求类似的生态建设
Cloudflare 宣布 Monetization Gateway,利用 x402 协议在边缘强制 AI 代理访问资源前付费,网站可设定如 $0.01 每次调用的价格,代理需携带钱包并理解协议。
MiniMax 宣布其最新模型 M3 在性能上达到 Sonnet 5 的 79%,且价格仅为十分之一。通过 Kilo 的 Token Plan Plus,用户可获得每月 1.7B tokens,相较于使用 Claude Code Max 的每月 $200 费用,费用降至 $20。
Cloudflare 开放 Monetization Gateway 等候名单,允许开发者对部署在 Cloudflare 后的网页、数据集、API 或 MCP 工具收取费用,结算方式采用 stablecoins 通过 x402 开放协议进行。
Cloudflare 发布 Monetization Gateway,基于开源 x402 协议,利用 HTTP 402 状态码实现机器间微支付,支持 AI Agent 自主完成千分之一美元级资源结算,无需注册账号或 KYC。该方案整合稳定币支付,将校验与计费逻辑部署在全球边缘网络,卖家可针对 API、数据集、MCP 工具灵活定价,与传统面...
Tencent Hunyuan 和 Novita Labs 通过 OpenRouter 平台推出大模型 Hy3,该模型基于 295B MoE(21B 活跃参数)架构,支持 256K 上下文长度,提供三种可配置推理模式,并专注于代码生成、推理与长上下文场景的优化,针对企业级 AI 工作流。
Cloudflare 推出 Workers Cache,这是一个位于 Worker 入口点前面的分层缓存,将 Worker 视为源站,缓存其响应以减少重复代码执行。关键设计包括默认两层 Tiered Cache、通过 ctx.props 实现按用户缓存、entrypoint 链独立缓存控制,以及标准 HTTP 缓存行为。计费方面,缓存命中...
OpenAI发布新版Realtime模型GPT-Realtime-2.1和GPT-Realtime-2.1-mini,后者新增推理和工具使用功能,定价与GPT-Realtime-mini一致;通过Playground和APIs提供服务。
Anthropic发布Claude Code的开发历程故事,由Boris Cherny主导。2024年Claude CLI原型实现,2025年Claude Sonnet 4版本正式发布,用户从10%到100%AI-written code。
Google 与 Android Developers 联合通过 Google Play Indie Games Fund 向非洲地区 10 个独立工作室分配 100 万美元资金,每个工作室单独获得 5 万至 20 万美元资助,并提供指导支持,截止 7 月 31 日申请
Etched 宣布其 AI 推理芯片已从隐秘阶段走出,成功完成 A0 tapeout 并构建首批机架,获得超过 10 亿美元客户合同和 8 亿美元融资。早期客户测试显示在推理吞吐量、时延和能效上达到 SOTA 水平,首批机架将于今年夏天发货。swyx 评论称,该芯片硬编码注意力到硅片,在 2 年内快速出货,有望将 LLM 推理成本降低 1...
Thinking Machines 开发了 Tinker(TML 子公司),Tinker 提供/API 支持 LLMs 的后处理训练,公司估值 12B 寻求 50B 融资,每月收入(ARR) 掉几百万。
xAI 推出 Voice Agent Builder,一个无代码平台,使用 Grok Voice 创建类人语音代理。该平台收费 0.05 美元/分钟,每个账户附赠免费电话号码,目前处于 Beta 测试阶段。相较于传统需拼接语音转文本、大模型和文本转语音三套 API 的方案,Voice Agent Builder 通过一体化降低成本、延迟和...
xAI 在其控制台上线 Voice Agent Builder,提供无代码平台创建类人语音智能体,使用 Grok Voice 技术,定价为每分钟 0.05 美元,即日起可用。
Anthropic 发布 Claude Science 桌面应用,专为科学研究设计。应用可连接超过 60 个科学数据库,管理按需环境,并允许在 Memory 中创建专用类别(Categories)和自定义代理(Specialists)。该应用开发时名为 Operon,实际上作为本地 web 服务器运行,UI 在浏览器中打开。
Nous Research 联合 Hermes Agent 团队解决了所有 P0/P1 问题及代码提交 PR,过去 1.5 周末重修问题并完成全量修复,项目总问题数和修复进度在图片中可视化
Google AI Studio 发布 Nano Banana 2 Lite,宣称为目前最快、最具成本效益的 Gemini 图像模型,能够在 4 秒内生成文本到图像输出,每 1K 分辨率图像成本仅 0.034 美元,相较于之前的 Gemini 图像模型在速度和成本上有所提升。
Google DeepMind 宣布 Gemini Omni Flash 可通过 API 获取,支持通过自然语言指令生成和编辑高质量视频,模型版本为 Gemini Omni Flash,参数规模未明确,与 Gemini Image 模型 Nano Banana 2 Lite 同步发布
Anthropic 推出 Claude Science,一个面向科学家的 AI 工作台,内置 60 多个预配置技能和连接器,覆盖基因组学、蛋白质组学等领域,集成 UniProt、PDB、Ensembl 等数据源。该工具可在本地或通过 SSH/HPC 使用,能自主起草计算任务并提交到用户自己的 HPC 集群,内置审稿 agent 验证引用和...
NVIDIA 在最新报告中指出,其 Blackwell 推理栈在一个月内使 DeepSeek V4 的 token 成本降低至原来的一五分之一。报告强调该成本优势来自于对 LLM、CPU、DPU、CUDA、网络、内存、安全和工具的统一协调。
Anthropic 发布了面向科学研究的 AI 工作台 Claude Science,集成 60 多个科学数据库,支持可复现性和本地运算。该产品非新模型,而是将现有 Claude 模型(含 Opus 4.8)整合为科研平台,与 OpenAI 的 GPT-Rosalind 形成差异化竞争。Claude Science 即日起公测,Pro 及...
Anthropic 发布 Claude Sonnet 5,定价 $2/$10 每百万 token(8 月后涨至 $3/$15),SWE-bench Pro 编码评分 63.2%,高于 Sonnet 4.6 的 58.1% 但低于 Opus 4.8 的 69.2%;在 CyberGym 测试中弱于 Sonnet 4.6,Anthropic ...
Google NotebookLM 发布 Short Video Overviews 功能,可将上传的文档源材料自动生成 60 秒竖屏深度解析视频。该功能现已向 Google AI Ultra 和 Pro 订阅者在移动端和网页端开放,免费用户将随后获得访问权限。
Anthropic 发布面向科学研究的工具 Claude Science(Beta),集成 60 个科学数据库,支持代码追踪的 artifact 和 3D 可视化,早期用户报告可生成 100 页以上的审稿草稿,种系分析时间缩短至十分之一。
Artificial Analysis 宣布推出 Controlled Voice Arena,通过语音克隆标准化 8 种声音(2 美国男声、2 美国女声、2 英国男声、2 英国女声)来评估文本转语音模型的质量,包括音频质量、发音、节奏和语调等。投票已开启,计划本周公布首个排行榜结果。
Etched 推出了 Cluster-Scale Memory (CSM),一种共享低延迟内存池架构,利用专有 ultra‑low‑latency 高带宽互连实现跨芯片快速内存访问,并采用 HBM/SRAM 混合设计同时解决内存容量与 mem2mem 延迟问题,从而提升大规模 MoE 模型的吞吐量与交互性能。
Etched 公司宣布走出隐身状态,完成 A0 版芯片光刻并发布首批机架,已获得 10 亿美元以上客户合同,融资 8 亿美元。早期客户测试表明,其芯片在推理工作负载上实现了同类技术的最高吞吐量、最低延迟和最高功率效率。
Anthropic 发布 Claude Sonnet 5,宣称性能接近 Opus 4.8 于更低价格。该模型在 SWE Bench Pro 上取得 63.2% 的分数,较前代 Sonnet 4.6 的 58.1% 实现提升。Claude 描述称新模型具备更强的自主性,能够制定计划并使用浏览器等工具。
Google 发布 Nano Banana 2 Lite 和 Gemini Omni Flash 新模型,Nano Banana 2 Lite 图像生成速度 <4 秒,价格 0.034 美元/千张;Omni Flash 视频编辑达 SOTA,价格 0.1 美元/秒。
Claude 发布面向研究流程的新应用 Claude Science,支持代码追溯、按需环境管理,并可连接 60+ 科学数据库,目前处于 beta 阶段。
Etched 透露已完成 A0 芯片版图并推出首批服务器机柜,已获得 1B+ 美元客户合同和 800M 美元融资,早期客户测试显示在推理工作负载上达到 SOTA 的吞吐率、延迟和功耗效率。首批机柜预计今年夏季发货。
Google 发布了两款生成式媒体模型:Nano Banana 2 Lite 是一款高性价比图像模型,Gemini Omni Flash 是一款原生多模态视频生成与对话编辑模型。两款模型现已通过 Google AI Studio、Gemini API 及 Gemini Enterprise Agent Platform 提供服务,并支持通...
ClaudeDevs 宣布 Claude Desktop 在 Ubuntu 和 Debian 上推出 Beta 版本,支持 Claude Code、Claude Cowork 和聊天功能,所有付费计划可用,但计算机使用(Computer Use)功能暂未包含。
Flowith 团队推出 Matrix - Agent 公司的操作系统。产品包含自演化 multi-agent runtime,支持 Neo/Codex 等模型,具备 Runtime 层、协调层和公司原语(网站部署、Stripe 收款、Agent Wallet 等)。GDPval-Bench 性能为 95.45%,优于 Codex CLI...
X Developer 官宣 MCP 支持功能上线,允许代理实时接入 X API 且无需设置流程。主要功能包括连接 Grok、Cursor 等 MCP 节点。
Meituan发布LongCat-2.0,1.6万亿参数MoE架构,约480亿激活参数,上下文窗口扩展至1M,训练使用5-6万块国产加速卡,实现训练及推理全流程不依赖英伟达;采用N-gram Embedding、稀疏注意力+跨层索引、自研底层算子(确定性FAG、Scatter重写)等技术;基准性能方面,Terminal‑Bench 2.1...
Tristan Rhee 的社交媒体分析指出,DeepSeek 发布免费的 GLM 5.2 模型,与 Anthropic 提出关闭源代码AI的立场形成矛盾,这可能削弱 Anthropic 的 $1 万亿市值合理性。核心数据包括模型免费定价、商业估值规模、技术开源动向。
文中 Gouri 强烈推荐 Andreessen 对话,引用 Marc Andreessen 的评价,并附关联视频链接。内容中提及了具体参数和平台名称,对比公开机构发布的技术评测。
SpaceXAI 在 Vercel AI Gateway 上推出了新的实时语音模型,用户与 Monichab 讨论其功能与实现细节,该更新包含新参数和优化路径。
Anthropic 在 Microsoft Foundry 上正式推出 Claude,托管于 Azure,Azure 客户可使用 Claude Opus 4.8 和 Claude Haiku 4.5,支持 Azure 认证、计费、prompt caching 和 extended thinking。
Meta 分享了 Brain2Qwerty v2(非侵入式脑文本解码器),基于 Nature 发表的 v1 提升了性能。该端到端系统可从原始脑信号中实时输出句子级别内容,从字符级跃升至词/语义级解码,准确率接近入侵式手术水平,有望帮助失语患者恢复沟通。
用户通过非正式渠道(社交媒体)比较特斯拉 FSD V14 Lite 的自动驾驶能力与非特斯拉新车的系统,声称前者更胜一筹,但话语权缺乏用户快照或数据支持,为无法独立验证的观点。
Google Cloud 在2026年Q1实现收入首次超过200亿美元(同比增长63%),营业利润达66亿美元。Sundar Pichai在电话会上强调企业AI已成为Google Cloud增长的主要动力来源。
Anthropic 发布 Claude Tag(Beta),允许企业用户通过 Slack 频道提及 Claude 发起工作流,支持组织级工具集成、持久记忆和异步执行,Gergely Orosz 分析其核心价值在于云端 AI 与内部系统无缝对接而非 Slack 本身,三类用户(新员工、非工程师、代码库陌生开发者)能实现无配环境直达工作。
Vida 开源 BrowserBC 框架,将浏览器会话转化为可复用技能,实现 WebArena‑Hard 通过率从 60.5% 提升至 81.4%、ClawBench 通过率从 32.9% 提升至 68.4%,并将平均工具调用数从 31.2 次减少至 22.7 次。
公司相关的导论者讨论,引发科技领域对nextjs优化方向的争议,涉及2026年版本及业内反响,内容包含具体数据和对比如上代产品。