Signal Feed

#基础设施 主题信号

围绕 基础设施 的精选动态、来源摘要和重要性判断。

动态列表

01

Browser Use 优化嵌套 VM 唤醒速度

Browser Use 在 AWS EC2 上运行 Firecracker 微型 VM 以承载浏览器会双层虚拟化导致页面错误开销大。其工程团队发现唤醒时 72% 的暂停源于页面错误,通过将内存加载粒度从 4 KB 增大至 2 MB(类似透明大页),将冷启动唤醒时间从 9.8 秒降至 3.1 秒。

twitter关注列表2026年06月18日 20:56#技术#开发者工具#基础设施
观察
02

Tensordyne 发布 Napier 推理芯片

Tensordyne 发布 Napier 推理芯片,采用 TSMC 3nm 工艺。该芯片通过硬件实现对数数学运算将乘法转换为加法,声称其每瓦 token 数和吞吐量分别是 NVIDIA Blackwell 的 17 倍和 13 倍。在 DeepSeek-R1 测试中,单机架吞吐量为 363K tokens/sec,而 NVIDIA 对比系...

twitter关注列表2026年06月17日 06:21#基础设施#技术突破#产品发布
观察
03

RL Systems Mind the Gap: Matching Trainer

SemiAnalysis 分析了 RL 训练基础设施中 Trainer 与 Generator 吞吐量不匹配的问题,探讨了 GRPO、PipelineRL、Async RL 等技术对 Policy Staleness 的影响,并提供了关于 RL Sandbox 基础设施、CPU 需求及 TCO 分析的技术细节。

twitter关注列表2026年06月17日 01:48#技术#分析#基础设施
观察
04

How We Run Firecracker VMs Inside EC2 and

Gregor Zunic 分享了在 EC2 中运行 Firecracker VM 的方案,将浏览器的冷启动时间降低至 825ms。

twitter关注列表2026年06月16日 23:54#基础设施#技术
观察
05

美国司法部支持 xAI 数据中心

美国司法部请求法院驳回 NAACP 对 xAI Colossus 数据中心的起诉,理由是 Grok 已被用于关键军事和国防行动,且是少数支持政府关键网络的 AI 系统之一。

twitter关注列表2026年06月16日 21:30#行业动态#政策#基础设施
观察
06

中国拟推2950亿美元AI基础设施计划

路透引述 Bloomberg News 报道称,中国正在准备一项规模约2950亿美元的国家级AI基础设施计划,拟把数据中心、电信运营商和国产芯片整合为一个由国家支持的算力网络。中国移动、中国电信等国有企业将运营其中大部分系统,AI基础设施被定位得更接近铁路、电网或电信网络,而非普通私有云扩张。该方案还计划依赖本土供应商,包括 Huawei...

twitter关注列表2026年06月10日 09:18#AI产业#基础设施#行业动态
高优先级
07

SpaceX 续签 Google 云大单

SpaceX 在更新的 S-1 中披露了一笔新的大额交易:Google 将从 2026年10月 到 2029年6月 按每月 9.2亿美元 向 SpaceX 支付费用,双方均可提前 90 天终止协议。原帖还将这笔交易与 CoreWeave 的收入规模作对比,称 SpaceX 的 AI cloud revenue 按 260亿美元年化运行率计...

twitter关注列表2026年06月06日 03:44#行业动态#基础设施#行业
观察
08

Gemma 4 QAT 模型发布

Google DeepMind 发布了新的 Gemma 4 QAT 模型,面向本地和端侧使用,重点提升效率。该版本采用 Quantization-Aware Training,在压缩时同步训练,以降低内存占用并尽量保留质量;同时支持常见的 Q4_0 格式,并新增了面向移动端的量化格式。Gemma 4 E2B 运行内存约为 1GB,文本版甚...

twitter关注列表2026年06月06日 02:03#模型发布#产品更新#基础设施
值得跟进
09

Gemma 4 QAT 检查点上线

Google Gemma 在 Hugging Face 发布了 Gemma 4 Quantization-Aware Training(QAT)检查点,覆盖 Gemma 4 的所有模型尺寸及其 drafters。官方称这些模型已通过 QAT 优化,以降低内存需求并提升端侧性能。

twitter关注列表2026年06月06日 00:05#模型发布#产品更新#基础设施
观察
10

SpaceX 火星任务成本降幅超99%

SpaceX 的 Starship 计划将地球轨道发射成本降至接近零,对比传统 $18,500/kg 成本,目标实现 99%以上削减。此技术突破可能推动 STARLINK、月球载物资和火星探索等产业发展方向,降低太空访问门槛。

twitter关注列表2026年06月04日 23:03#技术突破#基础设施#产品更新
高优先级
11

How Wasmer used Codex to build a Node.js runtime for the edge

Wasmer 团队使用 OpenAI 的 Codex 构建了 Edge.js,在 WebAssembly 沙箱中运行 Node.js workloads,使开发者可以在不使用 Docker 的情况下运行 JavaScript apps、MCPs 和 agents。Wasmer 表示,这项工作如果没有 Codex 需要约 1 年,但实际只用...

OpenAI-news2026年06月03日 20:00#产品更新#开发者工具#基础设施
观察
12

Alphabet 融资约850亿美元

Alphabet 宣布进行股权融资,作为其多年投资战略的一部分,用于迎接 AI 机会并满足来自企业和消费者的需求。公司表示此次发行认购超额,已募集约 450 亿美元,另有从 Q3 开始的 “at the market” 计划可再筹集 400 亿美元,合计约 850 亿美元。Berkshire Hathaway 参与投资 100 亿美元。

twitter关注列表2026年06月04日 00:04#行业动态#AI产业#基础设施
值得跟进
13

Alphabet 800亿融资

Alphabet/Google 在约 28 年里仅进行过 7 次一级股权融资,此次在 2026 年宣布募资 $80B,规模超过此前所有已识别一级融资总和的 10 倍以上。Berkshire 将投资 $10B;Alphabet 同时采用承销股票、mandatory convertible preferred、Berkshire 私募以及一个...

twitter关注列表2026年06月02日 16:57#行业动态#AI产业#基础设施
值得跟进
14

OpenAI frontier models and Codex are now available on AWS

OpenAI 宣布其 frontier models 和 Codex 已在 AWS 上正式可用,并通过 Amazon Bedrock 向 AWS 的商业区和 GovCloud 区域客户开放。Codex 作为 OpenAI 的软件工程 agent,号称每周被超过 500 万人使用;此次上线强调企业可在既有 AWS 安全、合规、采购、计费和治...

OpenAI-news2026年06月01日 18:00#产品更新#大模型#基础设施
值得跟进
15

NVIDIA 发布 Vera Rubin 平台

NVIDIA 正式投入生产 Vera Rubin 平台,该平台为 pod 规模的多机架系统,旨在处理 Agentic AI 任务。该系统通过协同设计统一了五个连接的机架级组件:NVIDIA Vera Rubin NVL72、Vera CPU rack、Groq 3 LPX、Vera BlueField-4 STX 以及 Spectrum-...

twitter关注列表2026年06月02日 01:37#基础设施#产品更新#大模型
观察
16

NVIDIA 开源 Cosmos 3 物理 AI 全能模型

NVIDIA 在 GTC Taipei 发布并开源了物理 AI 全能模型 Cosmos 3,包含 Super (32B) 和 Nano (8B) 两个版本,提供权重、代码及数据集。该模型集成视觉推理、世界模型预测与动作生成能力。同时 NVIDIA 成立 Cosmos Coalition,联合 Black Forest Labs、Runwa...

twitter关注列表2026年06月01日 20:59#模型发布#开源#基础设施
值得跟进
17

NVIDIA DSX平台为AI工厂提供全套方案

NVIDIA推出DSX平台,整合电力、土地、并网、冷却、光模块、GPU、HBM、先进封装、晶圆代工、网络及云容量等资源,打造AI工厂的全栈解决方案。该平台被定位为智能时代的「重工业」,NeoCloud被描述为新时代的「硅基」地产开发商。

twitter关注列表2026年06月01日 16:51#模型发布#基础设施#AI产业
高优先级
18

戴尔交付首个Nvidia Vera Rubin NVL72机架

戴尔交付首个Nvidia Vera Rubin NVL72机架给CoreWeave,搭载72个Rubin GPU、36个Vera CPU、3.6 exaFLOPS FP4推理性能、75TB快速内存和260TB/s NVLink带宽。

twitter关注列表2026年05月31日 15:32#产品更新#AI芯片#基础设施
观察
19

SoftBank 承诺 75 亿欧元在法国建设欧洲最大 AI 计算设施

SoftBank 宣布投入 75 亿欧元在法国建设欧洲最大 AI 计算设施,其中首阶段投入 45 亿欧元用于在 Hauts‑de‑France 建设 3.1GW 电力容量,计划到 2031 年完成;随后再追加约 2GW,形成总功率约 5GW 的 AI 计算园区,规模相当于一座中等城市的电力需求。项目锚点为敦刻尔克,Schneider El...

twitter关注列表2026年05月31日 03:48#行业动态#基础设施
观察
20

Kog AI 推理提速

Kog AI 在 8× AMD MI300X GPU 上实现了单用户 3,000 tokens/s,在 8× NVIDIA H200 上实现了 2,100 tokens/s,测试条件为 FP16、未使用 speculative decoding,且当前技术预览基于 2B 模型。其方法把 LLM 解码视为内存流式传输问题,并通过联合优化 r...

twitter关注列表2026年05月30日 01:14#模型发布#开发者工具#基础设施
观察