800VDC电力系统如何重塑数据中心生态
SemiAnalysis 分析了 800VDC 电力系统在数据中心的渗透趋势,预计将于 2030 年推动 39GW 增量容量。文章将过渡划分为四个阶段:2026 后期采用 row-level sidecar 进行改造(阶段 1-2),而 2028-2029 则实现集中式 rectification 或 SST 集成(阶段 3-4)。两类产...
围绕 基础设施 的精选动态、来源摘要和重要性判断。
SemiAnalysis 分析了 800VDC 电力系统在数据中心的渗透趋势,预计将于 2030 年推动 39GW 增量容量。文章将过渡划分为四个阶段:2026 后期采用 row-level sidecar 进行改造(阶段 1-2),而 2028-2029 则实现集中式 rectification 或 SST 集成(阶段 3-4)。两类产...
Anthropic 完成 650 亿美元 H 轮融资,投后估值 9650 亿美元。本轮由 Altimeter Capital、Dragoneer、Greenoaks 和 Sequoia Capital 领投,美光科技、Samsung、SK hynix 也参与投资。Anthropic 表示,这笔投资将用于推进研究,并扩大能力以满足 Clau...
Anthropic 获得 650 亿美元 H 轮融资,估值达到 9650 亿美元,超过了 OpenAI 的估值。到本月早些时候,Anthropic 的年度经常性收入(ARR)已突破 470 亿美元;其中 2026 年 2 月 ARR 为 140 亿美元,较 2024 年底的 10 亿美元增长 14 倍,2026 年 4 月升至 300 亿...
Kog (@Kog__AI) 开放了一个 2B coding model 的 Tech Preview,并表示其在单次请求下可在 8× AMD MI300X 上达到 3,000+ output tokens/s、在 8× NVIDIA H200 上达到 2,100 tokens/s,测试条件为 FP16 且未使用 speculative ...
Anthropic 宣布完成 650 亿美元 H 轮融资,投后估值达到 9650 亿美元,接近万亿美元。该轮由 Altimeter Capital、Sequoia Capital、Dragoneer、Greenoaks 联合领投,超大规模云厂商合计出资 150 亿美元,其中 Amazon 单独出资 50 亿美元;Micron、Samsun...
Firecrawl 上线了 /monitor 功能,支持用户输入一个 URL,并用自然语言描述要跟踪的目标,系统会按设定频率监测页面变化并通过 webhook 推送给 AI agent。官方称该方案只摄取真正变动的部分,最多可减少 90% 的 LLM tokens,diff 中会列出新增、删除和修改内容,并提供 permalink。功能支...
OpenAI 发布 Frontier Governance Framework,用于说明其安全与安保实践如何对齐新出现的法律要求,包括 California’s Transparency in Frontier AI Act 和 EU AI Act 的 Code of Practice for General Purpose AI。该框架...
Anthropic 宣布完成 65 billion 美元的 Series H 融资,由 Altimeter Capital、Dragoneer、Greenoaks 和 Sequoia Capital 领投,投后估值为 965 billion 美元。公司表示,自 2 月的 Series G 以来,企业客户采用继续增长,本月早些时候 run-...
Epoch AI 表示,超大规模云厂商在 2026 年 Q1 的资本开支与其趋势线预测基本一致:预测为 1551 亿美元,实际按其口径为 1561 亿美元,较 2025 年 Q4 的 1406 亿美元继续上升。其同时引用原帖称,受 AI 投资驱动,Alphabet、Amazon、Meta、Microsoft 和 Oracle 的资本开支自...
Reactor 推出实时世界模型基础设施层,获得 Lightspeed、Amplify、Jeffrey Katzenberg 等投资者共计 5900 万美元种子与 A 轮融资。该平台通过 SDK 仅需数行代码即可在产品中实时流式渲染世界模型生成的像素,适用于游戏、创意工具、仿真、机器人、叙事等多种场景。Reactor 已组建来自 Appl...
clem 🤗 介绍了 Hugging Face science team 在 TRL 中实现的异步 RL 权重同步优化:每个 RL step 不再同步完整权重,只导出变化的元素为稀疏 safetensors 文件,通过 Hugging Face Bucket 分发给 vLLM。对于 Qwen3-0.6B,单步传输载荷从 1.2 GB 降到...
腾讯技术工程团队介绍了 TencentDB Agent Memory 的短期记忆压缩方案,核心是“上下文卸载”与 Mermaid 任务画布结合:将完整工具调用结果、网页正文、日志等外部保存,只在上下文中保留摘要和索引,再用带状态、摘要和时间戳的 Mermaid 图组织任务进度与依赖关系。文章还提出四层记忆架构,包括原始原文、工具级 JSO...
Anthropic Engineering 介绍了其在三个主要产品中约束 AI 智能体的工程方法,涵盖 https://t.co/4zA6V9Pu5R、Claude Code 和 Claude Cowork。文章区分了三类风险:用户滥用、模型行为不当、外部攻击者,并对应三类防御组件:环境、模型、外部内容。文中给出三种隔离模式:用于 htt...
SpaceX 几乎已经完成一套用 C 编写的内部 AI 训练栈 V1.0,该系统可精确映射到 22 万块配备 800G NIC 的 GB300,并大量使用 pipeline parallelism,尽可能贴近 bare metal。原文称,这套训练栈在大规模训练任务上的潜在速度提升相较 JAX 可达到一个数量级以上。
Sakana AI 与东京大学小山雅典共同提出训练框架 DiffusionBlocks,并作为 #ICLR2026 论文发表。该方法将神经网络按 block 切分后逐块独立训练,使训练时所需内存可降到仅需单个 block 的规模,同时在 5 种架构上验证了与端到端训练相当的性能。验证对象包括 ViT、DiT、Masked Diffusio...
OpenRouter 宣布完成由 CapitalG 领投的 1.13 亿美元 B 轮融资。在过去 6 个月中,其每周交易量从 5T Tokens 增长到 25T Tokens,反映出 AI 正在从实验阶段向生产阶段快速转变。
Alibaba_Qwen 推出的 Qwen3.5 在 TokenSpeed inference engine 上针对 agentic workloads 达到 580 tokens per second(tps)的记录速度,运行于 NVIDIA GPUs。该优化由 Alibaba_Qwen inference team、lightseek...
MiMo 团队解释了其 API 降价原因:Input(Cache Hit)最高降价 99%,核心来自推理框架支持面向 SWA 的分层 KV cache 优化。生产推理引擎测试显示,该优化将缓存 token 容量提升 5 倍,相当于缓存成本下降 80%;同时,Hybrid 模型中多个 Full Attention 模块之间的 Cache R...
OpenRouter 宣布完成 1.13 亿美元 B 轮融资,由 CapitalG 领投,a16z、Menlo Ventures、NVIDIA 的 NVentures、ServiceNow、MongoDB、Snowflake、Databricks 等机构跟投。过去 6 个月,OpenRouter 每周处理的 token 量从 5T 增长到...
Micron 的市值因 AI 时代对存储的需求上升而突破 1 万亿美元,过去 12 个月其估值从 700 亿美元升至 1 万亿美元。文章指出,AI 计算的下一阶段瓶颈不是模型本身,而是 memory,尤其是 HBM;HBM 贴近加速器并以极高速度供数,成为 GPU 和 agentic AI、large models、inference-h...