NAVER扩建55M/1G千兆瓦数据中心
NAVER通过NVIDIA DSX平台扩建GAK Sejong数据中心,规划从55兆瓦到千兆瓦级,支持物理AI模型、代理和企业工作负载,涵盖韩国及更广地区。
围绕 AI基础设施 的精选动态、来源摘要和重要性判断。
NAVER通过NVIDIA DSX平台扩建GAK Sejong数据中心,规划从55兆瓦到千兆瓦级,支持物理AI模型、代理和企业工作负载,涵盖韩国及更广地区。
NVIDIA’s Jensen Huang outlines a comprehensive enterprise AI agent ecosystem at GTC, emphasizing infrastructure integration including models, orchestration, skilled tools...
拟建于犹他州的 Stratos 数据中心满负荷建成后用电量可能高达 9GW,规模接近纽约市平均用电需求或约 9 座核电站输出。文章强调,AI 产业扩张的关键瓶颈可能正从算力转向能源供给。
Epoch AI发布研究,揭示1吉瓦AI数据中心的年化总拥有成本为85亿美元,服务器占主导地位。
美国政客提出法案暂停AI数据中心建设,反对者认为这会阻碍未来10年最大的就业发动机,支持者则强调数据中心是AI基础设施的关键,对经济和技术发展具有重大影响。
Databricks 通过将速率限制计数器从 Redis 迁移到分片内存存储(Dicer 路由层),并采用异步批量上报模式,在容忍约 5% 超限的代价下将尾部延迟降低了约十倍,解决了实时模型服务面临的流量冲击问题。
韩国内存芯片出口价格在一个月内大幅上涨,DRAM涨35%、闪存+47%、SSD+140%,显示AI基础设施超级周期的实时体现。
中国移动推出AI中转站MoMA,接入300+主流模型,被视为国家队正式进入AI基础设施领域,同时文章分析了中转站在企业成本优化方面的实际价值和商业逻辑。
AMD ROCm软件栈在DeepSeek V4发布后14天内性能提升超过75倍,通过融合mHC操作、RoPE哈达玛变换优化以及使用TileLang和Triton重写关键kernel实现,团队正目标在未来几周内追平B200性能。
SpaceX 与 AnthropicAI 建立加速计算平台合作,在 Colossus 1 上部署超过 22 万块 NVIDIA GPU,形成规模化算力集群。该合作凸显 NVIDIA 在前沿 AI 训练与推理基础设施中的关键地位,并可能提升大模型研发与部署效率。
Multipath Reliable Connection(MRC)是一款面向大型AI训练集群的新型开放网络协议,目前已部署至发布方规模最大的训练集群生产环境中。
多家芯片与云服务巨头(AMD、Broadcom、Intel、Microsoft、NVIDIA)联合推出了 Multipath Reliable Connection (MRC),一种开放式网络协议,旨在提升大型 AI 训练集群的速度和可靠性,减少 GPU 资源浪费。
Qwen 与 Fireworks AI 建立战略合作,通过 Fireworks 平台提供对 Qwen 闭权模型的优化生产部署,旨在降低延迟与微调/推理成本。该合作面向开发者与企业,强调可靠性、安全性与规模化集成。