一句话判断
相比Blackwell,具体量化数据(10倍tokens/兆瓦、2倍CPU性能)提供了直接可比的性能提升证据,值得关注实际部署效果。
核心信息
NVIDIA发布Vera Rubin平台,性能功耗比较Blackwell提升10倍;CoreWeave实测显示其每兆瓦token数较Blackwell提升10倍;DeepInfra基准测试表明NVIDIA Vera CPU性能是其他CPU的2倍以上,可支持更多并发AI智能体。
原始内容
相关动态
NVIDIA Vera Rubin 平台发布
NVIDIA 发布 Vera Rubin 平台,性能功耗比提升 10 倍;CoreWeave 等云服务商部署 Vera Rubin NVL72,每兆瓦 token 数比 Blackwell 多 10 倍;DeepInfra 基准测试显示 Vera CPU 速度是其他 CPU 的 2 倍以上,支持更多并发 AI 代理。
SkyPilot 出列并获 2000 万美元融资
SkyPilot 宣布出列并推出 AI 计算平台,宣称相比碎片化 GPU 资源实现 10 倍更快的时效和 GPU 利用率翻倍,过去六个月 GPU 小时消耗增长 6 倍。公司已融资 2000 万美元,由 Lux Capital 领投,并在招聘工程和 GTM 人员以服务下一十年的 AI 需求。
Laguna S 2.1 from @poolsideai is live on OpenRouter!
Poolside AI发布了Laguna S 2.1,一个面向agentic编码和长时域工作的开放权重118B-A8B MoE模型,支持1M上下文窗口。该模型在Terminal-Bench 2.1上获得70.2%的分数,在DeepSWE上获得40.4%的分数。
Gemini 3.6 Flash发布,具备AI代理能力,Gemini 3.5 Flash-Lite支持agentic工作流
Google推出Gemini 3.6 Flash及Gemini 3.5 Flash-Lite两模型,分别针对效率与成本效益,Gemini 3.6 Flash在编码、知识工作和多模态任务中提升效率,Gemini 3.5 Flash-Lite支持agentic工作流,输出速度可达~350token/sec
MIT researchers propose faster diffusion model sampling algorithm
MIT CSAIL 研究人员提出一种新算法,用于从扩散模型中采样,能在指数级更少的步骤中达到相同精度,该论文获得 ICML 杰出论文奖。