一句话判断
建议关注 Gemini 3.6 Flash 在 Agentic 和编程任务中的实际性能表现。
核心信息
Google 在 Google AI Studio 和 Vertex API 中上线了 Gemini 3.6 Flash 与 Gemini 3.5 Flash Lite 模型。其中 Gemini 3.6 Flash 旨在提升 Agentic 任务与代码编写的性能,而 Gemini 3.5 Flash Lite 侧重于高吞吐量与低延迟的规模化 Agent 工作流执行。
原始内容
相关动态
Google 发布 Gemini 3.6 Flash 等三款新模型
Google 发布了 Gemini 3.6 Flash、3.5 Flash Lite 和 3.5 Flash Cyber 三款新模型。其中 3.6 Flash 的输出价格从每百万 token $9 降至 $7.50,生成速度从 165 tokens/s 提升至 304 tokens/s,且在 Artificial Analysis Int...
NVIDIA Vera Rubin 平台发布
NVIDIA 发布 Vera Rubin 平台,性能功耗比提升 10 倍;CoreWeave 等云服务商部署 Vera Rubin NVL72,每兆瓦 token 数比 Blackwell 多 10 倍;DeepInfra 基准测试显示 Vera CPU 速度是其他 CPU 的 2 倍以上,支持更多并发 AI 代理。
SkyPilot 出列并获 2000 万美元融资
SkyPilot 宣布出列并推出 AI 计算平台,宣称相比碎片化 GPU 资源实现 10 倍更快的时效和 GPU 利用率翻倍,过去六个月 GPU 小时消耗增长 6 倍。公司已融资 2000 万美元,由 Lux Capital 领投,并在招聘工程和 GTM 人员以服务下一十年的 AI 需求。
NVIDIA Vera Rubin平台发布:性能功耗比提升10倍
NVIDIA发布Vera Rubin平台,性能功耗比较Blackwell提升10倍;CoreWeave实测显示其每兆瓦token数较Blackwell提升10倍;DeepInfra基准测试表明NVIDIA Vera CPU性能是其他CPU的2倍以上,可支持更多并发AI智能体。
Gemini 3.6 Flash 与 3.5 Flash Lite 正式上线
Gemini 3.6 Flash 提供快速响应与推理能力平衡,优化Agent运行及多模态理解;Gemini 3.5 Flash Lite 侧重高速低成本,适配高并发场景。两者是Gemini 3.5系列中速度最快、成本最低的版本。知识库截止时间为2026年3月。