发生了什么
Cerebras 发表 Kimi K2.6 企业试点(约 1 万亿参数,约 1,000 tokens/s)
为什么值得关注
这条信息同时给出了超大参数模型在企业试点中的落地状态和约 1,000 tokens/s 的具体吞吐数据,适合关注推理基础设施与硬件性能边界的人直接点开原文。
信息来源
以下内容来自公开来源,可打开原文继续核验。
Cerebras 运行 Kimi K2.6
Cerebras 表示正在企业试点中运行 Kimi K2.6,这是一款约 1 万亿参数的模型。Cerebras 称其运行速度约为 1,000 tokens/s,并表示这是 Artificial Analysis 测得的最快前沿模型性能。
打开原始来源 ↗Kimi K2.6 高速推理
Cerebras 宣布正在企业试点中运行 Kimi K2.6,这个模型参数规模超过 1T。Cerebras 称其推理速度约为 1,000 tokens/s,并表示这是 Artificial Analysis 迄今测得最快的前沿模型性能。
打开原始来源 ↗