本期判断
本期简报聚焦 Kimi K3 在前端代码和电子表格任务中的领先表现及非对称竞争策略,同时涵盖 Mind Lab 开源长文本强化学习项目,以及 Databricks 的新一轮高估值融资。
模型发布
01
Kimi K3前端代码登顶,定价显非对称竞争
Kimi K3在Frontend Code Arena盲测中以1679 Elo分排名第一,领先Fable 5(1631)和GPT-5.6 Sol(1618)。综合智能指数Kimi K3为57.1分,低于Fable 5(59.9)和GPT-5.6 Sol(58.9)。K3输出定价为$15/M tokens,远低于Fable 5的$50,并计划7月27日开源权重,显示其在特定赛道采用非对称竞争策略。
02
Kimi K3登顶SpreadsheetBench 2,超越Fable 5
Kimi K3在SpreadsheetBench 2基准测试中排名第一,完成34.8%的workflow任务,超越Claude Fable 5。该测试包含321个专家策划任务,平均每个任务包含11.8个工作表和593.5个单元格更改,聚焦完整的电子表格工作簿执行。
研究突破
01
Mind Lab开源2M tokens长文本RL项目
Mind Lab开源长文本强化学习(RL)项目,支持2M tokens上下文,将超长上下文研究的算力门槛从数千个GPU降至仅需8个GPU,实现大幅优化。
商业与人事
01
Databricks Series M融资30亿美元,估值1880亿
数据平台Databricks完成Series M轮30亿美元融资,由Coatue领投,公司估值达1880亿美元,延续其在高估值下强劲的增长势头。