一句话判断
首次提及具体 token 效率提升,值得关注模型的成本优化趋势
核心信息
Google DeepMind 推出 Gemini 3.6 Flash 模型,称其在相同成本下使用更少的 token 即可提供更高质量输出。同时发布 3.5 Flash-Lite 用于日常任务和 3.5 Flash Cyber 用于网络安全。
原始内容
相关动态
微软公布AI在科学发现的投入
微软与美国能源部通过#GenesisMission深化合作,投资AI基础设施、科学计算、工程专长及合作枢纽,帮助全国实验室、大学和产业合作。目标是加速AI驱动的科学发现,覆盖能源、医药和先进材料,以增强美国竞争力并创造长期价值。
Alphabet Q2 AI业绩增长
Alphabet公布Q2业绩:收入同比增长24%,Google Cloud增长82%,Gemini app月活达9.5亿,模型API处理量22B tokens/min(上季度16B+),Gemini Enterprise被90%财富100强采用。
利用 Embedding 模型实现图像打标
Han Xiao 通过将冻结的 jina-v5-omni 多模态嵌入模型进行测试时缩放(scaled at test time),在无需训练、无需第二模型及外部知识的硬约束下,实现了强大的开放词汇多标签 n-gram 图像打标器。
Cursor 发布模型路由器,成本减六成
Cursor 宣布推出 Cursor Router,这款智能模型路由工具可分析每个请求并将其分配给最佳模型,在提供前沿性能的同时将成本降低 60%。
Bolt.new 新 Skills 功能:团队共享上下文
Bolt.new 更新 Skills 功能,允许用户一次性设置设计系统和品牌语音,所有团队成员共享,一次提示自动触发多个技能,无需手动调用。