Signal Brief

Gemma 4 31B 上 LiveKit 推理,实时语音代理领先 GPT‑4.1

Google Gemma 团队发布了 Gemma 4 31B 模型在 LiveKit 推理平台的部署,首次音频延迟为 354 ms,首次 token 生成时间为 192 ms,并在 tau2bench 工具使用基准上获得 76.9% 成功率,超越 GPT‑4.1。

twitter关注列表 Google Gemma (@googlegemma) 发布 2026-07-16 收录 2026-07-16 观察

一句话判断

值得查看原文并测试 Gemma 4 31B 在实时语音代理场景中的延迟与性能。

核心信息

Google Gemma 团队发布了 Gemma 4 31B 模型在 LiveKit 推理平台的部署,首次音频延迟为 354 ms,首次 token 生成时间为 192 ms,并在 tau2bench 工具使用基准上获得 76.9% 成功率,超越 GPT‑4.1。

原始内容

Every millisecond counts for voice agents. Introducing Gemma 4 31B on LiveKit Inference! Optimized for real-time voice agents: - 354ms time to first audio - 192ms time to first token - Beats GPT-4.1 in agentic tool use (31B achieves 76.9% on tau2bench) Fast, capable, and efficient! https://video.twimg.com/amplify_video/2077792974810075136/vid/avc1/1920x1080/BUDj0qxbfW7FGc6N.mp4?tag=29 Google Gemma (@googlegemma): Learn more and test the integration right here: https://t.co/ho7T6pmgXp

相关动态

01

BestBlogs 早报 · 07-18

月之暗面发布Kimi K3,2.8万亿参数,896选16的Stable LatentMoE,上下文100万token,接近Fable-5但仍落后最强闭源模型,完整权重7月27日前开源;VentureBeat调查显示54%企业已发生AI代理安全事件;xAI开源Grok Build(84万行Rust代码)并残留上传用户代码痕迹;Cursor评...

twitter关注列表2026-07-17#AI#模型发布#开源
观察
03

Claude Managed Agents 支持500个技能项目升级

Anthropic 在Claude 3系列推出2024年2月新特性,实现代理系统技能数量扩展至500项,增强自定义化程度。更新后的API参数文档显示请求头需包含新版本控制标识符v20240201。相较Claude 2的100技能限制,新版本实现10倍扩容空间,核心优化体现在事件触发策略更新与上下文处理模块重构。

twitter关注列表2026-07-17#技术更新#产品改进#多模态
观察
04

Astribot发布Lumo-2

Astribot发布了40亿参数的Lumo-2机器人基础模型,推理速度比前代快2.71倍,支持人类视频和多机器人身体。该模型在105个未见物体上取得更好结果,并在22项涵盖 motion prediction、memory、physical reasoning、long tasks、fine hand control的真实操作任务中表现最...

twitter关注列表2026-07-17#技术#模型发布#AI
观察
05

杨植麟在 GTC 2026 演讲:如何扩展 Kimi K2.5

月之暗面在 GTC 2026 宣布开源三个替代 Transformer 基础组件:MuonClip 优化器(数据效率接近翻倍)、Kimi Linear 线性注意力(3:1 混合全注意力,首个全面超越全注意力的架构)、Attention Residue 残差连接(提升 24% Token 效率)。同时披露 Agent Swarm 支持 10...

twitter关注列表2026-07-17#技术突破#模型发布#开源
观察