一句话判断
该声明首次披露了 MiniMax M3 与 Sonnet 5 的具体性价比对比(79% 性能、十分之一价格)。
核心信息
MiniMax 宣布其最新模型 M3 在性能上达到 Sonnet 5 的 79%,且价格仅为十分之一。通过 Kilo 的 Token Plan Plus,用户可获得每月 1.7B tokens,相较于使用 Claude Code Max 的每月 $200 费用,费用降至 $20。
原始内容
相关动态
OpenAI Launches Aix Shell Micro
OpenAI 发布了其首款硬件产品 Codex Micro,一款售价 230 美元的桌面控制器,用于管理工作流程。
Claude Managed Agents 支持500个技能项目升级
Anthropic 在Claude 3系列推出2024年2月新特性,实现代理系统技能数量扩展至500项,增强自定义化程度。更新后的API参数文档显示请求头需包含新版本控制标识符v20240201。相较Claude 2的100技能限制,新版本实现10倍扩容空间,核心优化体现在事件触发策略更新与上下文处理模块重构。
AI可能替代低质量人工代码工作
作者和Tobi Lutke分析AI代码替代趋势,指出大量低效人力资源可能被AI替代,核心阻力是系统集成问题。认为替代阻力不是技术瓶颈,而是与现有人工工作质量和流程的适配问题。
LiveKit 优化 Gemma 4 31B 性能
LiveKit 在自家推理平台 LiveKit Inference 上部署 Google Gemma 4 31B 模型,在实时语音应用中实现接话延迟比 GPT-4.1 低 5.2 倍(192 毫秒对 1006 毫秒)、成本约六分之一(省 83%)的效果;酒店前台场景测试中任务完成率达 88%,超过 GPT-4.1(73%)和 Gemini...
InternVLA-A1.5 发布四个 ModelScope 检查点
InternVLA-A1.5 新模型在 ModelScope 上发布了四个检查点,其中包含 2.69B 参数的基础版本以及 LIBERO、RoboTwin 2.0、DOMINO 的任务特定版本。该模型在六项仿真基准赛中报告了最佳整体成绩,分别为 LIBERO 98.9、LIBERO-Plus 84.8、RoboTwin 2.0 93.2。...