发生了什么
阿里巴巴发布Qwen3.6系列模型,支持256K上下文窗口和201种语言,通过Unsloth MTP技术实现本地推理速度提升1.4倍,27B模型达140 tokens/s,35B模型达220 tokens/s,无精度损失。
为什么值得关注
本地大模型性能突破显著提升开发者生态,MTP技术优化方案对实际应用具有重要参考价值。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
阿里巴巴发布Qwen3.6系列模型
阿里巴巴发布Qwen3.6系列模型,支持256K上下文窗口和201种语言,通过Unsloth MTP技术实现本地推理速度提升1.4倍,27B模型达140 tokens/s,35B模型达220 tokens/s,无精度损失。
打开原始来源 ↗