发生了什么
Meta 发布 Nemotron-3-Embed(8B,1B BF16,1B NVFP4)
为什么值得关注
该多版本量化方案在检索精度与吞吐量之间提供具体折衷,可直接用于生产 RAG 与代码检索场景。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
Nemotron-3-Embed 发布多模型权重量化版
Meta 团队发布 Nemotron-3-Embed embedding 模型,提供 8B、1B BF16 与 1B NVFP4 三种部署版本。8B 模型在 RTEB 数据集上获得 78.46 NDCG@10 的最高排名,1B 模型较前代下降 27% 的检索误差,NVFP4 版本保持 99% 步幅检索精度且吞吐量提升 2 倍;三个版本均支持 32K 上下文、多语言检索及代码检索,并公开权重、数据集与训练流程。许可为 OpenMDW 1.1。
打开原始来源 ↗