一句话判断
该多版本量化方案在检索精度与吞吐量之间提供具体折衷,可直接用于生产 RAG 与代码检索场景。
核心信息
Meta 团队发布 Nemotron-3-Embed embedding 模型,提供 8B、1B BF16 与 1B NVFP4 三种部署版本。8B 模型在 RTEB 数据集上获得 78.46 NDCG@10 的最高排名,1B 模型较前代下降 27% 的检索误差,NVFP4 版本保持 99% 步幅检索精度且吞吐量提升 2 倍;三个版本均支持 32K 上下文、多语言检索及代码检索,并公开权重、数据集与训练流程。许可为 OpenMDW 1.1。
原始内容
相关动态
Claude Code 系统提示词削减 80%
Anthropic Claude Code 产品负责人 Cat Wu 和工程师 Thariq Shihipar 在 AI Engineer World's Fair 炉边对谈中披露,Claude Code 系统提示词已削减 80%,适用于 Fable 5 和 Opus 4.8 等前沿模型。核心经验包括:删除 few-shot 示例反而提升...
Qwen3.8-Max-Preview上线
Qoder发布Qwen3.8-Max-Preview大模型,参数量2.4T,显著增强Coding与Cowork能力,商业版价格折扣至0.01x单位价格。
Kimi K3 在 DesignArena 前端基准测试中超越 Claude 系列
Kimi K3 在 DesignArena 的 Frontend Web App 基准测试中以 Elo 1326 排名第一,超过了 Anthropic 的 Fable 5、Sonnet 5 和 Opus 4.8 模型。
中国开源模型威胁美国AI商业模式
华尔街日报报道称,中国开源模型Kimi K3和Qwen 3.8 Max在基准测试中与领先美国系统竞争,且成本低廉,美国公司正采用中国模型以降低AI成本,这威胁到OpenAI和Anthropic的商业模型,并迫使后者警告安全风险。
BestBlogs 早报 · 07-18
月之暗面发布Kimi K3,2.8万亿参数,896选16的Stable LatentMoE,上下文100万token,接近Fable-5但仍落后最强闭源模型,完整权重7月27日前开源;VentureBeat调查显示54%企业已发生AI代理安全事件;xAI开源Grok Build(84万行Rust代码)并残留上传用户代码痕迹;Cursor评...