← 资讯列表
|

NVIDIA发布Nemotron 3 Embed系列8B版本,登顶RTEB检索基准

📅 2026/7/19 08:00:00👁 1 阅读⏱ 约 3 分钟

核心内容

{'title': 'NVIDIA发布Nemotron 3 Embed系列8B版本,登顶RTEB检索基准', 'source': 'AIbase', 'date': '2026-07-18', 'summary': 'NVIDIA近日发布了Nemotron3Embed系列嵌入向量模型,专门面向生产级RAG、智能问答检索、代码检索和Agent记忆场景设计。该系列包括三个开放检查点:Nemotron-3-Embed-8B-BF16(精度版)、Nemotron-3-Embed-1B-BF16(轻量版)和Nemotron-3-Embed-1B-NVFP4(Blackwell架构4位优化版)。三个版本均采用Transformer编码器配合双向注意力掩码训练,最大序列长度32768个token,支持34种自然语言,基于Mistral架构开源。在RTEB基准的16个公开任务中,8B-BF16版以平均NDCG@10得分78.46排名第一。1B版采用压缩而非小规模训练的方式构建,先通过神经架构搜索将3B基座裁剪至2B,再对微调后的8B嵌入向量教师模型进行知识蒸馏,最终迭代至11.4亿参数。NVFP4版在Blackwell架构上吞吐量可达BF16的两倍,精度损失仅0.38分,等效保留99.5%精度。在部署层面,模型支持多语言企业搜索、代码检索和Agent记忆(长上下文摘要)等应用场景。NVIDIA还推荐了"1B-NVFP4高容量召回+8B困难查询"的分层RAG策略,为不同成本敏感度场景提供灵活方案。', 'tags': ['NVIDIA', '大模型', 'RAG', '开源'], 'image': 'https://img.aibase.com/aibase/2026/0718/102418-204x204.png'}

← 返回资讯列表 AI8899 · 内容仅供学习参考