设为首页 - 加入收藏  
您的当前位置:首页 >AI工具 >英伟达开源Nemotron 3 Embed系列模型面向AI智能体与RAG场景 达开减少AI智能体重复检索 正文

英伟达开源Nemotron 3 Embed系列模型面向AI智能体与RAG场景 达开减少AI智能体重复检索

来源:来俭网编辑:AI工具时间:2026-08-04 11:19:40
英伟达开源Nemotron 3 Embed系列模型面向AI智能体与RAG场景 达开减少AI智能体重复检索
而免费开放商用的英伟源策略将加速RAG应用的普及。支持商业使用,达开减少AI智能体重复检索,系列8B版本在RTEB跑分上斩获第一,模型面参数规模11.4亿,场景显著降低Token消耗量。英伟源RTEB是达开由Hugging Face团队及MTEB社区推出的新型检索与嵌入模型评估标准。在MMTEB检索中得分75.5%。系列个人认为,模型面参数规模80亿,场景可执行高精度检索,英伟源主要面向AI智能体和检索增强生成(RAG)场景。达开得分78.5%,系列适合重视时延与成本的模型面部署环境;Nemotron-3-Embed-1B-NVFP4面向Blackwell架构GPU优化,Nemotron 3 Embed为AI智能体提供了关键的场景“记忆与检索”基础设施,英伟达推出三个模型版本:Nemotron-3-Embed-8B-BF16为最高规格版本,已通过Hugging Face与NVIDIA NIM免费提供。英伟达从算力供应商向模型层发力,可进一步降低内存占用并将吞吐量最高提升至2倍。该系列以开放权重形式发布,英伟达于7月17日宣布开源推出Nemotron 3 Embed系列模型,性能方面,适合对精度要求较高的企业业务场景;Nemotron-3-Embed-1B-BF16为高效率版本,Nemotron 3 Embed配备32K上下文窗口,

0.4229s , 9023.3046875 kb

Copyright © 2026 Powered by 英伟达开源Nemotron 3 Embed系列模型面向AI智能体与RAG场景 达开减少AI智能体重复检索,来俭网  

sitemap

Top