崔慧琴网

7月17日,英伟达宣布开源推出Nemotron 3 Embed系列模型,主要面向AI智能体和检索增强生成RAG)场景。该系列以开放权重形式发布,支持商业使用,已通过Hugging Face与NVIDI

英伟达开源Nemotron 3 Embed系列模型面向AI智能体与RAG场景免费开放 模型面向免费得分78.5%

英伟达开源Nemotron 3 Embed系列模型面向AI智能体与RAG场景免费开放 模型面向免费得分78.5%
而免费开放商用的英伟源策略将加速RAG应用的普及。支持商业使用,达开英伟达宣布开源推出Nemotron 3 Embed系列模型,系列该系列以开放权重形式发布,模型面向免费得分78.5%,场景7月17日,开放显著降低Token消耗量。英伟源性能方面,达开个人认为,系列可执行高精度检索,模型面向免费场景 可进一步降低内存占用并将吞吐量最高提升至2倍。开放参数规模为80亿;Nemotron-3-Embed-1B-BF16为高效率版本,英伟源英伟达推出3个模型版本:Nemotron-3-Embed-8B-BF16为最高规格版本,达开Nemotron 3 Embed配备32K上下文窗口,系列8B版本在RTEB跑分上斩获第一,已通过Hugging Face与NVIDIA NIM免费提供。Nemotron 3 Embed为AI智能体提供了关键的“记忆与检索”基础设施,主要面向AI智能体和检索增强生成(RAG)场景。减少AI智能体重复检索,在MMTEB检索中得分75.5%。参数规模为11.4亿;Nemotron-3-Embed-1B-NVFP4面向Blackwell架构GPU优化,英伟达从算力供应商向模型层发力,

访客,请您发表评论:

网站分类
热门文章
友情链接

© 2026. sitemap