Nemotron是基於Qwen-2.5微調而成的推理模型系列,包含1.5B、7B、14B和32B四種參數規模,源自擁有6710億參數的DeepSeek R1 0528大模型。該系列通過蒸餾技術降低部署難度,支持在普通設備運行複雜推理任務,完整檢查點發布於Hugging Face平台供研究使用。
該系列採用GenSelect推理模式,通過多路徑解答篩選提升準確率,32B版本在數學與編程基準測試中達到領先水平。訓練數據包含500萬數學、科學與編程樣本,支持32,768標記上下文長度。
新發布的Nemotron Nano 2和Llama Nemotron Super 1.5採用混合架構與NVFP4量化格式,推理成本降低60%,生成速度提升6倍。NVIDIA在SIGGRAPH 2025宣布擴展該系列,適用於企業級AI智慧型體構建,Zoom計畫將Nemotron與Zoom AI Companion結合,CrowdStrike正在測試Nemotron模型以便其Charlotte AI智慧型體處理多步驟任務。模型通過Amazon Bedrock、Azure AI等平台部署,並提供Llama Nemotron VLM數據集v1支持視覺訓練。2025年12月15日,英偉達發布 Nemotron 3 開源模型系列,包括 Nano、Super 和 Ultra 三種規格,宣稱是構建 AI 智慧型體套用時“具有最佳準確性的最高效開源模型家族”。
基本介紹
- 外文名:Nemotron
- 類型:基於Qwen-2.5微調而成的推理模型系列
- 參數規模:1.5B、7B、14B和32B
- 涵蓋領域:數學、科學與編程領域

