首頁 / 放.新聞 / 科技
放.新聞
科技

輝達不只賣GPU了!Nemotron 4最大模型上看1兆參數 中國低成本開放模型逼美國重新出手

2026.08.13
15:58pm
/ 放言編輯部 李云瑄

 

Nvidia正在把競爭範圍從AI晶片直接往AI模型延伸。《The Information》引述參與開發的人士報導,Nvidia正在打造下一代Nemotron 4開放模型系列,其中最大版本預計至少具有1兆個參數,目標直接挑戰全球最強的開放權重AI模型。

 



Nvidia已證實正在開發Nemotron 4,但沒有確認1兆參數及上市時程等細節。最終訓練目前尚未完成,參與計畫的人員表示,最快可能在今年秋末推出。

 

Nvidia為什麼要自己做模型?背景之一,是中國開放模型快速縮小與美國封閉模型之間的能力差距。DeepSeek、MiniMax、Moonshot等中國業者以較低成本推出可以下載、修改或自行部署的模型,使企業開始重新比較「使用最強封閉模型」與「部署價格更低的開放模型」之間的成本。路透分析指出,美國科技公司今年重新提高對開放權重模型的重視程度。

 

Nvidia 11日也同步推出Nemotron 3.5 Lightning,主攻程式碼審查、工具操作、資安警報監控及客服等工作;另一項NeMo Switchyard則是一套開源模型路由工具,可以依照不同工作,自動把任務交給最適合的模型處理。

 

這形成Nvidia更完整的AI堆疊:最底層是GPU與網路晶片,上面有CUDA等軟體環境,再向上延伸到模型、代理工具與模型路由。對開發者而言,未來使用Nvidia可能不只是在資料中心買GPU,而是從模型建立、訓練、部署到推論都可以使用同一套生態系。

 

 

圖片來源:AI生成

 

最新新聞
延伸閱讀
最新新聞