美國科技媒體《The Information》於美東時間11日引述參與專案的員工報導,輝達(Nvidia)正在開發全新的AI模型系列Nemotron 4,目標是挑戰全球頂尖的開源模型。
傳輝達開發Nemotron 4模型 至少有1兆個參數
輝達是少數投入開源AI模型開發的美國大型企業之一,隨著AI開發成本持續攀升,加上近期接連爆出多起涉及自主AI代理(AI agents)的駭客攻擊事件,開源模型的發展與安全議題也受到更多關注。
據《路透》引述《The Information》報導,多名參與專案的輝達員工指出,Nemotron 4的最大模型將擁有至少1兆個參數,約為目前最大Nemotron 3 Ultra的兩倍。
兩名熟悉專案的人士透露,Nemotron 4最快可能在今年秋季或秋末推出,但目前最終訓練工作尚未完成,輝達也未訂定正式發布日期。
輝達不證實細節 強調開源模型攸關AI安全
輝達曾表示正在開發Nemotron 4,但關於《The Information》報導中的具體細節並未證實。
輝達生成式AI軟體副總裁布里斯基(Kari Briski)在電子郵件聲明中指出,輝達投入Nemotron是因為相信每家公司、每個國家都需要能夠取得先進的開源模型,藉此強化安全與防護、加速創新,並提供可長期依賴的基礎。
推Nemotron 3.5 Lightning 積極投入開源AI生態系
事實上,輝達上個月與其他企業組成聯盟,致力於開發及共享AI安全與網路安全工具;此外,也與微軟(Microsoft)等科技巨頭簽署公開信,支持開放權重模型,盼避免AI創新與相關技術發展逐漸轉移至海外。
另一方面,輝達11日同步推出Nemotron 3.5 Lightning,這款模型擁有300億個參數,應用於程式碼審查、工具使用、安全警示監控、解答帳單問題等任務;同時發布開源模型路由庫NeMo Switchyard,能自動判斷不同AI任務,並將其導向最適合的模型。
AI市場面雙重挑戰 Nemotron 4細節受關注
《AI Weekly》提到,目前輝達在AI市場面臨雙重挑戰,一方面是中國低成本開源模型的能力持續與美國實驗室(如Anthropic和OpenAI)的系統競爭;另一方面,包括OpenAI、微軟在內的輝達主要客戶,也正低調開發自己的AI晶片。
在此背景下,若輝達成功推出具備最好能力的開放權重模型,對希望擺脫封閉式API的AI實驗室、雲端服務商或政府機構而言,將提供他們一個繼續採用輝達AI晶片的理由。
不過,目前有關Nemotron 4的消息主要來自單一媒體引述匿名輝達員工的說法,尚未公布旗艦模型的效能基準測試數據、授權條款及訓練資料等關鍵資訊。
如果輝達最終能在今年秋末推出具備先進能力的開放權重模型,競爭壓力就會落在其他主要開放權重模型業者,及中國的開放權重AI實驗室身上。