新聞 4 / 12

產品發佈

Nemotron 3 Ultra:開源高效混合專家模型,推理能力達業界水準

Nemotron 3 Ultra: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

Nemotron 3 Ultra:開源高效混合專家模型,推理能力達業界水準

arXiv cs.CL · 2026-06-16

摘要

NVIDIA 發佈 Nemotron 3 Ultra,這是一款 550 億參數的混合型語言模型,採用 Mamba-Attention 架構和稀疏專家混合(MoE)技術。該模型在 2000 萬億文本 token 上預訓練,支援 100 萬 token 上下文,推理吞吐量比現有開源模型高 6 倍,同時保持相當的準確度,特別適合長時間運行的自主 Agent 任務。

開發者:可直接應用開源模型構建高效 Agent 系統,降低推理成本並獲得更長上下文

投資人:NVIDIA 在模型生態中深化布局,強化 AI 推理晶片的商業價值

一般用戶:更高效的 AI 助手和自動化應用將更容易落地應用

重要性評分

78/100

🟠 值得關注

大語言模型專家混合推理效率
原文出處
上一則ALS 患者成為腦機介面「超級用戶」,植入電極後已使用數千小時下一則Ling 和 Ring 2.6 技術報告:萬億參數規模下的高效即時代理智能

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。

相關指南

🤖 本文摘要由 AI 自動生成,內容源自原始報導。如有疑慮,請參閱關於我們

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。