← Ultimi articoli
💬 NLP

Nemotron 3 Ultra: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

Nemotron 3 Ultra è un modello ibrido Mamba-Transformer open-source da 550 miliardi di parametri caratterizzato da un contesto di 1 milione di token e tecniche di addestramento avanzate che garantiscono un'accuratezza allo stato dell'arte con una velocità di inferenza fino a 6 volte superiore, rendendolo ideale per compiti complessi di ragionamento agentico.

Autori originali: NVIDIA (Allan), : (Allan), Aaron Blakeman (Allan), Aaron Thomas (Allan), Aastha Jhunjhunwala (Allan), Abhibha Gupta (Allan), Abhinav Khattar (Allan), Adam Rajfer (Allan), Adi Renduchintala (Allan), A
Pubblicato 2026-06-16
📖 6 min di lettura🧠 Approfondimento

Autori originali: NVIDIA (Allan), : (Allan), Aaron Blakeman (Allan), Aaron Thomas (Allan), Aastha Jhunjhunwala (Allan), Abhibha Gupta (Allan), Abhinav Khattar (Allan), Adam Rajfer (Allan), Adi Renduchintala (Allan), Adil Asif (Allan), Aditya Vavre (Allan), Adriana Flores Miranda (Allan), Ahmad Bilal (Allan), Aileen Zaman (Allan), Ajay Hotchandani (Allan), Akanksha Shukla (Allan), Akhiad Bercovich (Allan), Aleksander Ficek (Allan), Alex Gronskiy (Allan), Alex Kondratenko (Allan), Alex Steiner (Allan), Alex Ye (Allan), Alexander Bukharin (Allan), Alexandre Milesi (Allan), Ali Taghibakhshi (Allan), Alice Gatti (Allan), Alisa Liu (Allan), Alok Kumar (Allan), Amar Phanishayee (Allan), Ameya Sunil Mahabaleshwarkar (Allan), Amir Klein (Allan), Amit Zuker (Allan), Amnon Geifman (Allan), Anahita Bhiwandiwalla (Allan), Ananth Subramaniam (Allan), Andrea Santilli (Allan), Andrew Fulks (Allan), Andrew McHarg (Allan), Andrew Tao (Allan), Andrii Skliar (Allan), Anjulie Agrusa (Allan), Ankur Srivastava (Allan), Ankur Verma (Allan), Anna Shors (Allan), Anna Warno (Allan), Antoni-Joan Solergibert I Llaquet (Allan), Arham Mehta (Allan), Arkadiusz Nowaczynski (Allan), Arti Jain (Allan), Ashwath Aithal (Allan), Ashwin Poojary (Allan), Asif Ahamed (Allan), Asit Mishra (Allan), Asma Kuriparambil Thekkumpate (Allan), Atefeh Sohrabizadeh (Allan), Avinash Kaur (Allan), Avinash Vem (Allan), Ayush Dattagupta (Allan), Barath Subramaniam Anandan (Allan), Bardiya Sadeghi (Allan), Ben Lanir (Allan), Benedikt Schifferer (Allan), Besmira Nushi (Allan), Bilal Kartal (Allan), Bill Thiede (Allan), Bita Darvish Rouhani (Allan), Bo Deng (Allan), Bob Schatz (Allan), Boris Ginsburg (Allan), Boxin Wang (Allan), Brad Nemire (Allan), Brandon Norick (Allan), Brian Dang (Allan), Brian Westphal (Allan), Brian Yu (Allan), Brucek Khailany (Allan), Bryan Catanzaro (Allan), Carlo del Mundo (Allan), Caryln Aarish (Allan), Chankyu Lee (Allan), Chantal Hwang (Allan), Charbel Sakr (Allan), Charles Wang (Allan), Charlie Truong (Allan), Chen Cui (Allan), Cheng Cheng (Allan), Cheng-Ping Hsieh (Allan), Chenghao Zhang (Allan), Chenhui Deng (Allan), Chintan Patel (Allan), Chris Alexiuk (Allan), Christian Cosgrove (Allan), Christian Munley (Allan), Christine Harvey (Allan), Christopher Parisien (Allan), Chunyang Shen (Allan), Coco Li (Allan), Collin Neale (Allan), Cynthia Gao (Allan), Cyril Meurillon (Allan), Dan Gil (Allan), Dan Su (Allan), Dan Zhao (Allan), Dane Corneil (Allan), Daniel Afrimi (Allan), Daniel Egert (Allan), Daniel Korzekwa (Allan), Daniel Lo (Allan), Daniel Machlab (Allan), Daniel Serebrenik (Allan), Daniil Sorokin (Allan), Daria Gitman (Allan), Daria Levy (Allan), Darko Stosic (Allan), David Mosallanezhad (Allan), David Yu (Allan), Davit Karamyan (Allan), Deena Donia (Allan), Deep Debroy (Allan), Deepak Narayanan (Allan), Devin O'Kelly (Allan), Dheeraj Peri (Allan), Dhruv Nathawani (Allan), Di (Allan), Wu, Dima Rekesh, Divyanshu Kakwani, Donald Plummer, Dong Anh, Dongfeng Yu, Dongfu Jiang, Donnie Kim, Dorrin Poorkay, Duncan Riach, Dusan Stosic, Dustin VanStee, Eavan Meng, Edgar Minasyan, Edward Lin, Eileen Margaret Peters Long, Elad Sarafin, Elad Segal, Elena Lantz, Ellie Evans, Elliott Ning, Eric Chung, Eric Harper, Eric Pham-Hung, Eric Tramel, Eric Yang, Erick Galinkin, Erik Pounds, Erika Goncalves Goncalves, Evan Briones, Evan Wu, Evelina Bakhturina, Evgeny Tsykunov, Ewa Dobrowolska, Faisal Ladhak, Farzan Memarian, Fay Wang, Fei Jia, Felipe Soares, Felipe Vieira Frujeri, Feng Chen, Fengguang Lin, Ferenc Galko, Frank Sun, Frankie Siino, Frida Hou, Gal Hubara Agam, Gal Kaplun, Gantavya Bhatt, Gargi Prasad, Garvit Kulshreshtha, George Armstrong, Gerald Shen, Giulio Borghesi, Gordana Neskovic, Gorkem Batmaz, Grace Lam, Greg Mason, Greg Pauloski, Grigor Nalbandyan, Grzegorz Chlebus, Grzegorz Karch, Guan-Ting Liu, Guoming Zhang, Guyue Huang, Haggai Maron, Haifeng Qian, Haim Elisha, Haoxing Ren, Haran Kumar Shiv Kumar, Haribhau Hud, Harris Nover, Harrison Saturley Hall, Hayate Iso, Helen Ngo, Herbert Hum, Herman Sahota, Hexin Wang, Himanshu Soni, Hovhannes Tamoyan, Hua Li, Huanhuan Chen, Hui Li, Hui Wang, Huy Nguyen, Ian Chiles, Ido Galil, Ido Shahaf, Igor Gitman, Igor Shovkun, Ilya Loshchilov, Ingo Guehring, Itamar Schen, Itay Levy, Itay Neeman, Ivan Moshkov, Izik Golan, Izzy Putterman, Jaemin Choi, Jakub Slowikowski, Jan Kautz, Jane Polak Scowcroft, Jared Casper, Jatin Mitra, Jeffrey Glick, Jenny Chen, Jesse Oliver, Jiacheng Xu, Jiafan Zhu, Jialin Song, Jian Zhang, Jiantao Jiao, Jiaqi Zeng, Jie Lou, Jim King, Jimmy Zhang, Jingquan Wang, Jinhang Choi, Jinju Chu, Joey Conway, Joey Guman, Johan Jatko, Johannes Rausch, John Kamalu, John Roberts, Johnny Greco, Johnny Mensel, Jonah Alben, Jonas Yang, Jonathan Cohen, Jonathan Raiman, Joseph Jennings, Joshua Mabry, Joshua Pierce, Joyjit Daw, Julien Veron Vialard, Junkeun Yi, Jupinder Parmar, Kajal Jain, Kan Zhu, Kari Briski, Katherine Cheung, Katherine Luna, Keith Willowhawk, Keith Wyss, Keshav Santhanam, Kevin Shih, Kezhi Kong, Khanh Nguyen, Khushi Bhardwaj, Kirthi Shankar Sivamani, Konstantinos Krommydas, Krishna C. Puvvada, Krzysztof Pawelec, Kumar Anik, Kyle Keprios, Kylie Day, Lawrence McAfee, Leo Du, Leon Derczynski, Li Ding, Linda Liu, Lingjie Wu, Lior Kadoch, Lizzie Wei, Luis Vega, Luke Robison, Lun Su, Maarten Van Segbroeck, Maciej Jakub Mikulski, Maer Rodrigues de Melo, Magda Sypula, Mahan Fathi, Makesh Narsimhan Sreedhar, Makesh Tarun Chandran, Manoj Kilaru, Maor Ashkenazi, Marc Cuevas, Marc Romeijn, Marcin Chochowski, Mark Cai, Mark Mozolewski, Markus Kliegl, Marta Stepniewska-Dziubinska, Martyna Patelka, Mattei Machczynski, Matvei Novikov, Mauricio Ferrato, Maximilian Golub, Mehrzad Samadi, Melissa Corpuz, Mengru Wang, Mengxi Wu, Meredith Price, Meriem Boubdir, Micah Schaffer, Michael Andersch, Michael Boone, Michael Gschwind, Michael Lightstone, Michael Loh, Michal Bien, Michal Zawalski, Michelle Gill, Miguel Martinez, Mikail Khona, Mike Chrzanowski, Mike Houston, Mingyuan Ma, Minseok Lee, Mohamed Fawzy, Mohammad Dabbah, Mohammad Shoeybi, Mostofa Patwary, Nabin Mulepati, Najeeb Nabwani, Namit Dhameja, Narimane Hennouni, Natalie Hereth, Nathaniel Pinckney, Nave Algarici, Nave Assaf, Netanel Haber, Nicholas Knight, Nick Reamaroon, Nickson Quak, Nidhi Bhatia, Nikhil Desai, Nikolai Ludwig, Nima Tajbakhsh, Ning Xu, Nir Ailon, Nirmal Juluru, Nitin Nitin, Ofri Masad, Oleg Rybakov, Oleksii Hrinchuk, Oleksii Kuchaiev, Olivia Viessmann, Olivier Delalleau, Oluwatobi Olabiyi, Omer Ullman Argov, Omri Puny, Oren Tropp, Pablo Ribalta, Pallab Bhattacharya, Panos Lampropoulos, Parth Mannan, Pasha Shamis, Patrick Legresley, Paul Gibbons, Pavlo Molchanov, Pawel Morkisz, Peter Dykas, Peter Jin, Pierre-Yves Aquilanti, Pinky Xu, Piotr Januszewski, Piotr Laskiewicz, Pooya Jannaty, Prakash Gurumurthy, Pranav Prashant Thombre, Prasoon Varshney, Pritam Gundecha, Przemek Tredak, Puhui Meng, Qiyu Wan, Rabeeh Karimi Mahabadi, Rachel Oberman, Rachit Garg, Radha Sri-Tharan, Rahul Kandu, Rakshit Sanadhya, Ran El-Yaniv, Ran Zilberstein, Rasoul Shafipour, Ray Macalisang, Rayen Tian, Reka Kovacs, Renjie Pi, Rick Izzo, Rima Shahbazyan, Rishabh Garg, Rishi Puri, Rita Fernandes Neves, Ritchie Zhao, Ritika Borkar, Ritu Gala, Riyad Islam, Robert Clark, Robert Hesse, Robert Kirby, Roger Waleffe, Rohit Watve, Roi Koren, Ron Banner, Ruoxi Zhang, Russell J. Hewett, Ryan Prenger, Ryan Stewart, Ryota Egashira, Sadegh Mahdavi, Saee Paliwal, Sagar Singh, Sahil Modi, Salika Dave, Samantha Shinagawa, Samuel Kriman, Sandip Bhaskar, Sangkug Lym, Sanjay Kariyappa, Sanjeev Satheesh, Saran Vikas Murari, Satish Pasumarthi, Saurabh Mishra, Saurav Muralidharan, Scott Hara, Sean Narentharen, Selvaraj Anandaraj, Seonjin Na, Seonmeyong Bak, Seonmyeong Bak, Sepehr Sameni, Seph Mard, Serge Panev, Seth Henneman, Seth Poulos, Shahar Mor, Shantanu Acharya, Shaona Ghosh, Sharath Turuvekere Sreenivas, Sharon Mendelson, Shaun Kotek, Shawn Wang, Shay Aharon, Shaya Gharghabi, Sheng-Chieh Lin, Shi Chen, Shiqing Fan, Shirish Baskaran, Shreya Gopa, Shrimai Prabhumoye, Shubham Pachori, Shubham Toshniwal, Shuoyang Ding, Shwetha Krishnamurthy, Siddharth Singh, Simeng Sun, Sirshak Das, Sivakumar Arayandi Thottakara, Smita Ithape, Somshubra Majumdar, Soumye Singhal, Sri Harsha Singudasu, Sridhar Bhuvanapalli, Srimukh Veccham, Stas Sergienko, Stefania Alborghetti, Stephen Ge, Su Rong, Sugam Dipak Devare, Sukrit Rao, Sumeet Kumar Barua, Sungsoo Ha, Sunny Gai, Suriya Gunasekar, Suseella Panguluri, Suyog Gupta, Sviataslau Hinzburh, Sweta Priyadarshi, Syeda Nahida Akter, Talor Abramovich, Tan Bui, Tanay Varshney, Tatevik Ter-Hovhannisyan, Teodor-Dumitru Ene, Terry Kong, Thanh Do, Tianhe Zhang, Tiffany Moore, Tijmen Blankevoort, Tim Moon, Tiyasa Mitra, Tom Balough, Tomasz Grzegorzek, Tomasz Hliwiak, Tomer Asida, Tomer Bar Natan, Tomer Keren, Tomer Ronen, Tony Salim, Tony Wang, Traian Rebedea, Tugrul Konuk, Twinkle Vashishth, Udi Karpas, Ushnish De, Vahid Noorozi, Venkat Srinivasan, Venmugil Elango, Vibhor Agrawal, Victor Cui, Vijay Korthikanti, Vikas Mehta, Vinay Rao, Virginia Wu, Vitaly Kurin, Vitaly Lavrukhin, Vladimir Anisimov, Vu Pham, Wanli Jiang, Wasi Uddin Ahmad, Wataru Ishihara, Wei Du, Wei Ping, Weiheng Chai, Wenliang Dai, Wesley Helmholz, Will Jennings, Will Zhu, Wojciech Prazuch, Xiaowei Ren, Xiwen Yu, Yan Breek, Yang Chen, Yang Yu, Yangyi Chen, Yaniv Galron, Yashaswi Karnati, Yejin Choi, Yev Meyer, Yi-Fu Wu, Yian Zhang, Ying Lin, Yonatan Geifman, Yonggan Fu, Youngeun Kwon, Yu Yao, Yugi Guvvla, Yuki Huang, Yunsheng Liu, Zach Moshe, Zachary Newell, Zhilin Wang, Zhiyu Li, Zhongbo Zhu, Zhuolin Yang, Zihan Liu, Zijie Yan, Zsolt-Alon Wertheimer

Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo

Il Quadro Generale: Un Super-Cervello per "Fare" le Cose

Immaginate di avere un assistente brillante. La maggior parte degli assistenti AI odierni è bravissima a chattare o a scrivere una rapida email. Nemotron 3 Ultra è progettato per essere un project manager a lungo termine. È costruito per restare sveglio per ore, aprire più finestre, cercare sul web, scrivere codice, correggere errori e completare compiti complessi da solo, senza che tu debba tenergli la mano in ogni passaggio.

Il paper afferma che questo modello è il più capace finora prodotto da NVIDIA, specificamente ottimizzato per essere veloce ed efficiente pur gestendo enormi quantità di informazioni (fino a 1 milione di parole in una volta sola).


1. Il Motore: Un'Auto Ibrida per l'IA

La maggior parte dei modelli AI sono come un singolo motore massiccio che funziona allo stesso modo per ogni compito. Nemotron 3 Ultra è diverso; è un veicolo ibrido.

  • Il Motore "Mamba": Pensate a questo come a un treno ad alta velocità. Si muove attraverso le informazioni molto rapidamente e non ha bisogno di trasportare un pesante treno di bagagli (memoria) dietro di sé. Questo lo rende incredibilmente veloce nel processare lunghe storie o documenti.
  • Il Motore "Transformer": Questo è il classico motore potente, ottimo per il ragionamento profondo e per comprendere relazioni complesse.
  • L'Ibrido: Il modello passa da un motore all'altro a seconda del compito. Utilizza il treno veloce per scansionare lunghi documenti e il motore potente per il pensiero profondo. Questa combinazione permette al modello di essere molto più veloce dei suoi competitor senza perdere intelligenza.

2. La Struttura del Team: La "Miscela di Esperti"

Immaginate una biblioteca gigante. Inveve di un unico bibliotecario che cerca di sapere tutto di ogni libro (il che è lento e stancante), la biblioteca ha 512 esperti specializzati.

  • Quando fate una domanda sul diritto, si svegliano solo gli esperti legali.
  • Quando chiedete di programmazione, si svegliano solo gli esperti di codice.
  • Quando chiedete di matematica, si svegliano solo gli esperti di matematica.

Questo è chiamato un modello Mixture-of-Experts (MoE). Nemotron 3 Ultra ha un totale di 550 miliardi di "esperti" (parametri), ma per ogni singola frase, ne "sveglia" solo 55 miliardi. È come avere un enorme team di specialisti in attesa, ma chiamare solo quelli specifici necessari per il lavoro attuale. Questo risparmia enormi quantità di energia e tempo.

3. L'Addestamento: Da Studente a Maestro

Il paper descrive un processo di addestramento in tre fasi per trasformare questo modello in un agente esperto:

  • Fase 1: Pre-addestramento (Leggere l'Enciclopedia): Il modello ha letto 20 trilioni di token di testo (parole e codice). È come leggere ogni libro in una biblioteca immensa. Hanno usato un formato speciale a "bassa precisione" (NVFP4) per farlo in modo efficiente, come leggere un libro con un carattere leggermente più piccolo per far stare più contenuti nella pagina senza perdere significato.
  • Fase 2: Fine-tuning Supervisionato (Il Tirocinio): Al modello è stato insegnato come seguire istruzioni, usare strumenti (come motori di ricerca o terminali di codice) e rimanere sicuro. Gli sono stati dati esempi di come risolvere problemi passo dopo passo.
  • Fase 3: Apprendimento per Rinforzo e Distillazione (La Masterclass): Questa è la formula segreta.
    • Prima, il modello si è esercitato in molte diverse "simulazioni" (come un videogioco per la programmazione, la matematica e il lavoro d'ufficio) per imparare attraverso tentativi ed errori.
    • Poi, hanno addestrato oltre 10 modelli "Insegnanti" specializzati (uno per il codice, uno per la matematica, uno per il lavoro d'ufficio, ecc.).
    • Infine, hanno utilizzato una tecnica chiamata MOPD (Multi-teacher On-Policy Distillation). Immaginate il modello principale (lo studente) che cerca di risolvere un problema, mentre gli insegnanti specializzati gli sussurrano consigli su esattamente come farlo. Lo studente impara imitando le migliori mosse dei docenti, combinando tutta la loro saggezza in un unico super-modello.

4. I Superpoteri

Il paper evidenzia tre superpoteri principali di cui gode Nemotron 3 Ultra:

  • La Memoria di 1 Milione di Parole: La maggior parte dei modelli AI si confonde se si fornisce un libro più lungo di pochi capitoli. Nemotron può leggere un contesto di 1 milione di token (circa le dimensioni di 10 romanzi completi) e ricordare i dettagli della primissima pagina mentre scrive l'ultima.
  • Il Controllo del "Budget di Ragionamento": Potete dire al modello: "Risolvi questo velocemente, magari saltando alcuni passaggi" oppure "Prenditi il tuo tempo e pensa profondamente". Questo permette agli utenti di scegliere tra velocità e precisione a seconda del compito.
  • Velocità: Grazie al suo motore ibrido e al sistema di esperti, può processare le informazioni fino a 6 volte più velocemente rispetto ad altri modelli pubblici di alto livello, ottenendo risposte uguali (o migliori).

5. La Stabilità del "Cervello"

Il paper ammette che addestrare un modello così grande è come camminare su una fune tesa. Hanno incontrato la "divergenza" (dove il modello inizia a fare ipotesi casuali e sbagliate) due volte durante l'addestramento.

  • Correzione 1: Si sono resi conto che una parte specifica della matematica (accumulo del gradiente) stava perdendo precisione, quindi sono tornati a una modalità ad alta precisione per quella parte.
  • Correzione 2: Hanno notato che gli "esperti" nel team stavano diventando sbilanciati (alcuni facevano tutto il lavoro, altri dormivano). Hanno regolato il sistema per garantire che il carico di lavoro fosse condiviso equamente, evitando che il modello andasse in crash.

6. Il Risultato: Aperto a Tutti

La parte più entusiasmante del paper è che NVIDIA sta rilasciando tutto in open source.

  • Rilasciano il Modello Base (il cervello grezzo).
  • Il Modello Post-addestrato (l'agente esperto).
  • Una Versione Quantizzata (una versione compressa che gira ancora più velocemente su chip NVIDIA specifici).
  • I Dati e le Ricette (l'elenco esatto dei libri che hanno letto e le istruzioni che hanno seguito).

In sintesi: Nemotron 3 Ultra è un'IA con un motore ibrido massiccio, progettata per essere un lavoratore autonomo a lungo termine. Utilizza un team di esperti specializzati per pensare profondamente ma muoversi velocemente, può ricordare un'intera biblioteca di testi e viene rilasciata al pubblico in modo che chiunque possa costruire i propri agenti IA con essa.

Sommerso dagli articoli nel tuo campo?

Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.

Prova Digest →