← Derniers articles
💬 NLP

Nemotron 3 Ultra: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

Nemotron 3 Ultra est un modèle hybride Mamba-Transformer open-source de 550 milliards de paramètres doté d'un contexte de 1 million de jetons et de techniques d'entraînement avancées qui offre une précision de pointe avec un débit d'inférence jusqu'à 6 fois supérieur, ce qui le rend idéal pour les tâches complexes de raisonnement agentique.

Auteurs originaux : NVIDIA (Allan), : (Allan), Aaron Blakeman (Allan), Aaron Thomas (Allan), Aastha Jhunjhunwala (Allan), Abhibha Gupta (Allan), Abhinav Khattar (Allan), Adam Rajfer (Allan), Adi Renduchintala (Allan), A
Publié 2026-06-16
📖 6 min de lecture🧠 Analyse approfondie

Auteurs originaux : NVIDIA (Allan), : (Allan), Aaron Blakeman (Allan), Aaron Thomas (Allan), Aastha Jhunjhunwala (Allan), Abhibha Gupta (Allan), Abhinav Khattar (Allan), Adam Rajfer (Allan), Adi Renduchintala (Allan), Adil Asif (Allan), Aditya Vavre (Allan), Adriana Flores Miranda (Allan), Ahmad Bilal (Allan), Aileen Zaman (Allan), Ajay Hotchandani (Allan), Akanksha Shukla (Allan), Akhiad Bercovich (Allan), Aleksander Ficek (Allan), Alex Gronskiy (Allan), Alex Kondratenko (Allan), Alex Steiner (Allan), Alex Ye (Allan), Alexander Bukharin (Allan), Alexandre Milesi (Allan), Ali Taghibakhshi (Allan), Alice Gatti (Allan), Alisa Liu (Allan), Alok Kumar (Allan), Amar Phanishayee (Allan), Ameya Sunil Mahabaleshwarkar (Allan), Amir Klein (Allan), Amit Zuker (Allan), Amnon Geifman (Allan), Anahita Bhiwandiwalla (Allan), Ananth Subramaniam (Allan), Andrea Santilli (Allan), Andrew Fulks (Allan), Andrew McHarg (Allan), Andrew Tao (Allan), Andrii Skliar (Allan), Anjulie Agrusa (Allan), Ankur Srivastava (Allan), Ankur Verma (Allan), Anna Shors (Allan), Anna Warno (Allan), Antoni-Joan Solergibert I Llaquet (Allan), Arham Mehta (Allan), Arkadiusz Nowaczynski (Allan), Arti Jain (Allan), Ashwath Aithal (Allan), Ashwin Poojary (Allan), Asif Ahamed (Allan), Asit Mishra (Allan), Asma Kuriparambil Thekkumpate (Allan), Atefeh Sohrabizadeh (Allan), Avinash Kaur (Allan), Avinash Vem (Allan), Ayush Dattagupta (Allan), Barath Subramaniam Anandan (Allan), Bardiya Sadeghi (Allan), Ben Lanir (Allan), Benedikt Schifferer (Allan), Besmira Nushi (Allan), Bilal Kartal (Allan), Bill Thiede (Allan), Bita Darvish Rouhani (Allan), Bo Deng (Allan), Bob Schatz (Allan), Boris Ginsburg (Allan), Boxin Wang (Allan), Brad Nemire (Allan), Brandon Norick (Allan), Brian Dang (Allan), Brian Westphal (Allan), Brian Yu (Allan), Brucek Khailany (Allan), Bryan Catanzaro (Allan), Carlo del Mundo (Allan), Caryln Aarish (Allan), Chankyu Lee (Allan), Chantal Hwang (Allan), Charbel Sakr (Allan), Charles Wang (Allan), Charlie Truong (Allan), Chen Cui (Allan), Cheng Cheng (Allan), Cheng-Ping Hsieh (Allan), Chenghao Zhang (Allan), Chenhui Deng (Allan), Chintan Patel (Allan), Chris Alexiuk (Allan), Christian Cosgrove (Allan), Christian Munley (Allan), Christine Harvey (Allan), Christopher Parisien (Allan), Chunyang Shen (Allan), Coco Li (Allan), Collin Neale (Allan), Cynthia Gao (Allan), Cyril Meurillon (Allan), Dan Gil (Allan), Dan Su (Allan), Dan Zhao (Allan), Dane Corneil (Allan), Daniel Afrimi (Allan), Daniel Egert (Allan), Daniel Korzekwa (Allan), Daniel Lo (Allan), Daniel Machlab (Allan), Daniel Serebrenik (Allan), Daniil Sorokin (Allan), Daria Gitman (Allan), Daria Levy (Allan), Darko Stosic (Allan), David Mosallanezhad (Allan), David Yu (Allan), Davit Karamyan (Allan), Deena Donia (Allan), Deep Debroy (Allan), Deepak Narayanan (Allan), Devin O'Kelly (Allan), Dheeraj Peri (Allan), Dhruv Nathawani (Allan), Di (Allan), Wu, Dima Rekesh, Divyanshu Kakwani, Donald Plummer, Dong Anh, Dongfeng Yu, Dongfu Jiang, Donnie Kim, Dorrin Poorkay, Duncan Riach, Dusan Stosic, Dustin VanStee, Eavan Meng, Edgar Minasyan, Edward Lin, Eileen Margaret Peters Long, Elad Sarafin, Elad Segal, Elena Lantz, Ellie Evans, Elliott Ning, Eric Chung, Eric Harper, Eric Pham-Hung, Eric Tramel, Eric Yang, Erick Galinkin, Erik Pounds, Erika Goncalves Goncalves, Evan Briones, Evan Wu, Evelina Bakhturina, Evgeny Tsykunov, Ewa Dobrowolska, Faisal Ladhak, Farzan Memarian, Fay Wang, Fei Jia, Felipe Soares, Felipe Vieira Frujeri, Feng Chen, Fengguang Lin, Ferenc Galko, Frank Sun, Frankie Siino, Frida Hou, Gal Hubara Agam, Gal Kaplun, Gantavya Bhatt, Gargi Prasad, Garvit Kulshreshtha, George Armstrong, Gerald Shen, Giulio Borghesi, Gordana Neskovic, Gorkem Batmaz, Grace Lam, Greg Mason, Greg Pauloski, Grigor Nalbandyan, Grzegorz Chlebus, Grzegorz Karch, Guan-Ting Liu, Guoming Zhang, Guyue Huang, Haggai Maron, Haifeng Qian, Haim Elisha, Haoxing Ren, Haran Kumar Shiv Kumar, Haribhau Hud, Harris Nover, Harrison Saturley Hall, Hayate Iso, Helen Ngo, Herbert Hum, Herman Sahota, Hexin Wang, Himanshu Soni, Hovhannes Tamoyan, Hua Li, Huanhuan Chen, Hui Li, Hui Wang, Huy Nguyen, Ian Chiles, Ido Galil, Ido Shahaf, Igor Gitman, Igor Shovkun, Ilya Loshchilov, Ingo Guehring, Itamar Schen, Itay Levy, Itay Neeman, Ivan Moshkov, Izik Golan, Izzy Putterman, Jaemin Choi, Jakub Slowikowski, Jan Kautz, Jane Polak Scowcroft, Jared Casper, Jatin Mitra, Jeffrey Glick, Jenny Chen, Jesse Oliver, Jiacheng Xu, Jiafan Zhu, Jialin Song, Jian Zhang, Jiantao Jiao, Jiaqi Zeng, Jie Lou, Jim King, Jimmy Zhang, Jingquan Wang, Jinhang Choi, Jinju Chu, Joey Conway, Joey Guman, Johan Jatko, Johannes Rausch, John Kamalu, John Roberts, Johnny Greco, Johnny Mensel, Jonah Alben, Jonas Yang, Jonathan Cohen, Jonathan Raiman, Joseph Jennings, Joshua Mabry, Joshua Pierce, Joyjit Daw, Julien Veron Vialard, Junkeun Yi, Jupinder Parmar, Kajal Jain, Kan Zhu, Kari Briski, Katherine Cheung, Katherine Luna, Keith Willowhawk, Keith Wyss, Keshav Santhanam, Kevin Shih, Kezhi Kong, Khanh Nguyen, Khushi Bhardwaj, Kirthi Shankar Sivamani, Konstantinos Krommydas, Krishna C. Puvvada, Krzysztof Pawelec, Kumar Anik, Kyle Keprios, Kylie Day, Lawrence McAfee, Leo Du, Leon Derczynski, Li Ding, Linda Liu, Lingjie Wu, Lior Kadoch, Lizzie Wei, Luis Vega, Luke Robison, Lun Su, Maarten Van Segbroeck, Maciej Jakub Mikulski, Maer Rodrigues de Melo, Magda Sypula, Mahan Fathi, Makesh Narsimhan Sreedhar, Makesh Tarun Chandran, Manoj Kilaru, Maor Ashkenazi, Marc Cuevas, Marc Romeijn, Marcin Chochowski, Mark Cai, Mark Mozolewski, Markus Kliegl, Marta Stepniewska-Dziubinska, Martyna Patelka, Mattei Machczynski, Matvei Novikov, Mauricio Ferrato, Maximilian Golub, Mehrzad Samadi, Melissa Corpuz, Mengru Wang, Mengxi Wu, Meredith Price, Meriem Boubdir, Micah Schaffer, Michael Andersch, Michael Boone, Michael Gschwind, Michael Lightstone, Michael Loh, Michal Bien, Michal Zawalski, Michelle Gill, Miguel Martinez, Mikail Khona, Mike Chrzanowski, Mike Houston, Mingyuan Ma, Minseok Lee, Mohamed Fawzy, Mohammad Dabbah, Mohammad Shoeybi, Mostofa Patwary, Nabin Mulepati, Najeeb Nabwani, Namit Dhameja, Narimane Hennouni, Natalie Hereth, Nathaniel Pinckney, Nave Algarici, Nave Assaf, Netanel Haber, Nicholas Knight, Nick Reamaroon, Nickson Quak, Nidhi Bhatia, Nikhil Desai, Nikolai Ludwig, Nima Tajbakhsh, Ning Xu, Nir Ailon, Nirmal Juluru, Nitin Nitin, Ofri Masad, Oleg Rybakov, Oleksii Hrinchuk, Oleksii Kuchaiev, Olivia Viessmann, Olivier Delalleau, Oluwatobi Olabiyi, Omer Ullman Argov, Omri Puny, Oren Tropp, Pablo Ribalta, Pallab Bhattacharya, Panos Lampropoulos, Parth Mannan, Pasha Shamis, Patrick Legresley, Paul Gibbons, Pavlo Molchanov, Pawel Morkisz, Peter Dykas, Peter Jin, Pierre-Yves Aquilanti, Pinky Xu, Piotr Januszewski, Piotr Laskiewicz, Pooya Jannaty, Prakash Gurumurthy, Pranav Prashant Thombre, Prasoon Varshney, Pritam Gundecha, Przemek Tredak, Puhui Meng, Qiyu Wan, Rabeeh Karimi Mahabadi, Rachel Oberman, Rachit Garg, Radha Sri-Tharan, Rahul Kandu, Rakshit Sanadhya, Ran El-Yaniv, Ran Zilberstein, Rasoul Shafipour, Ray Macalisang, Rayen Tian, Reka Kovacs, Renjie Pi, Rick Izzo, Rima Shahbazyan, Rishabh Garg, Rishi Puri, Rita Fernandes Neves, Ritchie Zhao, Ritika Borkar, Ritu Gala, Riyad Islam, Robert Clark, Robert Hesse, Robert Kirby, Roger Waleffe, Rohit Watve, Roi Koren, Ron Banner, Ruoxi Zhang, Russell J. Hewett, Ryan Prenger, Ryan Stewart, Ryota Egashira, Sadegh Mahdavi, Saee Paliwal, Sagar Singh, Sahil Modi, Salika Dave, Samantha Shinagawa, Samuel Kriman, Sandip Bhaskar, Sangkug Lym, Sanjay Kariyappa, Sanjeev Satheesh, Saran Vikas Murari, Satish Pasumarthi, Saurabh Mishra, Saurav Muralidharan, Scott Hara, Sean Narentharen, Selvaraj Anandaraj, Seonjin Na, Seonmeyong Bak, Seonmyeong Bak, Sepehr Sameni, Seph Mard, Serge Panev, Seth Henneman, Seth Poulos, Shahar Mor, Shantanu Acharya, Shaona Ghosh, Sharath Turuvekere Sreenivas, Sharon Mendelson, Shaun Kotek, Shawn Wang, Shay Aharon, Shaya Gharghabi, Sheng-Chieh Lin, Shi Chen, Shiqing Fan, Shirish Baskaran, Shreya Gopa, Shrimai Prabhumoye, Shubham Pachori, Shubham Toshniwal, Shuoyang Ding, Shwetha Krishnamurthy, Siddharth Singh, Simeng Sun, Sirshak Das, Sivakumar Arayandi Thottakara, Smita Ithape, Somshubra Majumdar, Soumye Singhal, Sri Harsha Singudasu, Sridhar Bhuvanapalli, Srimukh Veccham, Stas Sergienko, Stefania Alborghetti, Stephen Ge, Su Rong, Sugam Dipak Devare, Sukrit Rao, Sumeet Kumar Barua, Sungsoo Ha, Sunny Gai, Suriya Gunasekar, Suseella Panguluri, Suyog Gupta, Sviataslau Hinzburh, Sweta Priyadarshi, Syeda Nahida Akter, Talor Abramovich, Tan Bui, Tanay Varshney, Tatevik Ter-Hovhannisyan, Teodor-Dumitru Ene, Terry Kong, Thanh Do, Tianhe Zhang, Tiffany Moore, Tijmen Blankevoort, Tim Moon, Tiyasa Mitra, Tom Balough, Tomasz Grzegorzek, Tomasz Hliwiak, Tomer Asida, Tomer Bar Natan, Tomer Keren, Tomer Ronen, Tony Salim, Tony Wang, Traian Rebedea, Tugrul Konuk, Twinkle Vashishth, Udi Karpas, Ushnish De, Vahid Noorozi, Venkat Srinivasan, Venmugil Elango, Vibhor Agrawal, Victor Cui, Vijay Korthikanti, Vikas Mehta, Vinay Rao, Virginia Wu, Vitaly Kurin, Vitaly Lavrukhin, Vladimir Anisimov, Vu Pham, Wanli Jiang, Wasi Uddin Ahmad, Wataru Ishihara, Wei Du, Wei Ping, Weiheng Chai, Wenliang Dai, Wesley Helmholz, Will Jennings, Will Zhu, Wojciech Prazuch, Xiaowei Ren, Xiwen Yu, Yan Breek, Yang Chen, Yang Yu, Yangyi Chen, Yaniv Galron, Yashaswi Karnati, Yejin Choi, Yev Meyer, Yi-Fu Wu, Yian Zhang, Ying Lin, Yonatan Geifman, Yonggan Fu, Youngeun Kwon, Yu Yao, Yugi Guvvla, Yuki Huang, Yunsheng Liu, Zach Moshe, Zachary Newell, Zhilin Wang, Zhiyu Li, Zhongbo Zhu, Zhuolin Yang, Zihan Liu, Zijie Yan, Zsolt-Alon Wertheimer

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

La vue d'ensemble : Un super-cerveau pour « faire » les choses

Imaginez que vous avez un assistant brillant. La plupart des assistants IA d'aujourd'hui sont excellents pour discuter ou écrire un e-mail rapide. Nemotron 3 Ultra est conçu pour être un chef de projet de longue haleine. Il est construit pour rester éveillé pendant des heures, ouvrir plusieurs fenêtres, chercher sur le web, écrire du code, corriger des erreurs et accomplir des tâches complexes de manière autonome, sans que vous ayez besoin de lui tenir la main à chaque étape.

Le papier affirme que ce modèle est le plus performant à ce jour de la part de NVIDIA, spécifiquement optimisé pour être rapide et efficace tout en gérant des quantités massives d'informations (jusqu'à 1 million de mots à la fois).


1. Le moteur : Une voiture hybride pour l'IA

La plupart des modèles d'IA sont comme un moteur unique et massif qui fonctionne de la même manière pour chaque tâche. Nemotron 3 Ultra est différent ; c'est un véhicule hybride.

  • Le moteur « Mamba » : Considérez cela comme un train à grande vitesse. Il traverse l'information très rapidement et n'a pas besoin de transporter un train de bagages (mémoire) derrière lui. Cela le rend incroyablement rapide pour traiter de longs récits ou documents.
  • Le moteur « Transformer » : C'est le moteur classique et puissant, excellent pour le raisonnement profond et la compréhension de relations complexes.
  • L'hybride : Le modèle bascule entre ces deux moteurs selon la tâche. Il utilise le train rapide pour scanner de longs documents et le moteur puissant pour la réflexion profonde. Cette combinaison permet au modèle d'être beaucoup plus rapide que ses concurrents sans perdre en intelligence.

2. La structure de l'équipe : Le « Mélange d'experts »

Imaginez une immense bibliothèque. Au lieu d'un seul bibliothécaire essayant de tout savoir sur chaque livre (ce qui est lent et fatigant), la bibliothèque dispose de 512 experts spécialisés.

  • Quand vous posez une question sur le droit, seuls les experts juridiques se réveillent.
  • Quand vous posez une question sur le codage, seuls les experts en codage se réveillent.
  • Quand vous posesez une question sur les mathématiques, seuls les experts en maths se réveillent.

C'est ce qu'on appelle un modèle de Mélange d'Experts (Mixture-of-Experts - MoE). Nemotron 3 Ultra possède 550 milliards de « experts » au total (paramètres), mais pour une phrase donnée, il ne « réveille » que 55 milliards d'entre eux. C'est comme avoir une équipe massive de spécialistes en attente, mais n'appeler que les spécifiques dont vous avez besoin pour le travail actuel. Cela économise énormément d'énergie et de temps.

3. L'entraînement : De l'étudiant au maître

Le papier décrit un processus d'entraînement en trois étapes pour transformer ce modèle en un agent expert :

  • Étape 1 : Pré-entraînement (Lire l'encyclopédie) : Le modèle a lu 20 billions (trillions en anglais) de tokens de texte (mots et code). C'est comme lire chaque livre d'une immense bibliothèque. Ils ont utilisé un format spécial à « basse précision » (NVFP4) pour le faire efficacement, comme lire un livre avec une police légèrement plus petite pour en faire tenir plus sur la page sans perdre de sens.
  • Étape 2 : Ajustement supervisé (Le stage) : Le modèle a appris à suivre des instructions, à utiliser des outils (comme des moteurs de recherche ou des terminaux de code) et à rester sûr. On lui a donné des exemples de résolution de problèmes étape par étape.
  • Étape 3 : Apprentissage par renforcement et distillation (La classe de maître) : C'est la recette secrète.
    • D'abord, le modèle s'est exercé dans de nombreuses « simulations » (comme un jeu vidéo pour le codage, les maths et le travail de bureau) pour apprendre par essais et erreurs.
    • Ensuite, ils ont entraîné plus de 10 « modèles enseignants » spécialisés (un pour le codage, un pour les maths, un pour le travail de bureau, etc.).
    • Enfin, ils ont utilisé une technique appelée MOPD (Multi-teacher On-Policy Distillation). Imaginez le modèle principal (l'étudiant) essayant de résoudre un problème, tandis que les enseignants spécialisés lui murmurent des conseils sur la façon exacte de procéder. L'étudiant apprend en imitant les meilleurs mouvements des enseignants, combinant toute leur sagesse en un seul super-modèle.

4. Les super-pouvoirs

Le papier met en avant trois super-pouvoirs principaux de Nemotron 3 Ultra :

  • La mémoire d'un million de mots : La plupart des modèles d'IA perdent le fil si vous leur donnez un livre plus long que quelques chapitres. Nemotron peut lire un contexte de 1 million de tokens (environ la taille de 10 romans complets) et se souvenir des détails de la première page tout en écrivant la dernière.
  • Le contrôle du « budget de raisonnement » : Vous pouvez dire au modèle : « Résous ceci rapidement, quitte à sauter quelques étapes » ou « Prends ton temps et réfléchis profondément ». Cela permet aux utilisateurs de choisir entre vitesse et précision selon la tâche.
  • La vitesse : Grâce à son moteur hybride et à son système d'experts, il peut traiter l'information jusqu'à 6 fois plus vite que les autres modèles publics de haut niveau, tout en obtenant des réponses identiques (ou meilleures).

5. La stabilité du « cerveau »

Le papier admet que l'entraînement d'un modèle aussi grand est comme marcher sur une corde raide. Ils ont rencontré des cas de « divergence » (où le modèle commence à faire des prédictions aléatoires et mauvaises) à deux reprises pendant l'entraînement.

  • Correction 1 : Ils ont réalisé qu'une partie spécifique du calcul (accumulation de gradient) perdait en précision, ils sont donc revenus à un mode de haute précision pour cette partie.
  • Correction 2 : Ils ont remarqué que les « experts » de l'équipe devenaient déséquilibrés (certains faisaient tout le travail, d'autres dormaient). Ils ont ajusté le système pour garantir que la charge de travail soit partagée équitablement, évitant ainsi le plantage du modèle.

6. Le résultat : Ouvert à tous

La partie la plus excitante du papier est que NVIDIA libère les sources (open-source) de tout.

  • Ils publient le Modèle de base (le cerveau brut).
  • Le Modèle post-entraîné (l'agent expert).
  • Une Version quantifiée (une version compressée qui fonctionne encore plus vite sur des puces NVIDIA spécifiques).
  • Les Données et les Recettes (la liste exacte des livres lus et les instructions suivies).

En résumé : Nemotron 3 Ultra est une IA massive à moteur hybride, conçue pour être un travailleur autonome de longue durée. Elle utilise une équipe d'experts spécialisés pour réfléchir profondément tout en étant rapide, peut mémoriser toute une bibliothèque de textes, et est mise à la disposition du public pour que quiconque puisse construire ses propres agents d'IA avec elle.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →