← Últimos artículos
💬 NLP

Nemotron 3 Ultra: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

Nemotron 3 Ultra es un modelo híbrido Mamba-Transformer de código abierto, con 550 mil millones de parámetros, que cuenta con un contexto de 1 millón de tokens y técnicas de entrenamiento avanzadas que ofrece una precisión de vanguardia con un rendimiento de inferencia hasta 6 veces mayor, lo que lo hace ideal para tareas complejas de razonamiento agéntico.

Autores originales: NVIDIA (Allan), : (Allan), Aaron Blakeman (Allan), Aaron Thomas (Allan), Aastha Jhunjhunwala (Allan), Abhibha Gupta (Allan), Abhinav Khattar (Allan), Adam Rajfer (Allan), Adi Renduchintala (Allan), A
Publicado 2026-06-16
📖 6 min de lectura🧠 Análisis profundo

Autores originales: NVIDIA (Allan), : (Allan), Aaron Blakeman (Allan), Aaron Thomas (Allan), Aastha Jhunjhunwala (Allan), Abhibha Gupta (Allan), Abhinav Khattar (Allan), Adam Rajfer (Allan), Adi Renduchintala (Allan), Adil Asif (Allan), Aditya Vavre (Allan), Adriana Flores Miranda (Allan), Ahmad Bilal (Allan), Aileen Zaman (Allan), Ajay Hotchandani (Allan), Akanksha Shukla (Allan), Akhiad Bercovich (Allan), Aleksander Ficek (Allan), Alex Gronskiy (Allan), Alex Kondratenko (Allan), Alex Steiner (Allan), Alex Ye (Allan), Alexander Bukharin (Allan), Alexandre Milesi (Allan), Ali Taghibakhshi (Allan), Alice Gatti (Allan), Alisa Liu (Allan), Alok Kumar (Allan), Amar Phanishayee (Allan), Ameya Sunil Mahabaleshwarkar (Allan), Amir Klein (Allan), Amit Zuker (Allan), Amnon Geifman (Allan), Anahita Bhiwandiwalla (Allan), Ananth Subramaniam (Allan), Andrea Santilli (Allan), Andrew Fulks (Allan), Andrew McHarg (Allan), Andrew Tao (Allan), Andrii Skliar (Allan), Anjulie Agrusa (Allan), Ankur Srivastava (Allan), Ankur Verma (Allan), Anna Shors (Allan), Anna Warno (Allan), Antoni-Joan Solergibert I Llaquet (Allan), Arham Mehta (Allan), Arkadiusz Nowaczynski (Allan), Arti Jain (Allan), Ashwath Aithal (Allan), Ashwin Poojary (Allan), Asif Ahamed (Allan), Asit Mishra (Allan), Asma Kuriparambil Thekkumpate (Allan), Atefeh Sohrabizadeh (Allan), Avinash Kaur (Allan), Avinash Vem (Allan), Ayush Dattagupta (Allan), Barath Subramaniam Anandan (Allan), Bardiya Sadeghi (Allan), Ben Lanir (Allan), Benedikt Schifferer (Allan), Besmira Nushi (Allan), Bilal Kartal (Allan), Bill Thiede (Allan), Bita Darvish Rouhani (Allan), Bo Deng (Allan), Bob Schatz (Allan), Boris Ginsburg (Allan), Boxin Wang (Allan), Brad Nemire (Allan), Brandon Norick (Allan), Brian Dang (Allan), Brian Westphal (Allan), Brian Yu (Allan), Brucek Khailany (Allan), Bryan Catanzaro (Allan), Carlo del Mundo (Allan), Caryln Aarish (Allan), Chankyu Lee (Allan), Chantal Hwang (Allan), Charbel Sakr (Allan), Charles Wang (Allan), Charlie Truong (Allan), Chen Cui (Allan), Cheng Cheng (Allan), Cheng-Ping Hsieh (Allan), Chenghao Zhang (Allan), Chenhui Deng (Allan), Chintan Patel (Allan), Chris Alexiuk (Allan), Christian Cosgrove (Allan), Christian Munley (Allan), Christine Harvey (Allan), Christopher Parisien (Allan), Chunyang Shen (Allan), Coco Li (Allan), Collin Neale (Allan), Cynthia Gao (Allan), Cyril Meurillon (Allan), Dan Gil (Allan), Dan Su (Allan), Dan Zhao (Allan), Dane Corneil (Allan), Daniel Afrimi (Allan), Daniel Egert (Allan), Daniel Korzekwa (Allan), Daniel Lo (Allan), Daniel Machlab (Allan), Daniel Serebrenik (Allan), Daniil Sorokin (Allan), Daria Gitman (Allan), Daria Levy (Allan), Darko Stosic (Allan), David Mosallanezhad (Allan), David Yu (Allan), Davit Karamyan (Allan), Deena Donia (Allan), Deep Debroy (Allan), Deepak Narayanan (Allan), Devin O'Kelly (Allan), Dheeraj Peri (Allan), Dhruv Nathawani (Allan), Di (Allan), Wu, Dima Rekesh, Divyanshu Kakwani, Donald Plummer, Dong Anh, Dongfeng Yu, Dongfu Jiang, Donnie Kim, Dorrin Poorkay, Duncan Riach, Dusan Stosic, Dustin VanStee, Eavan Meng, Edgar Minasyan, Edward Lin, Eileen Margaret Peters Long, Elad Sarafin, Elad Segal, Elena Lantz, Ellie Evans, Elliott Ning, Eric Chung, Eric Harper, Eric Pham-Hung, Eric Tramel, Eric Yang, Erick Galinkin, Erik Pounds, Erika Goncalves Goncalves, Evan Briones, Evan Wu, Evelina Bakhturina, Evgeny Tsykunov, Ewa Dobrowolska, Faisal Ladhak, Farzan Memarian, Fay Wang, Fei Jia, Felipe Soares, Felipe Vieira Frujeri, Feng Chen, Fengguang Lin, Ferenc Galko, Frank Sun, Frankie Siino, Frida Hou, Gal Hubara Agam, Gal Kaplun, Gantavya Bhatt, Gargi Prasad, Garvit Kulshreshtha, George Armstrong, Gerald Shen, Giulio Borghesi, Gordana Neskovic, Gorkem Batmaz, Grace Lam, Greg Mason, Greg Pauloski, Grigor Nalbandyan, Grzegorz Chlebus, Grzegorz Karch, Guan-Ting Liu, Guoming Zhang, Guyue Huang, Haggai Maron, Haifeng Qian, Haim Elisha, Haoxing Ren, Haran Kumar Shiv Kumar, Haribhau Hud, Harris Nover, Harrison Saturley Hall, Hayate Iso, Helen Ngo, Herbert Hum, Herman Sahota, Hexin Wang, Himanshu Soni, Hovhannes Tamoyan, Hua Li, Huanhuan Chen, Hui Li, Hui Wang, Huy Nguyen, Ian Chiles, Ido Galil, Ido Shahaf, Igor Gitman, Igor Shovkun, Ilya Loshchilov, Ingo Guehring, Itamar Schen, Itay Levy, Itay Neeman, Ivan Moshkov, Izik Golan, Izzy Putterman, Jaemin Choi, Jakub Slowikowski, Jan Kautz, Jane Polak Scowcroft, Jared Casper, Jatin Mitra, Jeffrey Glick, Jenny Chen, Jesse Oliver, Jiacheng Xu, Jiafan Zhu, Jialin Song, Jian Zhang, Jiantao Jiao, Jiaqi Zeng, Jie Lou, Jim King, Jimmy Zhang, Jingquan Wang, Jinhang Choi, Jinju Chu, Joey Conway, Joey Guman, Johan Jatko, Johannes Rausch, John Kamalu, John Roberts, Johnny Greco, Johnny Mensel, Jonah Alben, Jonas Yang, Jonathan Cohen, Jonathan Raiman, Joseph Jennings, Joshua Mabry, Joshua Pierce, Joyjit Daw, Julien Veron Vialard, Junkeun Yi, Jupinder Parmar, Kajal Jain, Kan Zhu, Kari Briski, Katherine Cheung, Katherine Luna, Keith Willowhawk, Keith Wyss, Keshav Santhanam, Kevin Shih, Kezhi Kong, Khanh Nguyen, Khushi Bhardwaj, Kirthi Shankar Sivamani, Konstantinos Krommydas, Krishna C. Puvvada, Krzysztof Pawelec, Kumar Anik, Kyle Keprios, Kylie Day, Lawrence McAfee, Leo Du, Leon Derczynski, Li Ding, Linda Liu, Lingjie Wu, Lior Kadoch, Lizzie Wei, Luis Vega, Luke Robison, Lun Su, Maarten Van Segbroeck, Maciej Jakub Mikulski, Maer Rodrigues de Melo, Magda Sypula, Mahan Fathi, Makesh Narsimhan Sreedhar, Makesh Tarun Chandran, Manoj Kilaru, Maor Ashkenazi, Marc Cuevas, Marc Romeijn, Marcin Chochowski, Mark Cai, Mark Mozolewski, Markus Kliegl, Marta Stepniewska-Dziubinska, Martyna Patelka, Mattei Machczynski, Matvei Novikov, Mauricio Ferrato, Maximilian Golub, Mehrzad Samadi, Melissa Corpuz, Mengru Wang, Mengxi Wu, Meredith Price, Meriem Boubdir, Micah Schaffer, Michael Andersch, Michael Boone, Michael Gschwind, Michael Lightstone, Michael Loh, Michal Bien, Michal Zawalski, Michelle Gill, Miguel Martinez, Mikail Khona, Mike Chrzanowski, Mike Houston, Mingyuan Ma, Minseok Lee, Mohamed Fawzy, Mohammad Dabbah, Mohammad Shoeybi, Mostofa Patwary, Nabin Mulepati, Najeeb Nabwani, Namit Dhameja, Narimane Hennouni, Natalie Hereth, Nathaniel Pinckney, Nave Algarici, Nave Assaf, Netanel Haber, Nicholas Knight, Nick Reamaroon, Nickson Quak, Nidhi Bhatia, Nikhil Desai, Nikolai Ludwig, Nima Tajbakhsh, Ning Xu, Nir Ailon, Nirmal Juluru, Nitin Nitin, Ofri Masad, Oleg Rybakov, Oleksii Hrinchuk, Oleksii Kuchaiev, Olivia Viessmann, Olivier Delalleau, Oluwatobi Olabiyi, Omer Ullman Argov, Omri Puny, Oren Tropp, Pablo Ribalta, Pallab Bhattacharya, Panos Lampropoulos, Parth Mannan, Pasha Shamis, Patrick Legresley, Paul Gibbons, Pavlo Molchanov, Pawel Morkisz, Peter Dykas, Peter Jin, Pierre-Yves Aquilanti, Pinky Xu, Piotr Januszewski, Piotr Laskiewicz, Pooya Jannaty, Prakash Gurumurthy, Pranav Prashant Thombre, Prasoon Varshney, Pritam Gundecha, Przemek Tredak, Puhui Meng, Qiyu Wan, Rabeeh Karimi Mahabadi, Rachel Oberman, Rachit Garg, Radha Sri-Tharan, Rahul Kandu, Rakshit Sanadhya, Ran El-Yaniv, Ran Zilberstein, Rasoul Shafipour, Ray Macalisang, Rayen Tian, Reka Kovacs, Renjie Pi, Rick Izzo, Rima Shahbazyan, Rishabh Garg, Rishi Puri, Rita Fernandes Neves, Ritchie Zhao, Ritika Borkar, Ritu Gala, Riyad Islam, Robert Clark, Robert Hesse, Robert Kirby, Roger Waleffe, Rohit Watve, Roi Koren, Ron Banner, Ruoxi Zhang, Russell J. Hewett, Ryan Prenger, Ryan Stewart, Ryota Egashira, Sadegh Mahdavi, Saee Paliwal, Sagar Singh, Sahil Modi, Salika Dave, Samantha Shinagawa, Samuel Kriman, Sandip Bhaskar, Sangkug Lym, Sanjay Kariyappa, Sanjeev Satheesh, Saran Vikas Murari, Satish Pasumarthi, Saurabh Mishra, Saurav Muralidharan, Scott Hara, Sean Narentharen, Selvaraj Anandaraj, Seonjin Na, Seonmeyong Bak, Seonmyeong Bak, Sepehr Sameni, Seph Mard, Serge Panev, Seth Henneman, Seth Poulos, Shahar Mor, Shantanu Acharya, Shaona Ghosh, Sharath Turuvekere Sreenivas, Sharon Mendelson, Shaun Kotek, Shawn Wang, Shay Aharon, Shaya Gharghabi, Sheng-Chieh Lin, Shi Chen, Shiqing Fan, Shirish Baskaran, Shreya Gopa, Shrimai Prabhumoye, Shubham Pachori, Shubham Toshniwal, Shuoyang Ding, Shwetha Krishnamurthy, Siddharth Singh, Simeng Sun, Sirshak Das, Sivakumar Arayandi Thottakara, Smita Ithape, Somshubra Majumdar, Soumye Singhal, Sri Harsha Singudasu, Sridhar Bhuvanapalli, Srimukh Veccham, Stas Sergienko, Stefania Alborghetti, Stephen Ge, Su Rong, Sugam Dipak Devare, Sukrit Rao, Sumeet Kumar Barua, Sungsoo Ha, Sunny Gai, Suriya Gunasekar, Suseella Panguluri, Suyog Gupta, Sviataslau Hinzburh, Sweta Priyadarshi, Syeda Nahida Akter, Talor Abramovich, Tan Bui, Tanay Varshney, Tatevik Ter-Hovhannisyan, Teodor-Dumitru Ene, Terry Kong, Thanh Do, Tianhe Zhang, Tiffany Moore, Tijmen Blankevoort, Tim Moon, Tiyasa Mitra, Tom Balough, Tomasz Grzegorzek, Tomasz Hliwiak, Tomer Asida, Tomer Bar Natan, Tomer Keren, Tomer Ronen, Tony Salim, Tony Wang, Traian Rebedea, Tugrul Konuk, Twinkle Vashishth, Udi Karpas, Ushnish De, Vahid Noorozi, Venkat Srinivasan, Venmugil Elango, Vibhor Agrawal, Victor Cui, Vijay Korthikanti, Vikas Mehta, Vinay Rao, Virginia Wu, Vitaly Kurin, Vitaly Lavrukhin, Vladimir Anisimov, Vu Pham, Wanli Jiang, Wasi Uddin Ahmad, Wataru Ishihara, Wei Du, Wei Ping, Weiheng Chai, Wenliang Dai, Wesley Helmholz, Will Jennings, Will Zhu, Wojciech Prazuch, Xiaowei Ren, Xiwen Yu, Yan Breek, Yang Chen, Yang Yu, Yangyi Chen, Yaniv Galron, Yashaswi Karnati, Yejin Choi, Yev Meyer, Yi-Fu Wu, Yian Zhang, Ying Lin, Yonatan Geifman, Yonggan Fu, Youngeun Kwon, Yu Yao, Yugi Guvvla, Yuki Huang, Yunsheng Liu, Zach Moshe, Zachary Newell, Zhilin Wang, Zhiyu Li, Zhongbo Zhu, Zhuolin Yang, Zihan Liu, Zijie Yan, Zsolt-Alon Wertheimer

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

La visión general: Un supercerebro para "hacer" cosas

Imagina que tienes un asistente brillante. La mayoría de los asistentes de IA actuales son excelentes para charlar o escribir un correo electrónico rápido. Nemotron 3 Ultra está diseñado para ser un gestor de proyectos de larga duración. Está construido para permanecer despierto durante horas, abrir múltiples ventanas, buscar en la web, escribir código, corregir errores y completar tareas complejas por sí mismo sin necesidad de que le lleves de la mano en cada paso del camino.

El artículo afirma que este modelo es el "más capaz" hasta la fecha de NVIDIA, optimizado específicamente para ser rápido y eficiente mientras maneja cantidades masivas de información (hasta 1 millón de palabras a la vez).


1. El motor: Un coche híbrido para la IA

La mayoría de los modelos de IA son como un motor único y masivo que funciona de la misma manera para cada tarea. Nemotron 3 Ultra es diferente; es un vehículo híbrido.

  • El motor "Mamba": Piensa en esto como un tren de alta velocidad. Se mueve a través de la información muy rápidamente y no necesita cargar con un pesado tren de equipaje (memoria) detrás de él. Esto lo hace increíblemente rápido para procesar historias o documentos largos.
  • El motor "Transformer": Este es el motor clásico y potente que es excelente para el razonamiento profundo y la comprensión de relaciones complejas.
  • El híbrido: El modelo cambia entre estos dos motores dependiendo de la tarea. Utiliza el tren rápido para escanear documentos largos y el motor potente para el pensamiento profundo. Esta combinación le permite ser mucho más rápido que sus competidores sin perder inteligencia.

2. La estructura del equipo: La "Mezcla de Expertos"

Imagina una biblioteca gigante. En lugar de un solo bibliotecario intentando saberlo todo sobre cada libro (lo cual es lento y agotador), la biblioteca tiene 512 expertos especializados.

  • Cuando haces una pregunta sobre derecho, solo se despiertan los expertos legales.
  • Cuando preguntas sobre programación, solo se despiertan los expertos en programación.
  • Cuando preguntas sobre matemáticas, solo se despiertan los expertos en matemáticas.

Esto se llama un modelo de Mezcla de Expertos (Mixture-of-Experts o MoE). Nemotron 3 Ultra tiene 550 mil millones de "expertos" totales (parámetros), pero para cualquier frase individual, solo "despierta" 55 mil millones de ellos. Esto es como tener un enorme equipo de especialistas en espera, pero llamando solo a los específicos que necesitas para el trabajo en ese momento. Esto ahorra una cantidad masiva de energía y tiempo.

3. El entrenamiento: De estudiante a maestro

El artículo describe un proceso de entrenamiento de tres pasos para convertir este modelo en un agente experto:

  • Paso 1: Pre-entrenamiento (Leer la enciclopedia): El modelo leyó 20 billones de tokens de texto (palabras y código). Es como leer cada libro de una biblioteca masiva. Utilizaron un formato especial de "baja precisión" (NVFP4) para hacer esto de manera eficiente, como leer un libro con una fuente ligeramente más pequeña para que quepa más en la página sin perder el significado.
  • Paso 2: Ajuste fino supervisado (La pasantía): Se le enseñó al modelo cómo seguir instrucciones, usar herramientas (como motores de búsqueda o terminales de código) y mantenerse seguro. Le dieron ejemplos de cómo resolver problemas paso a paso.
  • Paso 3: Aprendizaje por refuerzo y destilación (La clase magistral): Esta es la salsa secreta.
    • Primero, el modelo practicó en muchas diferentes "simulaciones" (como un videojuego para programación, matemáticas y trabajo de oficina) para aprender mediante el ensayo y error.
    • Luego, entrenaron a más de 10 "modelos maestros" especializados (uno para programación, uno para matemáticas, uno para trabajo de oficina, etc.).
    • Finalmente, utilizaron una técnica llamada MOPD (Destilación Multi-maestro On-Policy). Imagina que el modelo principal (el estudiante) intenta resolver un problema, y los maestros especializados le susurran consejos sobre exactamente cómo hacerlo. El estudiante aprende imitando los mejores movimientos de los maestros, combinando toda su sabiduría en un supermodelo.

4. Los superpoderes

El artículo destaca tres superpoderes principales que tiene Nemotron 3 Ultra:

  • La memoria de 1 millón de palabras: La mayoría de los modelos de IA se confunden si les das un libro más largo que unos pocos capítulos. Nemotron puede leer un contexto de 1 millón de tokens (aproximadamente el tamaño de 10 novelas completas) y recordar detalles de la primera página mientras escribe la última.
  • Control del "Presupuesto de Razonamiento": Puedes decirle al modelo: "Resuelve esto rápido pero quizás sáltate algunos pasos", o "Tómate tu tiempo y piensa profundamente". Esto permite a los usuarios elegir entre velocidad y precisión dependiendo de la tarea.
  • Velocidad: Debido a su motor híbrido y su sistema de expertos, puede procesar información hasta 6 veces más rápido que otros modelos públicos de alto nivel mientras obtiene las mismas (o mejores) respuestas.

5. La estabilidad del "Cerebro"

El artículo admite que entrenar un modelo de este tamaño es como caminar por la cuerda floja. Encontraron "divergencia" (donde el modelo empieza a hacer conjetzas aleatorias y malas) dos veces durante el entrenamiento.

  • Solución 1: Se dieron cuenta de que una parte específica de las matemáticas (acumulación de gradientes) estaba perdiendo precisión, así que volvieron a un modo de mayor precisión para esa parte.
  • Solución 2: Notaron que los "expertos" en el equipo se estaban desequilibrando (algunos hacían todo el trabajo, otros dormían). Ajustaron el sistema para asegurar que la carga de trabajo se compartiera de manera justa, evitando que el modelo colapsara.

6. El resultado: Abierto para todos

La parte más emocionante del artículo es que NVIDIA está haciendo código abierto (open-source) de todo.

  • Están lanzando el Modelo Base (el cerebro bruto).
  • El Modelo Post-entrenado (el agente experto).
  • Una Versión Cuantizada (una versión comprimida que se ejecuta aún más rápido en chips NVIDIA específicos).
  • Los Datos y las Recetas (la lista exacta de libros que leyeron y las instrucciones que siguieron).

En resumen: Nemotron 3 Ultra es una IA de motor híbrido masivo diseñada para ser un trabajador autónomo de larga duración. Utiliza un equipo de expertos especializados para pensar profundamente pero moverse rápido, puede recordar una biblioteca entera de texto y se está lanzando al público para que cualquiera pueda construir sus propios agentes de IA con ella.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →