← Últimos artigos
💬 NLP

Nemotron 3 Ultra: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

O Nemotron 3 Ultra é um modelo híbrido Mamba-Transformer de código aberto, com 550 bilhões de parâmetros, que apresenta um contexto de 1 milhão de tokens e técnicas de treinamento avançadas que entregam uma precisão de estado da arte com até 6x mais taxa de transferência de inferência, tornando-o ideal para tarefas complexas de raciocínio de agentes.

Autores originais: NVIDIA (Allan), : (Allan), Aaron Blakeman (Allan), Aaron Thomas (Allan), Aastha Jhunjhunwala (Allan), Abhibha Gupta (Allan), Abhinav Khattar (Allan), Adam Rajfer (Allan), Adi Renduchintala (Allan), A
Publicado 2026-06-16
📖 6 min de leitura🧠 Leitura aprofundada

Autores originais: NVIDIA (Allan), : (Allan), Aaron Blakeman (Allan), Aaron Thomas (Allan), Aastha Jhunjhunwala (Allan), Abhibha Gupta (Allan), Abhinav Khattar (Allan), Adam Rajfer (Allan), Adi Renduchintala (Allan), Adil Asif (Allan), Aditya Vavre (Allan), Adriana Flores Miranda (Allan), Ahmad Bilal (Allan), Aileen Zaman (Allan), Ajay Hotchandani (Allan), Akanksha Shukla (Allan), Akhiad Bercovich (Allan), Aleksander Ficek (Allan), Alex Gronskiy (Allan), Alex Kondratenko (Allan), Alex Steiner (Allan), Alex Ye (Allan), Alexander Bukharin (Allan), Alexandre Milesi (Allan), Ali Taghibakhshi (Allan), Alice Gatti (Allan), Alisa Liu (Allan), Alok Kumar (Allan), Amar Phanishayee (Allan), Ameya Sunil Mahabaleshwarkar (Allan), Amir Klein (Allan), Amit Zuker (Allan), Amnon Geifman (Allan), Anahita Bhiwandiwalla (Allan), Ananth Subramaniam (Allan), Andrea Santilli (Allan), Andrew Fulks (Allan), Andrew McHarg (Allan), Andrew Tao (Allan), Andrii Skliar (Allan), Anjulie Agrusa (Allan), Ankur Srivastava (Allan), Ankur Verma (Allan), Anna Shors (Allan), Anna Warno (Allan), Antoni-Joan Solergibert I Llaquet (Allan), Arham Mehta (Allan), Arkadiusz Nowaczynski (Allan), Arti Jain (Allan), Ashwath Aithal (Allan), Ashwin Poojary (Allan), Asif Ahamed (Allan), Asit Mishra (Allan), Asma Kuriparambil Thekkumpate (Allan), Atefeh Sohrabizadeh (Allan), Avinash Kaur (Allan), Avinash Vem (Allan), Ayush Dattagupta (Allan), Barath Subramaniam Anandan (Allan), Bardiya Sadeghi (Allan), Ben Lanir (Allan), Benedikt Schifferer (Allan), Besmira Nushi (Allan), Bilal Kartal (Allan), Bill Thiede (Allan), Bita Darvish Rouhani (Allan), Bo Deng (Allan), Bob Schatz (Allan), Boris Ginsburg (Allan), Boxin Wang (Allan), Brad Nemire (Allan), Brandon Norick (Allan), Brian Dang (Allan), Brian Westphal (Allan), Brian Yu (Allan), Brucek Khailany (Allan), Bryan Catanzaro (Allan), Carlo del Mundo (Allan), Caryln Aarish (Allan), Chankyu Lee (Allan), Chantal Hwang (Allan), Charbel Sakr (Allan), Charles Wang (Allan), Charlie Truong (Allan), Chen Cui (Allan), Cheng Cheng (Allan), Cheng-Ping Hsieh (Allan), Chenghao Zhang (Allan), Chenhui Deng (Allan), Chintan Patel (Allan), Chris Alexiuk (Allan), Christian Cosgrove (Allan), Christian Munley (Allan), Christine Harvey (Allan), Christopher Parisien (Allan), Chunyang Shen (Allan), Coco Li (Allan), Collin Neale (Allan), Cynthia Gao (Allan), Cyril Meurillon (Allan), Dan Gil (Allan), Dan Su (Allan), Dan Zhao (Allan), Dane Corneil (Allan), Daniel Afrimi (Allan), Daniel Egert (Allan), Daniel Korzekwa (Allan), Daniel Lo (Allan), Daniel Machlab (Allan), Daniel Serebrenik (Allan), Daniil Sorokin (Allan), Daria Gitman (Allan), Daria Levy (Allan), Darko Stosic (Allan), David Mosallanezhad (Allan), David Yu (Allan), Davit Karamyan (Allan), Deena Donia (Allan), Deep Debroy (Allan), Deepak Narayanan (Allan), Devin O'Kelly (Allan), Dheeraj Peri (Allan), Dhruv Nathawani (Allan), Di (Allan), Wu, Dima Rekesh, Divyanshu Kakwani, Donald Plummer, Dong Anh, Dongfeng Yu, Dongfu Jiang, Donnie Kim, Dorrin Poorkay, Duncan Riach, Dusan Stosic, Dustin VanStee, Eavan Meng, Edgar Minasyan, Edward Lin, Eileen Margaret Peters Long, Elad Sarafin, Elad Segal, Elena Lantz, Ellie Evans, Elliott Ning, Eric Chung, Eric Harper, Eric Pham-Hung, Eric Tramel, Eric Yang, Erick Galinkin, Erik Pounds, Erika Goncalves Goncalves, Evan Briones, Evan Wu, Evelina Bakhturina, Evgeny Tsykunov, Ewa Dobrowolska, Faisal Ladhak, Farzan Memarian, Fay Wang, Fei Jia, Felipe Soares, Felipe Vieira Frujeri, Feng Chen, Fengguang Lin, Ferenc Galko, Frank Sun, Frankie Siino, Frida Hou, Gal Hubara Agam, Gal Kaplun, Gantavya Bhatt, Gargi Prasad, Garvit Kulshreshtha, George Armstrong, Gerald Shen, Giulio Borghesi, Gordana Neskovic, Gorkem Batmaz, Grace Lam, Greg Mason, Greg Pauloski, Grigor Nalbandyan, Grzegorz Chlebus, Grzegorz Karch, Guan-Ting Liu, Guoming Zhang, Guyue Huang, Haggai Maron, Haifeng Qian, Haim Elisha, Haoxing Ren, Haran Kumar Shiv Kumar, Haribhau Hud, Harris Nover, Harrison Saturley Hall, Hayate Iso, Helen Ngo, Herbert Hum, Herman Sahota, Hexin Wang, Himanshu Soni, Hovhannes Tamoyan, Hua Li, Huanhuan Chen, Hui Li, Hui Wang, Huy Nguyen, Ian Chiles, Ido Galil, Ido Shahaf, Igor Gitman, Igor Shovkun, Ilya Loshchilov, Ingo Guehring, Itamar Schen, Itay Levy, Itay Neeman, Ivan Moshkov, Izik Golan, Izzy Putterman, Jaemin Choi, Jakub Slowikowski, Jan Kautz, Jane Polak Scowcroft, Jared Casper, Jatin Mitra, Jeffrey Glick, Jenny Chen, Jesse Oliver, Jiacheng Xu, Jiafan Zhu, Jialin Song, Jian Zhang, Jiantao Jiao, Jiaqi Zeng, Jie Lou, Jim King, Jimmy Zhang, Jingquan Wang, Jinhang Choi, Jinju Chu, Joey Conway, Joey Guman, Johan Jatko, Johannes Rausch, John Kamalu, John Roberts, Johnny Greco, Johnny Mensel, Jonah Alben, Jonas Yang, Jonathan Cohen, Jonathan Raiman, Joseph Jennings, Joshua Mabry, Joshua Pierce, Joyjit Daw, Julien Veron Vialard, Junkeun Yi, Jupinder Parmar, Kajal Jain, Kan Zhu, Kari Briski, Katherine Cheung, Katherine Luna, Keith Willowhawk, Keith Wyss, Keshav Santhanam, Kevin Shih, Kezhi Kong, Khanh Nguyen, Khushi Bhardwaj, Kirthi Shankar Sivamani, Konstantinos Krommydas, Krishna C. Puvvada, Krzysztof Pawelec, Kumar Anik, Kyle Keprios, Kylie Day, Lawrence McAfee, Leo Du, Leon Derczynski, Li Ding, Linda Liu, Lingjie Wu, Lior Kadoch, Lizzie Wei, Luis Vega, Luke Robison, Lun Su, Maarten Van Segbroeck, Maciej Jakub Mikulski, Maer Rodrigues de Melo, Magda Sypula, Mahan Fathi, Makesh Narsimhan Sreedhar, Makesh Tarun Chandran, Manoj Kilaru, Maor Ashkenazi, Marc Cuevas, Marc Romeijn, Marcin Chochowski, Mark Cai, Mark Mozolewski, Markus Kliegl, Marta Stepniewska-Dziubinska, Martyna Patelka, Mattei Machczynski, Matvei Novikov, Mauricio Ferrato, Maximilian Golub, Mehrzad Samadi, Melissa Corpuz, Mengru Wang, Mengxi Wu, Meredith Price, Meriem Boubdir, Micah Schaffer, Michael Andersch, Michael Boone, Michael Gschwind, Michael Lightstone, Michael Loh, Michal Bien, Michal Zawalski, Michelle Gill, Miguel Martinez, Mikail Khona, Mike Chrzanowski, Mike Houston, Mingyuan Ma, Minseok Lee, Mohamed Fawzy, Mohammad Dabbah, Mohammad Shoeybi, Mostofa Patwary, Nabin Mulepati, Najeeb Nabwani, Namit Dhameja, Narimane Hennouni, Natalie Hereth, Nathaniel Pinckney, Nave Algarici, Nave Assaf, Netanel Haber, Nicholas Knight, Nick Reamaroon, Nickson Quak, Nidhi Bhatia, Nikhil Desai, Nikolai Ludwig, Nima Tajbakhsh, Ning Xu, Nir Ailon, Nirmal Juluru, Nitin Nitin, Ofri Masad, Oleg Rybakov, Oleksii Hrinchuk, Oleksii Kuchaiev, Olivia Viessmann, Olivier Delalleau, Oluwatobi Olabiyi, Omer Ullman Argov, Omri Puny, Oren Tropp, Pablo Ribalta, Pallab Bhattacharya, Panos Lampropoulos, Parth Mannan, Pasha Shamis, Patrick Legresley, Paul Gibbons, Pavlo Molchanov, Pawel Morkisz, Peter Dykas, Peter Jin, Pierre-Yves Aquilanti, Pinky Xu, Piotr Januszewski, Piotr Laskiewicz, Pooya Jannaty, Prakash Gurumurthy, Pranav Prashant Thombre, Prasoon Varshney, Pritam Gundecha, Przemek Tredak, Puhui Meng, Qiyu Wan, Rabeeh Karimi Mahabadi, Rachel Oberman, Rachit Garg, Radha Sri-Tharan, Rahul Kandu, Rakshit Sanadhya, Ran El-Yaniv, Ran Zilberstein, Rasoul Shafipour, Ray Macalisang, Rayen Tian, Reka Kovacs, Renjie Pi, Rick Izzo, Rima Shahbazyan, Rishabh Garg, Rishi Puri, Rita Fernandes Neves, Ritchie Zhao, Ritika Borkar, Ritu Gala, Riyad Islam, Robert Clark, Robert Hesse, Robert Kirby, Roger Waleffe, Rohit Watve, Roi Koren, Ron Banner, Ruoxi Zhang, Russell J. Hewett, Ryan Prenger, Ryan Stewart, Ryota Egashira, Sadegh Mahdavi, Saee Paliwal, Sagar Singh, Sahil Modi, Salika Dave, Samantha Shinagawa, Samuel Kriman, Sandip Bhaskar, Sangkug Lym, Sanjay Kariyappa, Sanjeev Satheesh, Saran Vikas Murari, Satish Pasumarthi, Saurabh Mishra, Saurav Muralidharan, Scott Hara, Sean Narentharen, Selvaraj Anandaraj, Seonjin Na, Seonmeyong Bak, Seonmyeong Bak, Sepehr Sameni, Seph Mard, Serge Panev, Seth Henneman, Seth Poulos, Shahar Mor, Shantanu Acharya, Shaona Ghosh, Sharath Turuvekere Sreenivas, Sharon Mendelson, Shaun Kotek, Shawn Wang, Shay Aharon, Shaya Gharghabi, Sheng-Chieh Lin, Shi Chen, Shiqing Fan, Shirish Baskaran, Shreya Gopa, Shrimai Prabhumoye, Shubham Pachori, Shubham Toshniwal, Shuoyang Ding, Shwetha Krishnamurthy, Siddharth Singh, Simeng Sun, Sirshak Das, Sivakumar Arayandi Thottakara, Smita Ithape, Somshubra Majumdar, Soumye Singhal, Sri Harsha Singudasu, Sridhar Bhuvanapalli, Srimukh Veccham, Stas Sergienko, Stefania Alborghetti, Stephen Ge, Su Rong, Sugam Dipak Devare, Sukrit Rao, Sumeet Kumar Barua, Sungsoo Ha, Sunny Gai, Suriya Gunasekar, Suseella Panguluri, Suyog Gupta, Sviataslau Hinzburh, Sweta Priyadarshi, Syeda Nahida Akter, Talor Abramovich, Tan Bui, Tanay Varshney, Tatevik Ter-Hovhannisyan, Teodor-Dumitru Ene, Terry Kong, Thanh Do, Tianhe Zhang, Tiffany Moore, Tijmen Blankevoort, Tim Moon, Tiyasa Mitra, Tom Balough, Tomasz Grzegorzek, Tomasz Hliwiak, Tomer Asida, Tomer Bar Natan, Tomer Keren, Tomer Ronen, Tony Salim, Tony Wang, Traian Rebedea, Tugrul Konuk, Twinkle Vashishth, Udi Karpas, Ushnish De, Vahid Noorozi, Venkat Srinivasan, Venmugil Elango, Vibhor Agrawal, Victor Cui, Vijay Korthikanti, Vikas Mehta, Vinay Rao, Virginia Wu, Vitaly Kurin, Vitaly Lavrukhin, Vladimir Anisimov, Vu Pham, Wanli Jiang, Wasi Uddin Ahmad, Wataru Ishihara, Wei Du, Wei Ping, Weiheng Chai, Wenliang Dai, Wesley Helmholz, Will Jennings, Will Zhu, Wojciech Prazuch, Xiaowei Ren, Xiwen Yu, Yan Breek, Yang Chen, Yang Yu, Yangyi Chen, Yaniv Galron, Yashaswi Karnati, Yejin Choi, Yev Meyer, Yi-Fu Wu, Yian Zhang, Ying Lin, Yonatan Geifman, Yonggan Fu, Youngeun Kwon, Yu Yao, Yugi Guvvla, Yuki Huang, Yunsheng Liu, Zach Moshe, Zachary Newell, Zhilin Wang, Zhiyu Li, Zhongbo Zhu, Zhuolin Yang, Zihan Liu, Zijie Yan, Zsolt-Alon Wertheimer

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

O Panorama Geral: Um Supercérebro para "Fazer" Coisas

Imagine que você tem um assistente brilhante. A maioria dos assistentes de IA hoje é ótima em conversar ou escrever um e-mail rápido. O Nemotron 3 Ultra foi projetado para ser um gerente de projetos de longa distância. Ele foi construído para permanecer acordado por horas, abrir múltiplas janelas, pesquisar na web, escrever código, corrigir erros e completar tarefas complexas por conta própria, sem precisar que você segure sua mão a cada passo do caminho.

O artigo afirma que este modelo é o "mais capaz" até o momento da NVIDIA, otimizado especificamente para ser rápido e eficiente, enquanto lida com quantidades massivas de informações (até 1 milhão de palavras de uma só vez).


1. O Motor: Um Carro Híbrido para IA

A maioria dos modelos de IA é como um motor único e massivo que funciona da mesma forma para todas as tarefas. O Nemotron 3 Ultra é diferente; ele é um veículo híbrido.

  • O Motor "Mamba": Pense nisso como um trem de alta velocidade. Ele se move através da informação muito rapidamente e não precisa carregar um trem de bagagem pesado (memória) atrás de si. Isso o torna incrivelmente rápido ao processar histórias ou documentos longos.
  • O Motor "Transformer": Este é o motor clássico e poderoso, que é excelente em raciocínio profundo e compreensão de relações complexas.
  • O Híbrido: O modelo alterna entre esses dois motores dependendo da tarefa. Ele usa o trem rápido para escanear documentos longos e o motor poderoso para o pensamento profundo. Essa combinação permite que ele seja muito mais rápido que seus concorrentes sem perder a inteligência.

2. A Estrutura da Equipe: A "Mistura de Especialistas"

Imagine uma biblioteca gigante. Em vez de um único bibliotecário tentando saber tudo sobre todos os livros (o que é lento e cansativo), a biblioteca possui 512 especialistas especializados.

  • Quando você faz uma pergunta sobre direito, apenas os especialistas jurídicos acordam.
  • Quando você pergunta sobre programação, apenas os especialistas em codificação acordam.
  • Quando você pergunta sobre matemática, apenas os especialistas em matemática acordam.

Isso é chamado de um modelo de Mistura de Especialistas (Mixture-of-Experts - MoE). O Nemotron 3 Ultra possui 550 bilhões de "especialistas" totais (parâmetros), mas para qualquer frase individual, ele "acorda" apenas 55 bilhões deles. É como ter uma enorme equipe de especialistas de prontidão, mas chamando apenas os específicos que você precisa para o trabalho agora. Isso economiza uma quantidade massiva de energia e tempo.

3. O Treinamento: De Estudante a Mestre

O artigo descreve um processo de treinamento de três etapas para transformar este modelo em um agente especialista:

  • Etapa 1: Pré-treinamento (Lendo a Enciclopédia): O modelo leu 20 trilhões de tokens de texto (palavras e código). É como ler todos os livros de uma biblioteca imensa. Eles usaram um formato especial de "baixa precisão" (NVFP4) para fazer isso de forma eficiente, como ler um livro com uma fonte ligeiramente menor para caber mais conteúdo na página sem perder o significado.
  • Etapa de Ajuste Fino Supervisionado (O Estágio): O modelo foi ensinado a seguir instruções, usar ferramentas (como mecanismos de busca ou terminais de código) e manter-se seguro. Eles deram a ele exemplos de como resolver problemas passo a passo.
  • Etapa 3: Aprendizado por Reforço e Destilação (A Masterclass): Este é o ingrediente secreto.
    • Primeiro, o modelo praticou em muitas diferentes "simulações" (como um videogame para programação, matemática e trabalho de escritório) para aprender por tentativa e erro.
    • Depois, eles treinaram mais de 10 "Modelos Professores" especializados (um para programação, um para matemática, um para trabalho de escritório, etc.).
    • Finalmente, eles usaram uma técnica chamada MOPD (Multi-teacher On-Policy Distillation). Imagine o modelo principal (o aluno) tentando resolver um problema, e os professores especializados sussurrando conselhos sobre exatamente como fazê-lo. O aluno aprende imitando os melhores movimentos dos professores, combinando toda a sabedoria deles em um supermodelo.

4. Os Superpoderes

O artigo destaca três principais superpoderes que o Nemotron 3 Ultra possui:

  • A Memória de 1 Milhão de Palavras: A maioria dos modelos de IA fica confusa se você der a eles um livro mais longo que alguns capítulos. O Nemotron pode ler um contexto de 1 milhão de tokens (aproximadamente o tamanho de 10 romances completos) e lembrar de detalhes da primeiríssima página enquanto escreve a última página.
  • O Controle do "Orçamento de Raciocínio": Você pode dizer ao modelo: "Resolva isso rapidamente, mas talvez pule alguns passos" ou "Leve seu tempo e pense profundamente". Isso permite que os usuários escolham entre velocidade e precisão dependendo da tarefa.
  • Velocidade: Devido ao seu motor híbrido e sistema de especialistas, ele pode processar informações até 6 vezes mais rápido do que outros modelos públicos de alto nível, obtendo as mesmas (ou melhores) respostas.

5. A Estabilidade do "Cérebro"

O artigo admite que treinar um modelo deste tamanho é como caminhar em uma corda bamba. Eles encontraram "divergência" (onde o modelo começa a fazer palpites aleatórios e ruins) duas vezes durante o treinamento.

  • Correção 1: Eles perceberam que uma parte específica da matemática (acumulação de gradiente) estava perdendo precisão, então voltaram para um modo de maior precisão para essa parte.
  • Correção 2: Eles notaram que os "especialistas" na equipe estavam ficando desequilibrados (alguns estavam fazendo todo o trabalho, outros estavam dormindo). Eles ajustaram o sistema para garantir que a carga de trabalho fosse compartilhada de forma justa, evitando que o modelo travasse.

6. O Resultado: Aberto para Todos

A parte mais emocionante do artigo é que a NVIDIA está tornando tudo open-source (código aberto).

  • Eles estão lançando o Modelo Base (o cérebro bruto).
  • O Modelo Pós-treinado (o agente especialista).
  • Uma Versão Quantizada (uma versão comprimida que roda ainda mais rápido em chips NVIDIA específicos).
  • Os Dados e Receitas (a lista exata de livros que leram e as instruções que seguiram).

Em Resumo: O Nemotron 3 Ultra é uma IA de motor híbrido massivo, projetada para ser um trabalhador autônomo de longa duração. Ele usa uma equipe de especialistas especializados para pensar profundamente, mas se mover rapidamente, consegue lembrar de uma biblioteca inteira de texto e está sendo lançado ao público para que qualquer pessoa possa construir seus próprios agentes de IA com ele.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →