← Últimos artigos
🤖 AI

LLM-Based Scientific Equation Discovery via Physics-Informed Token-Regularized Policy Optimization

Este artigo apresenta o PiT-PO, um framework de aprendizado por reforço que transforma Grandes Modelos de Linguagem em geradores adaptativos para regressão simbólica ao impor validade física hierárquica e parcimônia estrutural ao nível de token, alcançando assim o estado da arte em descoberta de equações e permitindo que modelos de pequena escala superem gigantes de código fechado.

Autores originais: Boxiao Wang, Kai Li, Tianyi Liu, Chen Li, Junzhe Wang, Yifan Zhang, Jian Cheng

Publicado 2026-08-12
📖 4 min de leitura☕ Leitura rápida

Autores originais: Boxiao Wang, Kai Li, Tianyi Liu, Chen Li, Junzhe Wang, Yifan Zhang, Jian Cheng

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você é um detetive tentando resolver um mistério, mas em vez de procurar impressões digitais ou pegadas, você está caçando a receita matemática secreta que governa como o mundo funciona. Esse campo é chamado de Regressão Simbólica. Enquanto a maioria dos programas de computador atuais são como caixas pretas que adivinham uma resposta sem explicar o porquê, a Regressão Simbólica tenta encontrar a equação real — a "lei da natureza" — escondida dentro de um monte de dados. Pense nisso como ouvir uma música e tentar escrever a partitura do zero, em vez de apenas cantarolar junto.

Por muito tempo, os cientistas usaram métodos de estilo antigo para encontrar essas receitas, mas eles eram lentos e frequentemente se perdiam na vasta selva de possíveis fórmulas matemáticas. Recentemente, um novo tipo de "supercérebro" chamado Modelo de Linguagem de Grande Escala (LLM) entrou no jogo. Estes são os mesmos tipos de IA que podem escrever histórias ou conversar com você, mas eles também leram milhões de livros didáticos de ciências. Por causa disso, eles são incrivelmente bons em adivinhar como uma equação científica poderia parecer. No entanto, há uma pegadinha: esses modelos de IA são geralmente como um aluno que memorizou o livro didático, mas nunca fez uma prova. Eles podem cuspir uma fórmula que parece correta e se ajusta perfeitamente aos números, mas que pode violar as leis da física ou ser desnecessariamente complicada, como uma receita que pede uma xícara de sal só porque o chef sentiu vontade.

É aqui que um novo estudo entra em cena. Os pesquisadores, liderados por Boxiao Wang e Kai Li, queriam consertar esse problema do "memorizador". Eles criaram um sistema chamado PiT-PO (Otimização de Política Regularizada por Tokens Informada pela Física). Em vez de apenas pedir um palpite à IA e esperar pelo melhor, o PiT-PO transforma a IA em um aluno que realmente aprende com seus erros em tempo real. É como ter um professor de física rigoroso, porém brilhante, parado logo ao lado da IA, sussurrando: "Não, esse termo não faz sentido fisicamente", ou "Você está usando ingredientes demais; simplifique isso!".

A equipe construiu um ciclo de feedback inteligente. Quando a IA gera uma equação candidata, o PiT-PO a verifica contra duas regras estritas. Primeiro, ele verifica a Validade Física: Esta equação obedece às leis da física? Por exemplo, se a equação prevê que um fluido flui montanha acima sem qualquer energia, o sistema aplica uma penalidade a ela. Segundo, ele verifica a Redundância: A equação está inchada com partes desnecessárias? Os pesquisadores usaram um truque matemático chamado "Teorema de Exclusão de Suporte" para detectar termos que são apenas ruído e punir a IA por incluí-los.

Os resultados são impressionantes. Em seus testes, o PiT-PO não apenas encontrou equações que se ajustavam aos dados; ele encontrou as leis subjacentes corretas, mesmo quando os dados estavam bagunçados. Em um teste específico envolvendo o fluxo caótico de ar sobre colinas (um problema conhecido como "Fluxo sobre Colinas Periódicas"), a IA descobriu uma nova maneira de modelar a turbulência que era muito mais próxima da realidade do que os métodos tradicionais. Talvez o mais emocionante seja que este sistema funcionou tão bem que até mesmo um modelo de IA de código aberto pequeno (um que pode rodar em um computador padrão) foi capaz de superar gigantes "de código fechado" massivos e caros.

Ao ensinar a IA a aprender com seu próprio processo de busca e ao aplicar estritamente as regras da física, o PiT-PO transforma uma máquina de adivinhação estática em um descobridor científico adaptável. Isso sugere que não precisamos esperar por supercomputadores para desbloquear os segredos do universo; com o treinamento certo, ferramentas de IA menores e mais acessíveis podem nos ajudar a descobrir as equações fundamentais que impulsionam tudo, desde a dinâmica de fluidos até o crescimento biológico.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →