The Format Tax
O artigo "The Format Tax" demonstra que as instruções de formatação em prompts degradam significativamente o raciocínio e a escrita em modelos de linguagem abertos, mas essa perda de precisão pode ser majoritariamente recuperada ao separar a geração do conteúdo do raciocínio da etapa de formatação estruturada.
Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo
Imagine que você pediu a um assistente muito inteligente (uma Inteligência Artificial) para resolver um problema de matemática difícil ou escrever um texto criativo. Você quer a resposta, certo?
Agora, imagine que, antes de ele começar a pensar, você diz: "Ei, não me dê apenas a resposta. Você tem que escrever tudo dentro de uma caixa de JSON, com chaves e vírgulas específicas, ou senão eu não aceito."
O que os autores deste estudo descobriram é que essa exigência de "caixa" faz o assistente ficar burro.
Aqui está a explicação simples, usando analogias do dia a dia:
1. O "Imposto de Formato" (The Format Tax)
O papel chama isso de "Imposto de Formato". Pense assim:
Imagine que você está pedindo a um cozinheiro de elite para fazer um prato incrível.
- Cenário A: Você diz: "Faça um bolo delicioso." O cozinheiro foca no sabor, na textura e nos ingredientes. O bolo fica perfeito.
- Cenário B: Você diz: "Faça um bolo delicioso, mas você tem que colocá-lo em uma caixa de papelão quadrada, com um laço vermelho, e garantir que a caixa não fique torta enquanto você cozinha."
No Cenário B, o cozinheiro começa a se preocupar tanto com a caixa e o laço que esquece de misturar bem a massa. O bolo fica ruim.
O estudo mostrou que, quando pedimos para as IAs (especialmente as versões gratuitas ou "abertas") formatarem a resposta em códigos como JSON, XML ou LaTeX, elas cometem mais erros de raciocínio e escrevem pior. Elas pagam um "imposto" de inteligência apenas para obedecer à regra de formatação.
2. Onde está o problema? (A Culpa não é da "Máquina de Empacotar")
Por muito tempo, os pesquisadores achavam que o problema era a "máquina de empacotar" (o código que força a IA a seguir as regras da caixa). Eles pensavam: "Ah, é que a IA está tentando encaixar a resposta na caixa e, por isso, ela erra."
Mas o estudo descobriu algo surpreendente: O problema acontece antes mesmo de começar a empacotar.
O problema é o pedido em si.
Quando você diz à IA: "Pense e escreva tudo dentro de uma caixa JSON", você está sobrecarregando o cérebro dela. Ela tenta pensar e formatar ao mesmo tempo. É como tentar resolver um quebra-cabeça complexo enquanto alguém te empurra e te pede para manter o equilíbrio em um skate.
Mesmo que você use a melhor "máquina de empacotar" do mundo, se o pedido inicial for confuso, a IA já começa a errar.
3. A Solução: "Pense Primeiro, Empacote Depois"
Como consertar isso? O estudo propõe uma solução simples, como separar o "pensar" do "escrever".
Existem duas formas de fazer isso:
O Método de Duas Etapas (2-Turn):
- Você pede à IA: "Resolva esse problema de matemática. Me explique como fez, sem se preocupar com o formato." (A IA pensa livremente).
- Depois, você pega essa resposta e pede: "Agora, pegue o que você escreveu e coloque dentro da caixa JSON."
- Resultado: A IA resolveu o problema com clareza e só depois organizou a caixa. A precisão volta ao normal!
O Método do "Rascunho Mental" (Thinking):
Algumas IAs modernas têm uma função onde elas "pensam em voz alta" antes de falar. O estudo mostrou que, quando a IA pode gastar tempo pensando em um "rascunho invisível" antes de gerar a resposta formatada, ela também acerta muito mais. É como se ela pudesse fazer o trabalho sujo na cozinha antes de servir o prato na mesa.
4. Por que algumas IAs não sofrem desse imposto?
O estudo comparou IAs de código aberto (gratuitas) com IAs de empresas gigantes (como o GPT-5 ou Claude).
- As IAs gratuitas sofrem muito com esse imposto. Elas perdem inteligência quando pedem formatos rígidos.
- As IAs mais novas e caras quase não sofrem. Elas já aprenderam a "pensar e formatar" ao mesmo tempo sem se distrair.
Isso sugere que o problema não é que "formatar é impossível", mas sim que as IAs gratuitas ainda precisam treinar mais para não se distraírem com as regras da caixa.
Resumo da Ópera
Pedir para uma IA formatar a resposta (em JSON, XML, etc.) faz com que ela cometa mais erros de raciocínio, como se ela tivesse perdido um pouco de inteligência.
- O erro: O pedido confuso de "pensar e formatar ao mesmo tempo".
- A cura: Separar as tarefas. Deixe a IA pensar livremente primeiro e só depois peça para ela formatar a resposta.
- A lição: Se você quer a melhor resposta de uma IA, não a force a vestir um terno apertado enquanto ela tenta correr uma maratona. Deixe-a correr primeiro, e depois a vista o terno.
Afogado em artigos na sua área?
Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.