← Últimos artigos
🤖 machine learning

Green Prompting: Characterizing Prompt-driven Energy Costs of LLM Inference

Este estudo empírico demonstra que o significado semântico das prompts e palavras-chave específicas, mais do que seu comprimento, impactam significativamente o custo energético da inferência de Grandes Modelos de Linguagem, destacando a importância do design de prompts para otimizar a eficiência.

Autores originais: Marta Adamska, Daria Smirnova, Hamid Nasiri, Zhengxin Yu, Peter Garraghan

Publicado 2026-04-03
📖 4 min de leitura☕ Leitura rápida

Autores originais: Marta Adamska, Daria Smirnova, Hamid Nasiri, Zhengxin Yu, Peter Garraghan

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você tem três cozinheiros de elite (os modelos de Inteligência Artificial: Mistral, Gemma e Vicuna). Todos eles usam a mesma receita básica (a arquitetura "Transformer"), mas cada um tem seu próprio estilo, tempero e velocidade.

O objetivo deste estudo foi descobrir: o que faz a cozinha gastar mais energia elétrica enquanto eles cozinham?

Aqui está a explicação do que os pesquisadores descobriram, usando analogias do dia a dia:

1. O Grande Engano: O Tamanho do Pedido vs. O Tamanho da Prática

Muitas pessoas acham que, se você der um pedido muito longo e detalhado para o cozinheiro (o prompt), ele vai gastar muita energia apenas para ler o que você escreveu.

A descoberta: Isso é um mito! O tamanho do pedido (o que você escreve) quase não importa.
A analogia: É como entrar em um restaurante. O fato de você ter lido um cardápio gigante antes de chegar à mesa não gasta energia na cozinha. O que gasta energia é quanto tempo o cozinheiro fica cozinhando e quanto prato ele serve.

O estudo mostrou que o tamanho da resposta (o prato final) é o que realmente define o custo de energia. Se o cozinheiro decide servir um banquete de 10 pratos em vez de um sanduíche, a conta de luz explode.

2. O Significado do Pedido é o "Comando Mestre"

O que realmente manda na cozinha não é o tamanho do papel do pedido, mas o que está escrito nele (o significado semântico).

A analogia:

  • Se você pedir: "Resuma este texto em uma palavra" (como "positivo"), o cozinheiro faz um trabalho rápido e gasta pouca energia.
  • Se você pedir: "Escreva uma história detalhada sobre a vida deste personagem" (como "gerar texto"), o cozinheiro precisa pensar, criar e escrever muito, gastando muita energia.

O estudo descobriu que a intenção do pedido é o que define se a resposta será curta ou longa.

3. As Palavras Mágicas (e as Palavras "Caras")

Os pesquisadores olharam para palavras específicas usadas nos pedidos e viram que algumas são "gastadoras" e outras são "econômicas".

  • Palavras "Caras" (Gastam muita energia): Verbos como "explique", "justifique" ou "analise".
    • Por que? Quando você pede para "explicar", o cozinheiro entende que precisa escrever um livro inteiro. Ele não pode parar até ter dado todos os detalhes.
  • Palavras "Econômicas" (Gastam pouca energia): Verbos como "classifique", "identifique" ou "resuma".
    • Por que? Quando você pede para "classificar", o cozinheiro sabe que a resposta deve ser curta (ex: apenas "Sim" ou "Não").

O resultado impressionante: Mudar apenas uma palavra no pedido pode reduzir o consumo de energia em até 60%. É como trocar um pedido de "prato completo com sobremesa" por um "café expresso".

4. Cada Cozinheiro é um Mundo à Parte

Mesmo usando a mesma receita base, os três modelos se comportaram de formas diferentes:

  • O Gemma: É o mais "tagarela". Ele gasta menos energia por cada palavra que escreve, mas como ele escreve muitas palavras, no final da conta, ele é o que mais gasta energia no total.
  • O Mistral e o Vicuna: São um pouco mais "econômicos" por palavra, mas o Vicuna tem um hábito estranho: ele adora usar emoticons (carinhas felizes).
    • Curiosidade: O Vicuna usou emoticons em 40% das respostas. Como cada emoticon conta como várias "palavras" para a máquina, isso faz ele gastar mais energia e, às vezes, até travar tentando desenhar carinhas infinitas!

5. A Lição para o Futuro

O estudo conclui que, para usar Inteligência Artificial de forma sustentável (sem desperdiçar energia e dinheiro), não basta apenas escolher o modelo certo. O segredo está em como você pede.

Se você quer economizar:

  1. Seja específico no pedido.
  2. Evite palavras que forcem respostas longas (como "explique tudo").
  3. Use palavras que peçam respostas curtas e diretas (como "liste" ou "classifique").

Resumo da Ópera:
Não culpe o tamanho do seu pedido pela conta de luz. Culpe o que você pediu para ser feito. Um pedido mal formulado que gera uma resposta gigante é como pedir um banquete quando você só queria um lanche: custa caro e desperdiça recursos. Com um pouco de "engenharia de prompt" (saber pedir direito), podemos fazer a IA ser mais verde e eficiente.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →