← Últimos artigos
🤖 machine learning

Position: Zeroth-Order Optimization in Deep Learning Is Underexplored, Not Underpowered

Este artigo argumenta que a otimização de ordem zero em aprendizado profundo não é inerentemente não escalável, mas sim pouco explorada devido a práticas de design míopes, defendendo uma mudança de paradigma em direção a métodos de subespaço, vantagens conscientes do sistema e avaliações desofuscadas para desbloquear seu potencial para aprendizado em grande escala e eficiente em recursos.

Autores originais: Sijia Liu, Yicheng Lang, Soumyadeep Pal, Changsheng Wang, Yancheng Huang, Chongyu Fan, James Diffenderfer, Bhavya Kailkhura, Yihua Zhang

Publicado 2026-05-18
📖 6 min de leitura🧠 Leitura aprofundada

Autores originais: Sijia Liu, Yicheng Lang, Soumyadeep Pal, Changsheng Wang, Yancheng Huang, Chongyu Fan, James Diffenderfer, Bhavya Kailkhura, Yihua Zhang

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

A Grande Ideia: Não Está Quebrado, Apenas Ainda Não Aprendemos a Usá-lo

Imagine que você está tentando encontrar o ponto mais baixo em um vale gigante e completamente escuro (isso representa treinar um modelo de IA complexo).

  • O Jeito Antigo (Otimização de Primeira Ordem): Você tem uma lanterna mágica que não apenas ilumina o chão, mas também lhe diz exatamente para onde é "para baixo" (o gradiente). É assim que a maioria das IAs é treinada hoje. É rápido, mas a lanterna exige uma bateria massiva (memória de computador enorme) e quebra facilmente se você tentar usá-la em terrenos estranhos e não padronizados (como simuladores ou sistemas de caixa preta).
  • O Jeito "Ordem Zero" (ZO): Você não tem uma lanterna. Você só tem um bastão. Para descobrir para onde é para baixo, você espetar o chão em direções diferentes com o bastão. Se o chão parecer mais baixo, você dá um passo nessa direção. Isso é otimização de Ordem Zero (ZO). Ela usa muito pouca memória e funciona em qualquer terreno, mesmo que você não consiga ver o chão.

O Problema: Por muito tempo, as pessoas achavam que o "método do bastão" era lento demais e desajeitado para grandes montanhas. Elas acreditavam que levaria uma eternidade para espetar o chão o suficiente vezes para encontrar o fundo.

A Alegação do Artigo: Os autores dizem: "Pare! Vocês estão julgando o método do bastão de forma injusta." Eles argumentam que a ZO não é fraca; ela apenas está pouco explorada. Temos usado o bastão da maneira errada (espetando cada centímetro do chão, um por um). Se mudarmos como espetamos, podemos torná-lo tão poderoso quanto a lanterna, mas sem a bateria pesada.


Os Seis Pontos Chave (O Guia "Como Fazer")

Os autores propõem seis novas maneiras de pensar sobre o uso do "bastão" para fazê-lo funcionar melhor.

1. Não Espete Aleatoriamente em Todo Lugar (P1 & P2)

A Analogia: Imagine que você está tentando encontrar o melhor lugar para plantar uma árvore em um campo vasto.

  • O Erro: A maioria das pessoas espetar o chão aleatoriamente em todas as direções ao mesmo tempo. Isso cria muito "ruído" (confusão) e exige espetar milhões de vezes.
  • A Correção: O artigo diz: "Seja mais inteligente sobre onde espetar." Em vez de espetar em todo lugar, espete em padrões específicos e estruturados. Além disso, perceba que espetar mais vezes reduz a confusão, mas custa mais tempo. Você precisa encontrar o equilíbrio perfeito entre "quantos espetos" e "quão claro é o sinal".

2. Use uma Bússola, Não Apenas um Bastão (P3)

A Analogia: Quando você espetar o chão, você está na verdade medindo a inclinação em uma direção específica (como a agulha de uma bússola).

  • A Insight: Os autores dizem que devemos parar de fingir que estamos apenas chutando. Devemos tratar esses "espetos" como medições da inclinação em uma direção específica. Se compararmos nosso "método do bastão" com uma "bússola perfeita" teórica (chamada de derivada direcional), podemos ver exatamente quão bom é nosso método realmente. Isso nos ajuda a parar de culpar a ferramenta quando a tarefa é, na verdade, apenas muito difícil.

3. Dê Zoom no Que é Importante (P4)

A Analogia: Imagine tentar navegar em uma cidade olhando para um mapa de todo o planeta. É avassalador.

  • A Correção: Em vez de espetar o planeta inteiro, dê zoom em um pequeno bairro (um subespaço). Os autores sugerem que os modelos de IA frequentemente têm padrões ocultos onde apenas algumas direções importam. Se espetarmos apenas nesses "bairros" específicos (subespaços de baixa dimensão), obtemos uma resposta clara com muito menos espetos. É como navegar em uma cidade olhando apenas para as ruas principais em vez de cada beco.

4. A Vantagem da "Equipe Invisível" (P5)

A Analogia: Imagine uma equipe de trabalhadores tentando mover um sofá pesado.

  • O Jeito Antigo (Lanterna): Todos precisam ver o mesmo projeto exato e conversar constantemente para se coordenar. Isso leva muito tempo e largura de banda.
  • O Jeito ZO: Como o "método do bastão" exige apenas o envio de um único número (como "é mais baixo aqui!") em vez de um projeto inteiro, os trabalhadores podem se comunicar muito mais rápido. Eles podem até usar um código secreto compartilhado (uma semente aleatória) para saber onde espetar sem conversar. Isso torna a otimização ZO incrivelmente rápida para equipes trabalhando em computadores diferentes e economiza muita energia.

5. Não Culpe a Ferramenta por uma Tarefa Muito Fácil (P6)

A Analogia: Imagine um aluno fazendo uma prova.

  • O Problema: Às vezes, o professor dá ao aluno uma cola (chamada de alinhamento de tarefa) que torna a prova super fácil. O aluno tira A, mas você não sabe se ele é inteligente ou apenas sortudo.
  • A Correção: Os autores dizem: "Parem de dar a cola!" Precisamos testar o "método do bastão" em problemas difíceis onde a cola não é permitida. Se o método ainda funcionar, então sabemos que a ferramenta é realmente poderosa. Se falhar, sabemos que a ferramenta precisa de trabalho. Isso nos impede de achar que a ferramenta é ótima apenas porque o teste foi manipulado.

O Chamado à Ação: O Que Devemos Fazer Depois?

Os autores não estão apenas reclamando; eles estão fornecendo um roteiro para o futuro:

  1. Mude as Regras do Jogo: Pare de testar esses métodos com "colas" (alinhamento de tarefa) e sem medir quantos "espetos" (consultas) são necessários. Precisamos de testes justos.
  2. Pare de Espetar o Mundo Inteiro: Afaste-se de espetar cada parâmetro individual. Comece a espetar em grupos menores e mais inteligentes (subespaços) ou use truques "espectrais" para encontrar as direções mais importantes.
  3. Construa Novas Ferramentas para o Bastão: Atualmente, estamos tentando encaixar o "método do bastão" em ferramentas construídas para a "lanterna". Precisamos construir novos sistemas de computador projetados especificamente para o método do bastão. Esses sistemas seriam mais leves, mais rápidos e funcionariam em computadores mais baratos.
  4. Olhe Além da IA: Este método não é apenas para IA. É perfeito para coisas onde você não pode usar uma lanterna de forma alguma, como:
    • Computadores Quânticos: Onde as leis da física tornam impossível o uso de "luzes" (gradientes).
    • Simuladores Científicos: Onde você está testando um modelo físico (como uma ponte ou um sistema climático) e não pode calcular matematicamente a inclinação.

A Conclusão

O artigo argumenta que a otimização de Ordem Zero é um Ferrari que temos estado dirigindo em um estacionamento. Temos usado de forma desajeitada, achando que é lento e fraco. Mas, se construirmos as estradas certas (sistemas), dirigirmos nas faixas certas (subespaços) e pararmos de usar colas (alinhamento de tarefa), revela-se ser uma maneira incrivelmente poderosa, eficiente em memória e escalável para treinar a próxima geração de IA.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →