← Últimos artigos
💻 computer science

Leveraging Dissimilarity Invariance as a Robust Anchor for Learning with Noisy Labels

Este artigo apresenta o NegScale, um novo framework que aproveita o fenômeno estável da Invariância de Dissimilaridade para aprender de forma robusta a partir de rótulos ruidosos, deslocando o foco de similaridades frágeis para dissimilaridades confiáveis por meio de uma Penalidade de Ortogonalidade Negativa Estruturada e um Ajuste de Similaridade Calibrado por Dissimilaridade.

Autores originais: Wenxiao Fan, Kan Li

Publicado 2026-07-21
📖 4 min de leitura☕ Leitura rápida

Autores originais: Wenxiao Fan, Kan Li

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você está ensinando um robô a reconhecer animais mostrando a ele milhares de fotos. No mundo da ciência da computação, isso é chamado de "reconhecimento visual", e é assim que seu telefone desbloqueia com seu rosto ou como os aplicativos marcam seus amigos em fotos. Mas aqui está o detalhe: e se o professor que está dando os cartões de memória ao robô for um pouco distraído? Às vezes, ele pode acidentalmente colar uma etiqueta dizendo "cachorro" em uma foto de um gato. Isso é chamado de "rótulos ruidosos" (noisy labels). Quando um robô tenta aprender com essas instruções misturadas, ele fica confuso. Ele começa a pensar que gatos e cachorros são, na verdade, a mesma coisa porque o professor continuou dizendo que eles eram. Este artigo aborda exatamente esse problema: como ensinamos um robô a aprender a verdade quando o professor está cometendo erros? A ideia central que o artigo desenvolve é que os robôs aprendem descobrindo quais coisas são semelhantes (como dois cachorros diferentes) e quais são diferentes (como um cachorro e um sapo). Geralmente, quando o professor erra os rótulos, o robô fica muito ruim em distinguir coisas semelhantes.

Mas os autores deste artigo, Wenxiao Fan e Kan Li, notaram algo estranho e maravilhoso acontecendo enquanto observavam o robô aprender. Eles descobriram que, embora o robô ficasse confuso sobre o que as coisas pareciam ser, ele permanecia surpreendentemente bom em saber o que as coisas não pareciam ser. Mesmo quando o professor gritava "Isto é um cachorro!" enquanto apontava para um sapo, o robô ainda sabia, lá no fundo, que um cachorro e um sapo eram totalmente diferentes. A capacidade do robô de identificar as coisas "não semelhantes" não quebrou, mesmo quando as coisas "semelhantes" ficaram todas bagunçadas. Os autores chamam isso de "Invariância de Dissimilaridade". É como ter um superpoder onde você não consegue lembrar quem são seus amigos porque todos têm nomes confusos, mas você ainda consegue identificar instantaneamente que um gato não é uma torradeira.

Usando essa descoberta, a equipe construiu uma nova ferramenta chamada NegScale. Pense no NegScale como um treinador inteligente para o robô. Em vez de tentar consertar os rótulos confusos do professor diretamente, o treinador diz ao robô: "Ei, ignore os rótulos confusos de 'igual' por um segundo. Apenas foque no fato de que um cavalo e um carro definitivamente não são o mesmo". O treinador usa dois truques principais. Primeiro, ele força o robô a manter coisas "não relacionadas" em caixas mentais completamente diferentes (como colocar um sapato e uma banana em quartos separados e distantes). Segundo, ele atua como um teste de realidade: se o robô começar a pensar que duas coisas são muito parecidas devido a um rótulo ruim, o treinador diz: "Espere, essas duas coisas estão longe demais no mundo do 'não semelhante' para serem amigas. Recue!".

O artigo mostra que essa abordagem funciona muito bem. Quando testaram o NegScale em conjuntos de dados de imagens padrão como o CIFAR-10 e o CIFAR-100, onde os rótulos foram propositalmente bagunçados (às vezes até 80% dos rótulos estavam errados!), o robô aprendeu muito melhor do que antes. Na verdade, ele superou quase todos os outros métodos que os cientistas já haviam tentado. Por exemplo, em um conjunto de dados com 80% de ruído, o método deles obteve cerca de 95,6% de precisão, enquanto outros métodos de ponta tiveram dificuldade para passar de 94%. Eles também testaram em dados reais e desorganizados, como fotos da internet onde os rótulos costumam estar errados, e o método continuou sendo o melhor.

Os autores não apenas supuseram que isso funcionaria; eles fizeram a matemática para provar o porquê. Eles mostraram que, quando um robô aprende, a "distância" entre coisas que são verdadeiramente diferentes permanece constante, mesmo quando os rótulos estão errados. Mas a "proximidade" entre coisas que deveriam ser as mesmas torna-se instável e não confiável. Ao ancorar o processo de aprendizagem nas relações estáveis de "não semelhança", o NegScale impede que o robô seja enganado pelos rótulos ruidosos. É um pouco como navegar em um mar tempestuoso: quando o mapa (os rótulos) está rasgado e confuso, você não tenta adivinhar onde as ilhas estão; em vez disso, você apenas garante que fique longe das rochas que sabe que certamente estão lá. Essa simples mudança de foco — de tentar encontrar a correspondência perfeita para evitar os desajustes impossíveis — revela-se uma maneira muito mais forte de aprender quando o mundo é bagunçado.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →