← Últimos artigos
💬 NLP

Peek2: Regex-free Byte-level Byte-Pair Encoding Pretokenizer for LLM Inference on Edge Devices

O artigo apresenta o Peek2, um pretokenizador altamente otimizado e sem expressões regulares para BPE em nível de byte, que alcança até 2,48× mais throughput em microtestes e 1,14× mais velocidade de codificação geral em dispositivos de borda, mantendo saída idêntica à dos tokenizadores padrão baseados em cl100k.

Autores originais: Liu Zai, Iraklis Klampanos

Publicado 2026-05-04
📖 4 min de leitura☕ Leitura rápida

Autores originais: Liu Zai, Iraklis Klampanos

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você está tentando enviar uma longa carta a um amigo, mas seu amigo só entende palavras-código curtas e específicas. Antes de poder enviar a carta, você precisa decompor sua frase nessas palavras-código. Esse processo é chamado de tokenização, e é assim que computadores como GPT-3 ou LLaMa entendem a linguagem humana.

O artigo que você está lendo apresenta uma nova ferramenta chamada Peek2. Aqui está como ela funciona, explicada de forma simples:

O Problema: O Engarrafamento do "Regex"

Atualmente, a maioria dos computadores usa um método chamado Regex (Expressões Regulares) para decompor o texto nessas palavras-código. Pense no Regex como um guarda muito rigoroso e complicado na entrada de um clube.

  • O guarda tem uma lista massiva de regras (Ramificações).
  • Quando uma pessoa (uma letra) chega, o guarda a verifica contra a Regra 1. Se não se encaixar, o guarda verifica a Regra 2. Se falhar, a Regra 3, e assim por diante.
  • Esse processo de "verificar, falhar, verificar novamente" é lento, especialmente em dispositivos pequenos e de baixa potência, como laptops ou tablets (dispositivos de borda). É como se o guarda fizesse você esperar enquanto folheia um livro de regras gigante toda vez que alguém se aproxima.

A Solução: O Atalho "Peek2"

Os autores criaram o Peek2, uma nova maneira de realizar essa tarefa que é muito mais rápida e usa menos memória.

Em vez do guarda folhear um livro de regras, o Peek2 usa uma cola (uma tabela de consulta).

  1. O "Olhar" (Peek): Em vez de verificar uma letra de cada vez, o Peek2 olha para duas letras de uma vez (como espiar adiante).
  2. As Categorias: Ele classifica rapidamente essas duas letras em categorias simples (por exemplo: "É um espaço?", "É um número?", "É uma letra?").
  3. A Cola: Como ele só precisa olhar para duas categorias, os autores criaram uma pequena grade 7x7 (como um tabuleiro de Sudoku). Você apenas olha para as duas categorias, encontra o quadrado na grade, e a grade diz instantaneamente exatamente o que fazer a seguir.

A Analogia:

  • Método Antigo (Regex): Você se aproxima de um labirinto. Você tenta a porta da esquerda. Está trancada. Você tenta a porta da direita. Está trancada. Você tenta a porta dos fundos. Está aberta. Você passa. Depois, você repete isso para cada pessoa na fila.
  • Método Novo (Peek2): Você se aproxima de uma parede com um único mapa gigante. Você aponta para onde está, e o mapa desenha instantaneamente uma linha até a saída. Sem palpites, sem portas trancadas, apenas um caminho direto.

Por Que Isso Importa?

O artigo afirma que, ao trocar o "labirinto" pelo "mapa", eles tornaram o processo muito mais rápido:

  • Velocidade: Em alguns testes, foi 2,48 vezes mais rápido apenas na etapa de decomposição.
  • Geralmente: Quando se considera todo o trabalho de transformar texto em palavras-código, foi cerca de 14% mais rápido no geral.
  • Precisão: Ele produz os exatamente mesmos resultados que o método antigo. É uma "substituição direta", o que significa que você pode trocar o guarda antigo pelo novo sem mudar nada mais ou quebrar o sistema.

A Pegadinha (Limitações)

O artigo é honesto sobre o que essa ferramenta não faz:

  • É para dispositivos específicos: Foi testado em computadores desktop. Os autores esperam que funcione em celulares e tablets também, mas ainda não provaram isso.
  • É para modelos específicos: Funciona para modelos que usam o estilo "cl100k" (como GPT-3 e LLaMa-3). Não corrige magicamente todos os modelos de IA existentes.
  • Mantém os bugs: O método antigo tinha alguns erros estranhos (como dividir uma palavra incorretamente). Como o Peek2 foi projetado para ser uma cópia exata do comportamento do método antigo, ele mantém esses mesmos erros. Corrigir esses erros exigiria retreinar os modelos de IA, o que é um trabalho muito maior do que apenas trocar a ferramenta.

Em resumo: O Peek2 é uma maneira mais inteligente e rápida de dividir texto para IA, projetada especificamente para funcionar suavemente em dispositivos do dia a dia sem precisar de um supercomputador.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →