← Últimos artigos
💬 NLP

Llettuce: An Open Source Natural Language Processing Tool for the Translation of Medical Terms into Uniform Clinical Encoding

Este artigo apresenta o Llettuce, uma ferramenta de código aberto que utiliza processamento de linguagem natural e modelos de linguagem avançados para automatizar a conversão de termos médicos em conceitos padrão OMOP, garantindo conformidade com o GDPR e proteção de dados ao ser implantada localmente.

Autores originais: James Mitchell-White, Reza Omdivar, Benjamin Partridge, Esmond Urwin, Karthikeyan Sivakumar, Ruizhe Li, Andy Rae, Xiaoyan Wang, Theresia Mina, Tom Giles, Diego Garcia-Gil, Tim Beck, John Chambers, Gra
Publicado 2026-03-13
📖 4 min de leitura☕ Leitura rápida

Autores originais: James Mitchell-White, Reza Omdivar, Benjamin Partridge, Esmond Urwin, Karthikeyan Sivakumar, Ruizhe Li, Andy Rae, Xiaoyan Wang, Theresia Mina, Tom Giles, Diego Garcia-Gil, Tim Beck, John Chambers, Grazziela Figueredo, Philip R Quinlan

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você tem um grande armário de remédios, mas cada pessoa que entra na sala de emergência escreve o nome do remédio de um jeito diferente. Um escreve "Dor de cabeça forte", outro "Tylenol", e um terceiro "Paracetamol 500mg". O sistema de saúde precisa organizar tudo isso em uma lista padronizada para que os médicos do mundo todo entendam o que está sendo tratado.

O problema é que os sistemas atuais são como bibliotecários cansados que só procuram por palavras que batem exatamente igual. Se você pedir "Paracetamol", eles acham. Mas se você pedir "Tylenol" (que é a mesma coisa, mas com nome diferente), eles podem ficar confusos e sugerir remédios errados, ou exigir que um humano leia cada um dos milhares de pedidos para corrigir manualmente. Isso é lento, caro e propenso a erros.

É aqui que entra o Lettuce (que significa "Alface" em inglês, uma brincadeira com o nome do projeto, mas pense nele como um "salada de ideias" inteligente).

O que é o Lettuce?

O Lettuce é uma ferramenta de inteligência artificial de código aberto (gratuita e transparente) criada por pesquisadores da Universidade de Nottingham. Ele funciona como um tradutor superinteligente que entende não apenas as palavras, mas o significado por trás delas.

Aqui está como ele funciona, usando analogias simples:

1. O Tradutor de Significados (Busca Semântica)

Imagine que você está procurando um livro na biblioteca.

  • Os sistemas antigos (como o Usagi) funcionam como alguém que só lê o título. Se você pedir "O Senhor dos Anéis", eles acham. Se você pedir "A história do anel mágico", eles podem não achar, porque as palavras não batem.
  • O Lettuce funciona como um bibliotecário que leu todos os livros. Se você pedir "A história do anel mágico", ele sabe que você quer "O Senhor dos Anéis", mesmo que as palavras sejam diferentes. Ele usa uma tecnologia chamada Embeddings (vetores) que transforma palavras em "mapas de significado". No mapa dele, "Paracetamol" e "Tylenol" estão sentados na mesma mesa, muito perto um do outro.

2. O Assistente com Memória (RAG e LLMs)

Às vezes, o significado não é óbvio. Imagine que alguém escreveu "Remédio do coração da marca X".

  • O Lettuce usa um Grande Modelo de Linguagem (LLM), que é como um especialista médico muito bem lido.
  • Mas, para não alucinar (inventar coisas), o Lettuce usa uma técnica chamada RAG (Geração Aumentada por Recuperação). Pense nisso como dar ao especialista uma "cola" antes da prova. O sistema primeiro busca os remédios mais parecidos no banco de dados e entrega essa lista para o especialista. O especialista então olha a lista, pensa: "Ah, 'Remédio do coração da marca X' é provavelmente o 'Losartana'", e confirma a resposta.

3. O Guardião da Privacidade (Segurança e GDPR)

Muitas ferramentas de IA (como o ChatGPT público) enviam seus dados para a nuvem de grandes empresas. Em medicina, isso é perigoso: você não quer que dados de pacientes vazem.

  • O Lettuce foi feito para rodar localmente (no seu próprio computador ou servidor do hospital). É como ter um tradutor particular que trabalha dentro da sua casa, sem nunca sair de lá. Isso garante que os dados dos pacientes fiquem 100% seguros e em conformidade com as leis de proteção de dados (GDPR).

O que os testes mostraram?

Os pesquisadores testaram o Lettuce com dois grupos de dados:

  1. Dados formais: Onde os nomes já eram quase corretos. O Lettuce funcionou bem, mas os sistemas antigos também conseguiam.
  2. Dados "da vida real" (informais): Onde as pessoas escreviam nomes estranhos, com erros de digitação, marcas comerciais ou descrições confusas (como no estudo HELIOS em Singapura).
    • Aqui, o Lettuce brilhou. Enquanto os sistemas antigos acertavam apenas cerca de 10% das vezes nos top 10 resultados, o Lettuce acertou mais de 40% a 80% das vezes, dependendo da configuração.
    • Basicamente, o Lettuce reduziu o trabalho manual dos humanos pela metade ou mais, encontrando o remédio correto onde os outros sistemas falhavam.

Resumo Final

O Lettuce é como um detetive de remédios que:

  • Entende a linguagem humana (gírias, marcas, erros de digitação).
  • Usa inteligência artificial para conectar o que o paciente disse com o nome técnico correto.
  • Trabalha dentro do hospital, garantindo que os segredos dos pacientes não saiam da sala.
  • É gratuito e pode ser adaptado por qualquer pessoa.

O objetivo final é tornar os dados de saúde mais organizados, seguros e úteis para que os médicos e cientistas possam descobrir novas curas mais rápido, sem se perderem em uma montanha de papéis e nomes confusos.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →