← Últimos artigos
💻 computer science

Deep Transfer Learning for Automated Cervical Cell-Type Classification in Pap-Smear Images: A Comparative and Explainable Study

Este estudo demonstra que um modelo de aprendizagem por transferência profunda baseado em ResNet50, aprimorado com técnicas de IA explicável como Grad-CAM, alcança alta acurácia (91,50%) na classificação de cinco tipos distintos de células cervicais a partir de imagens de citologia de Papanicolaou, embora enfrente desafios específicos na distinção entre as classes Koilocytótica e Metaplásica.

Autores originais: Prashansa D. Choksi, Vipul B. Bambhaniya, Chetan Shingadiya

Publicado 2026-09-21
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Prashansa D. Choksi, Vipul B. Bambhaniya, Chetan Shingadiya

Artigo original sob licença CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ✨ Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Todos os anos, milhões de mulheres submetem-se a um exame de rastreio simples e rotineiro para detetar sinais precoces de cancro do colo do útero. Neste procedimento, conhecido como citologia ou Papanicolau, um médico recolhe uma amostra de células do colo do útero e envia-as para um laboratório. Lá, um patologista observa as células ao microscópio, procurando mudanças subtis na sua forma, tamanho e textura que possam indicar doença. Embora este método tenha salvo inúmeras vidas, depende inteiramente dos olhos e do julgamento humano. Quando um laboratório recebe milhares de amostras, o volume colossal pode levar à fadiga, e as diferenças minúsculas entre uma célula saudável e uma ligeiramente anormal podem ser fáceis de perder. Para ajudar, cientistas passaram anos a tentar ensinar computadores a ler estas imagens, esperando criar um assistente fiável que possa detetar os sinais de alerta com o mesmo cuidado que um especialista humano.

O desafio reside na complexidade das próprias células. As células cervicais não são uniformes; existem diferentes tipos e alguns destes tipos são notavelmente semelhantes entre si. Distingui-los requer a observação de detalhes minuciosos no núcleo e no citoplasma circundante. Um programa de computador que simplesmente conte píxeis ou procure formas básicas muitas vezes falha porque não consegue compreender estes padrões biológicos matizados. É aqui que uma técnica chamada aprendizagem por transferência (transfer learning) entra em jogo. Em vez de ensinar um computador a ver do zero, os investigadores pegam num modelo que já aprendeu a reconhecer milhares de objetos comuns — como gatos, carros e árvores — e adaptam-no para observar imagens médicas. A ideia é que o computador já aprendeu a detetar arestas, texturas e formas, e pode aplicar esse conhecimento à nova e mais difícil tarefa de identificar tipos de células.

Num estudo recente, investigadores procuraram testar quão bem este método funciona para um problema específico e difícil: classificar células cervicais em cinco categorias distintas. Estas categorias incluem células que estão a morrer prematuramente, células infetadas por um vírus, células que estão a sofrer alterações estruturais e dois tipos de células saudáveis que são frequentemente confundidas entre si. A equipa reuniu uma coleção de mais de cinco mil imagens de alta qualidade destas células. Para garantir que os seus resultados fossem justos e fiáveis, dividiram esta coleção em três grupos: um grupo grande para ensinar o computador, um grupo médio para verificar o seu progresso durante o treino e um grupo final, nunca antes visto, para testar o seu conhecimento no final. Em seguida, treinaram três tipos diferentes de modelos de computador, cada um baseado numa arquitetura famosa que tinha sido utilizada anteriormente para identificar objetos na natureza. Estes modelos foram ajustados cuidadosamente, utilizando técnicas para garantir que prestassem atenção aos tipos de células menos comuns tanto quanto aos mais comuns.

Os resultados mostraram que os modelos de computador conseguem, de facto, distinguir entre estes cinco tipos de células com um elevado grau de precisão. Um dos modelos, conhecido como ResNet50, teve o melhor desempenho. Quando testado no grupo final de imagens que nunca tinha visto antes, identificou corretamente o tipo de célula em mais de noventa e um por cento dos casos. Isto significa que, de cada cem imagens, o computador acertou a resposta em noventa e uma delas. O modelo foi particularmente bom em distinguir os dois tipos de células saudáveis, que são frequentemente os mais difíceis de separar. No entanto, teve um pouco mais de dificuldade com as células que tinham sido infetadas por um vírus ou que estavam a sofrer alterações estruturais. Estes tipos específicos de células são naturalmente mais variáveis na sua aparência, tornando-os mais difíceis de categorizar perfeitamente por qualquer sistema.

Para compreender como o computador estava a tomar as suas decisões, os investigadores utilizaram uma ferramenta que destaca as partes específicas de uma imagem nas quais o modelo se focou. Quando observaram estas áreas destacadas, descobriram que o computador estava, de facto, a observar a própria célula, e não o fundo ou ruído aleatório. Este é um passo crucial, pois prova que o modelo está a aprender as coisas certas. Contudo, o estudo também revelou que, mesmo quando o computador estava muito confiante na sua resposta, nem sempre estava correto. Em alguns casos, identificou erroneamente, com confiança, uma célula infetada por um vírus como sendo uma célula em morte, ou vice-versa. Isto sugere que, embora a tecnologia seja poderosa, ainda não é suficientemente perfeita para substituir um médico humano. Os investigadores enfatizam que estas descobertas representam um passo significativo em direção à automação do processo de rastreio, mas não são uma solução final. Os modelos foram testados em imagens de uma única fonte, e a prática médica real envolve amostras de muitos laboratórios diferentes, com diferentes microscópios e métodos de coloração.

O estudo conclui que, embora a aprendizagem por transferência ofereça uma forma robusta e eficaz de construir sistemas automatizados para a classificação de células cervicais, ainda há trabalho a fazer antes que estas ferramentas possam ser utilizadas com segurança numa clínica. O computador provou que consegue aprender a linguagem visual destas células, mas o caminho para a utilização clínica exige mais testes em diversas populações de pacientes e uma compreensão mais profunda de onde o sistema ainda pode cometer erros. Por agora, o papel mais promissor para esta tecnologia é o de uma ferramenta de apoio, ajudando a reduzir a carga de trabalho dos patologistas e garantindo que nenhum sinal subtil de doença passe despercebido, em vez de atuar como um diagnosticador independente. A jornada de um experimento computacional bem-sucedido para um dispositivo médico que salva vidas é longa, mas esta investigação confirma que a base é sólida.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →