← Últimos artigos
💻 computer science

Mi:dm 2.0 Korea-centric Bilingual Language Models

A KT apresenta o Mi:dm 2.0, uma família de modelos de linguagem de grande escala bilíngue que apresenta variantes de 11,5B e 2,3B de parâmetros que aproveitam um pipeline de dados abrangente e alinhamento cultural para alcançar desempenho de estado da arte em benchmarks específicos da Coreia, enquanto suporta aplicações de pesquisa e comerciais sob uma licença MIT.

Autores originais: Donghoon Shin, Sejung Lee, Soonmin Bae, Hwijung Ryu, Changwon Ok, Hoyoun Jung, Hyesung Ji, Jeehyun Lim, Jehoon Lee, Ji-Eun Han, Jisoo Baik, Mihyeon Kim, Riwoo Chung, Seongmin Lee, Wonjae Park, Yoonseo
Publicado 2026-01-15
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Donghoon Shin, Sejung Lee, Soonmin Bae, Hwijung Ryu, Changwon Ok, Hoyoun Jung, Hyesung Ji, Jeehyun Lim, Jehoon Lee, Ji-Eun Han, Jisoo Baik, Mihyeon Kim, Riwoo Chung, Seongmin Lee, Wonjae Park, Yoonseok Heo, Youngkyung Seo, Seyoun Won, Boeun Kim, Cheolhun Heo, Eunkyeong Lee, Honghee Lee, Hyeongju Ju, Hyeontae Seo, Jeongyong Shim, Jisoo Lee, Junseok Koh, Junwoo Kim, Minho Lee, Minji Kang, Minju Kim, Sangha Nam, Seongheum Park, Taehyeong Kim, Euijai Ahn, Hong Seok Jeung, Jisu Shin, Jiyeon Kim, Seonyeong Song, Seung Hyun Kong, Sukjin Hong, Taeyang Yun, Yu-Seon Kim, A-Hyun Lee, Chae-Jeong Lee, Hye-Won Yu, Ji-Hyun Ahn, Song-Yeon Kim, Sun-Woo Jung, Eunju Kim, Eunji Ha, Jinwoo Baek, Yun-ji Lee, Wanjin Park, Jeong Yeop Kim, Eun Mi Kim, Hyoung Jun Park, Jung Won Yoon, Min Sung Noh, Myung Gyo Oh, Wongyoung Lee, Yun Jin Park, Young S. Kwon, Hyun Keun Kim, Jieun Lee, YeoJoo Park

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você está tentando ensinar um robô não apenas a língua coreana, mas a alma da cultura coreana. Foi exatamente isso que a equipe da KT (Korea Telecom) fez com sua nova criação, o Mi:dm 2.0.

Pense na maioria dos modelos de IA existentes como turistas que memorizaram um guia de frases. Eles podem dizer "Olá" e "Obrigado" em coreano, mas podem não entender por que você se curva, como usar o nível certo de polidez para o seu chefe versus o seu amigo, ou as profundas referências históricas em uma piada. O Mi:dm 2.0, no entanto, foi projetado para ser um residente local. Ele não apenas fala a língua; ele pensa, raciocina e sente como se pertencesse à sociedade coreana.

Aqui está uma divisão de como eles o construíram, usando analogias simples:

1. O Problema: O "Turista" vs. O "Local"

Os autores notaram que, embora muitos modelos de IA saibam falar coreano, eles muitas vezes soam artificiais ou perdem as nuances culturais. É como um turista tentando pedir comida em um mercado local, mas acidentalmente ofendendo o chef porque não conhecia os costumes locais. Os modelos existentes foram treinados em dados que eram ou muito pequenos, ou de baixa qualidade, ou simplesmente não capturavam o "clima" específico da vida coreana.

2. A Solução: Uma "Dieta Cultural"

Para corrigir isso, a equipe não apenas alimentou a IA com mais dados; eles a alimentaram com dados melhores. Eles trataram os dados de treinamento como um chef preparando uma refeição gourmet:

  • Os Ingredientes (Dados): Eles não pegaram tudo o que havia na internet. Eles construíram um pipeline rigoroso de "controle de qualidade". Imagine um peneira que filtra frases quebradas, comentários rudes e textos confusos, mantendo apenas as histórias, notícias e livros claros, de alta qualidade e culturalmente relevantes.
  • O Suplemento Sintético: Como dados de alta qualidade em coreano são raros (como encontrar um tempero específico e raro), eles criaram dados "sintéticos". Eles pegaram o conhecimento existente e o reescreveram em novos formatos, como transformar uma entrada seca de enciclopédia em uma lição de livro didático ou uma notícia em uma conversa, garantindo que a IA aprendesse com fontes diversas.
  • O Menu Equilibrado: Eles notaram que a IA estava comendo muita "humanidades" (história, literatura) e pouco "STEM" (ciência, matemática). Por isso, eles prepararam deliberadamente pratos extras de "STEM" para garantir que a IA fosse bem arredondada e não ficasse doente com uma dieta unilateral.

3. Os Dois Modelos: O "Chef Mestre" e o "Canivete Suíço"

Eles lançaram duas versões desta IA para atender a diferentes necessidades:

  • Mi:dm 2.0 Base (11,5 Bilhões de Parâmetros): Pense nisso como o Chef Mestre. É grande, poderoso e lida com tarefas complexas como raciocínio profundo, escrita de histórias longas ou resolução de problemas matemáticos difíceis. Ele foi construído pegando um modelo menor de 8 bilhões de parâmetros e "esticando-o" mais profundamente (adicionando mais camadas) para torná-lo mais inteligente sem alterar sua estrutura básica.
  • Mi:dm 2.0 Mini (2,3 Bilhões de Parâmetros): Este é o Canivete Suíço. É pequeno, leve e projetado para rodar em dispositivos com energia limitada (como um celular ou um laptop). Eles pegaram o conhecimento do Chef Mestre e o "podaram", mantendo as habilidades mais importantes para que ele ainda possa fazer um ótimo trabalho sem precisar de uma cozinha enorme.

4. O Treinamento: De "Ler" para "Conversar"

  • Pré-treinamento (Lendo a Biblioteca): Primeiro, a IA leu milhões de documentos para aprender o básico da linguagem, fatos e lógica.
  • Pós-treinamento (Aprendizado): Após a leitura, a IA passou por um aprendizado especializado. Eles lhe ensinaram habilidades específicas:
    • Seguir Instruções: Aprender a dizer "Sim, senhor" e fazer exatamente o que você pede, não apenas o que ela acha que você quer.
    • Segurança: Aprender o que não dizer. Eles a ensinaram a reconhecer tópicos prejudiciais (como discurso de ódio ou atos ilegais) e recusar educadamente o engajamento, agindo como um adulto responsável.
    • Uso de Ferramentas: Ensinar como usar ferramentas externas, como uma calculadora ou um mecanismo de busca, para obter respostas em tempo real.

5. Os Resultados: Passando no "Teste Local"

A equipe testou o Mi:dm 2.0 contra outros modelos famosos de IA usando testes especiais coreanos (como um teste de QI cultural).

  • O Veredito: O Mi:dm 2.0 não apenas passou; ele gabaritou os testes. Ele pontuou mais alto que outros modelos na compreensão da história, cultura e situações sociais complexas da Coreia.
  • A "Agulha no Palheiro": Eles testaram se a IA conseguia encontrar uma pequena informação em um documento massivo (como encontrar uma agulha em um palheiro). O Mi:dm 2.0 foi excelente nisso, provando que pode lidar com conversas longas e detalhadas sem se perder.
  • Segurança: Quando enganado com perguntas capciosas projetadas para fazer a IA dizer algo maldoso ou perigoso, o Mi:dm 2.0 manteve sua posição melhor do que seus concorrentes, mostrando que possui uma forte "bússola moral".

Resumo

O Mi:dm 2.0 é uma IA bilíngue (coreano-inglês) que foi especificamente projetada para ser centrada na Coreia. Em vez de ser um robô genérico que por acaso fala coreano, ela foi criada com uma dieta de dados culturalmente ricos e de alta qualidade para entender as nuances, o humor e os valores da sociedade coreana. Quer você precise de um cérebro poderoso para tarefas complexas (Base) ou de um ajudante ágil para tarefas cotidianas (Mini), esta IA foi projetada para parecer menos uma máquina e mais um amigo local conhecedor.

Nota: O artigo afirma que os modelos são lançados sob a licença MIT para uso de pesquisa e comercial, e os desenvolvedores reconhecem que, embora se esforcem pela segurança, nenhum IA é perfeito e ainda pode cometer erros.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →