← Últimos artigos
🤖 AI

Phoenix-VL 1.5 Medium Technical Report

Phoenix-VL 1.5 Medium é um modelo de base nativamente multimodal e multilingue com 123 bilhões de parâmetros, especificamente adaptado ao contexto de Singapura por meio de pré-treinamento e alinhamento localizados extensivos, alcançando desempenho de última geração em benchmarks regionais enquanto mantém competitividade global em inteligência geral.

Autores originais: Team Phoenix, :, Arka Ray, Askar Ali Mohamed Jawad, Biondi Lee, Elijah Seah, Eva Lim, Fiona Teo, Grace Toh, Guang Xiang Teo, Jun En Tan, Jia Hui Bong, Jiale Wang, Jonathan Ng, Justin Tan, Kai Zhe Yew
Publicado 2026-05-12
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Team Phoenix, :, Arka Ray, Askar Ali Mohamed Jawad, Biondi Lee, Elijah Seah, Eva Lim, Fiona Teo, Grace Toh, Guang Xiang Teo, Jun En Tan, Jia Hui Bong, Jiale Wang, Jonathan Ng, Justin Tan, Kai Zhe Yew, Matthew Ong, Shun Yi Yeo, Wen Jett Lam, Wen Xiu Tan, Ze Yu Zhang, Gee Wah Ng, Chee Wee Ang, Mistral AI, :, Adrien Sadé, Guillaume Kunsch, Jia Sin Loh, Nicolas Schuhl, Rupert Menneer, Umar Jamil, Vincent Maladière, Yimu Pan

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

A Grande Ideia: Um Super-Cérebro "Especialista Local"

Imagine que você tem um professor brilhante, que viajou pelo mundo inteiro e sabe tudo sobre ciência, matemática e história global. Este é o modelo Mistral Medium 3.1 com o qual os pesquisadores começaram. Ele é incrivelmente inteligente, mas, se você perguntar sobre uma lei específica de Singapura ou o nome de um parque infantil famoso no bairro de Toa Payoh, ele pode errar a resposta ou dar uma resposta genérica.

Phoenix-VL 1.5 Medium é o que acontece quando você pega esse professor que viajou pelo mundo e o envia para um rigoroso "Bootcamp de Imersão em Singapura" de 12 meses. O objetivo era criar uma IA Soberana — um cérebro digital que pertence a Singapura, entende sua cultura e leis únicas, e pode trabalhar com segurança sem precisar consultar coisas na internet (como um sistema "isolado" que não se comunica com o mundo exterior).

A Receita de Treinamento: Como Eles Fizeram

Os pesquisadores não apenas jogaram uma pilha de livros no modelo. Eles usaram uma receita de cozimento específica de quatro etapas para assar essa nova IA:

  1. A Camada Base (Pré-treinamento Contínuo):
    Pense nisso como alimentar o modelo com uma biblioteca massiva e especializada. Eles deram a ele 1 trilhão de tokens (um token é como uma palavra ou uma parte de uma palavra) de dados. Isso não era apenas texto aleatório da internet; era uma mistura curada, pesada em leis de Singapura, idiomas regionais (como malaio, tâmil e chinês) e cultura local.

    • A Analogia: Imagine o professor lendo todos os jornais de Singapura, o diário oficial do governo e romances locais durante um ano, mantendo ao mesmo tempo seu conhecimento global intacto.
  2. A Extensão de Leitura Longa (Contexto Longo):
    Eles ensinaram o modelo a lembrar de grandes quantidades de informações de uma só vez. Eles estenderam sua "memória de curto prazo" para reter 131.072 tokens (aproximadamente o tamanho de um romance grosso).

    • A Analogia: O professor agora consegue ler um documento legal inteiro de 500 páginas em uma única sentada e lembrar dos detalhes da página 1 quando chega na página 400, sem esquecer o início.
  3. O Ajuste Fino (Treinamento de Instrução e Domínio):
    É aqui que o modelo aprendeu como se comportar. Eles mostraram exemplos específicos de como responder perguntas sobre políticas governamentais de Singapura e como descrever cenas locais (como um "Parque Infantil Dragão de Toa Payoh" em vez de apenas um "parque infantil" genérico).

    • A Analogia: O professor agora está fazendo uma aula de "Atendimento ao Cliente e Etiqueta Local". Ele aprendeu que, quando um singapuriano pergunta sobre uma lei, ele precisa de uma resposta precisa, não de um palpite vago. Ele também aprendeu a olhar para fotos de marcos locais e descrevê-los com precisão.
  4. O Polimento (Otimização Direta de Preferência Online):
    Finalmente, professores humanos revisaram as respostas do modelo e as classificaram. Se o modelo fosse muito tagarela, alucinasse (inventasse coisas) ou fosse rude, os professores o corrigiam.

    • A Analogia: Um último "ensaio geral" onde o professor pratica responder perguntas, e um painel de juízes dá feedback para garantir que ele seja útil, honesto e seguro antes de subir ao palco.

O Que o Torna Especial?

O artigo destaca três superpoderes principais deste novo modelo:

  • É uma Lenda Local: Em testes projetados especificamente para Singapura (como conhecer os nomes de todos os 16 ministérios do governo ou entender leis de segurança locais), o Phoenix-VL 1.5 Medium superou modelos muito maiores e mais famosos.
    • O Resultado: Ele pontuou mais alto do que modelos com 400 bilhões de parâmetros (como o Llama 4 Maverick) em conhecimento local. Isso prova que o treinamento local profundo é mais importante do que apenas ter um cérebro maior.
  • Não Esqueceu o Mundo: Um medo comum é que ensinar um modelo sobre um tópico específico faça com que ele esqueça tudo o mais. O artigo afirma que o Phoenix-VL 1.5 Medium manteve sua inteligência geral. Ele ainda é ótimo em matemática, programação e raciocínio geral, tão bom quanto outros modelos de ponta.
  • Vê e Entende: Ao contrário de modelos mais antigos que apenas leem texto, este é "multimodal". Ele pode olhar para uma foto de uma cena de rua de Singapura ou um gráfico complexo e explicá-lo no contexto local.

Segurança: O Filtro de "Honestidade"

Os pesquisadores construíram um quadro de segurança especial adaptado às regras de Singapura.

  • A Regra "Não Invente Coisas": Em contextos legais ou governamentais, inventar um fato é perigoso. O modelo foi treinado para dizer "Eu não sei" em vez de chutar.
  • A Regra "Sem Maus Agentes": O modelo é resistente a "jailbreaks" (truques que as pessoas usam para fazer a IA fazer coisas ruins) e não vazará suas próprias instruções secretas.
  • A Analogia: Pense nele como um funcionário público muito disciplinado que sabe exatamente o que lhe é permitido dizer e o que deve se recusar a responder, garantindo que ele nunca acidentalmente quebre a lei ou espalhe desinformação.

A Conclusão

O Phoenix-VL 1.5 Medium é um modelo de IA com 123 bilhões de parâmetros que prova que você não precisa do maior modelo do mundo para ser o especialista local mais inteligente. Ao curar cuidadosamente os dados e treinar especificamente para as leis, idiomas e cultura únicas de Singapura, os criadores construíram um modelo que é:

  1. Profundamente conhecedor de Singapura (melhor que os gigantes).
  2. Competitivo globalmente em inteligência geral.
  3. Seguro e protegido para uso nos setores governamental e privado sem necessidade de internet.

É um "ativo soberano", o que significa que é uma ferramenta digital construída especificamente para as necessidades de Singapura, propriedade e controlada pela nação.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →