← Derniers articles
🤖 AI

Phoenix-VL 1.5 Medium Technical Report

Phoenix-VL 1.5 Medium est un modèle de fondation nativement multimodal et multilingue de 123 milliards de paramètres, spécifiquement adapté au contexte singapourien grâce à un préentraînement et un alignement localisés approfondis, atteignant des performances de pointe sur les benchmarks régionaux tout en maintenant une compétitivité mondiale en intelligence générale.

Auteurs originaux : Team Phoenix, :, Arka Ray, Askar Ali Mohamed Jawad, Biondi Lee, Elijah Seah, Eva Lim, Fiona Teo, Grace Toh, Guang Xiang Teo, Jun En Tan, Jia Hui Bong, Jiale Wang, Jonathan Ng, Justin Tan, Kai Zhe Yew
Publié 2026-05-12
📖 6 min de lecture🧠 Analyse approfondie

Auteurs originaux : Team Phoenix, :, Arka Ray, Askar Ali Mohamed Jawad, Biondi Lee, Elijah Seah, Eva Lim, Fiona Teo, Grace Toh, Guang Xiang Teo, Jun En Tan, Jia Hui Bong, Jiale Wang, Jonathan Ng, Justin Tan, Kai Zhe Yew, Matthew Ong, Shun Yi Yeo, Wen Jett Lam, Wen Xiu Tan, Ze Yu Zhang, Gee Wah Ng, Chee Wee Ang, Mistral AI, :, Adrien Sadé, Guillaume Kunsch, Jia Sin Loh, Nicolas Schuhl, Rupert Menneer, Umar Jamil, Vincent Maladière, Yimu Pan

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

La Grande Idée : Un Super-Cerveau « Expert Local »

Imaginez un professeur brillant, ayant voyagé partout dans le monde, qui connaît tout sur la science, les mathématiques et l'histoire mondiale. C'est le modèle Mistral Medium 3.1 avec lequel les chercheurs ont commencé. Il est incroyablement intelligent, mais si vous lui posez une question sur une loi locale spécifique à Singapour ou le nom d'une aire de jeux célèbre dans le quartier de Toa Payoh, il pourrait se tromper ou donner une réponse générique.

Phoenix-VL 1.5 Medium est le résultat obtenu lorsque l'on prend ce professeur ayant voyagé dans le monde entier et que l'on l'envoie dans un « Bootcamp d'Immersion Singapourienne » rigoureux de 12 mois. L'objectif était de créer une IA Souveraine — un cerveau numérique qui appartient à Singapour, comprend sa culture et ses lois uniques, et peut fonctionner en toute sécurité sans avoir besoin de consulter des informations sur Internet (comme un système « isolé » qui ne communique pas avec le monde extérieur).

La Recette d'Entraînement : Comment Ils Ont Fait

Les chercheurs n'ont pas simplement déversé une pile de livres sur le modèle. Ils ont utilisé une recette de cuisine spécifique en quatre étapes pour cuire cette nouvelle IA :

  1. La Couche de Base (Pré-entraînement Continu) :
    Imaginez cela comme nourrir le modèle avec une bibliothèque massive et spécialisée. Ils lui ont fourni 1 billion de tokens (un token est comme un mot ou un fragment de mot) de données. Ce n'était pas du texte Internet aléatoire ; c'était un mélange soigneusement sélectionné, lourd en lois singapouriennes, en langues régionales (comme le malais, le tamoul et le chinois) et en culture locale.

    • L'Analogie : Imaginez le professeur lisant tous les journaux singapouriens, les gazettes gouvernementales et les romans locaux pendant un an, tout en conservant intactes ses connaissances mondiales.
  2. L'Extension de Lecture Longue (Contexte Long) :
    Ils ont appris au modèle à se souvenir d'énormes quantités d'informations simultanément. Ils ont étendu sa « mémoire à court terme » pour qu'elle puisse contenir 131 072 tokens (environ la taille d'un roman épais).

    • L'Analogie : Le professeur peut maintenant lire un document juridique complet de 500 pages en une seule séance et se souvenir des détails de la page 1 lorsqu'il arrive à la page 400, sans oublier le début.
  3. Le Affinage (Entraînement par Instruction et Domaine) :
    C'est ici que le modèle a appris comment se comporter. On lui a montré des exemples spécifiques de la manière de répondre à des questions sur les politiques gouvernementales singapouriennes et de décrire des scènes locales (comme une « aire de jeux du Dragon de Toa Payoh » plutôt qu'une simple « aire de jeux » générique).

    • L'Analogie : Le professeur suit maintenant un cours de « Service Client et Étiquette Locale ». Il a appris que lorsqu'un Singapourien demande une loi, il a besoin d'une réponse précise, pas d'une supposition vague. Il a aussi appris à regarder des photos de monuments locaux et à les décrire avec exactitude.
  4. La Finition (Optimisation Directe des Préférences en Ligne) :
    Enfin, des enseignants humains ont examiné les réponses du modèle et les ont classées. Si le modèle était trop bavard, hallucinait (inventait des choses) ou était impoli, les enseignants le corrigeaient.

    • L'Analogie : Une dernière « répétition générale » où le professeur s'entraîne à répondre à des questions, et un jury de juges lui donne des retours pour s'assurer qu'il est utile, honnête et sûr avant de monter sur scène.

Ce Qui Le Rend Spécial ?

Le document met en avant trois super-pouvoirs principaux de ce nouveau modèle :

  • C'est une Légende Locale : Sur des tests spécifiquement conçus pour Singapour (comme connaître les noms des 16 ministères gouvernementaux ou comprendre les lois locales de sécurité), Phoenix-VL 1.5 Medium a battu des modèles beaucoup plus grands et plus célèbres.
    • Le Résultat : Il a obtenu un score supérieur à celui de modèles comportant 400 milliards de paramètres (comme Llama 4 Maverick) sur les connaissances locales. Cela prouve que l'entraînement local approfondi est plus important que d'avoir simplement un cerveau plus gros.
  • Il N'a Pas Oublié le Monde : Une crainte courante est qu'enseigner à un modèle un sujet spécifique le fasse oublier tout le reste. Le document affirme que Phoenix-VL 1.5 Medium a conservé son intelligence générale. Il reste excellent en mathématiques, en programmation et en raisonnement général, tout aussi bon que les autres modèles de premier plan.
  • Il Voit et Comprend : Contrairement aux anciens modèles qui ne lisaient que du texte, celui-ci est « multimodal ». Il peut regarder une photo d'une scène de rue singapourienne ou d'un graphique complexe et l'expliquer dans le contexte local.

Sécurité : Le Filtre « Honnêteté »

Les chercheurs ont construit un cadre de sécurité spécial adapté aux règles de Singapour.

  • La Règle « Ne Pas Inventer » : Dans des contextes juridiques ou gouvernementaux, inventer un fait est dangereux. Le modèle a été entraîné à dire « Je ne sais pas » plutôt que de deviner.
  • La Règle « Pas de Mauvais Acteurs » : Le modèle est résistant aux « jailbreaks » (les astuces utilisées par les gens pour faire faire de mauvaises choses à l'IA) et ne divulguera pas ses propres instructions secrètes.
  • L'Analogie : Imaginez un fonctionnaire très discipliné qui sait exactement ce qu'il a le droit de dire et ce qu'il doit refuser de répondre, s'assurant ainsi de ne jamais enfreindre la loi ou de propager de fausses informations par accident.

La Conclusion

Phoenix-VL 1.5 Medium est un modèle d'IA de 123 milliards de paramètres qui prouve que vous n'avez pas besoin du plus grand modèle au monde pour être l'expert local le plus intelligent. En sélectionnant soigneusement les données et en entraînant spécifiquement pour les lois, les langues et la culture uniques de Singapour, les créateurs ont construit un modèle qui est :

  1. Profondément informé sur Singapour (mieux que les géants).
  2. Compétitif au niveau mondial en matière d'intelligence générale.
  3. Sûr et sécurisé pour une utilisation dans les secteurs public et privé sans avoir besoin d'Internet.

C'est un « actif souverain », ce qui signifie que c'est un outil numérique construit spécifiquement pour les besoins de Singapour, appartenant et contrôlé par la nation.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →