Ce que fait ce modèle
Lancée par Tencent, la famille de modèles Hy-MT2 se positionne comme une référence spécialisée dans la traduction automatique multilingue de pointe. Au sein de cette gamme, le modèle Hy-MT2-7B se distingue par son équilibre optimal entre légèreté, rapidité et efficacité. Publié initialement le 21 mai 2026 par les équipes de Tencent, ce modèle a fait son apparition sur le catalogue d'OpenRouter le 19 août 2026. Conçu pour répondre aux exigences professionnelles de localisation, il propose une approche de traduction directe dite « fast-thinking », privilégiant une génération fluide et immédiate, au détriment des phases de raisonnement explicites et coûteuses en temps de calcul.
Une spécialisation technique rigoureuse et des modalités avancées
D'un point de vue architectural, bien que commercialisé sous la dénomination « 7B », Hy-MT2-7B s'appuie sur un point de contrôle (checkpoint) de 8 milliards de paramètres au format BF16. Le modèle est distribué sous licence Apache-2.0, offrant ainsi une grande liberté d'intégration, et dispose de déclinaisons optimisées pour le déploiement local, notamment en formats FP8 et GGUF.
Le modèle fonctionne exclusivement en mode texte-vers-texte. Il ne dispose d'aucune capacité de traitement d'images, de fichiers audio ou de vidéos, et ne génère aucun média de ce type. Son expertise est entièrement canalisée vers la maîtrise de 33 langues différentes, enrichie sur OpenRouter par la prise en charge de cinq paires de langues impliquant des dialectes ou des langues minoritaires chinoises (telles que le cantonais, le tibétain, le kazakh ou le mongol).
Au-delà de la simple conversion mot à mot, Tencent a doté ce modèle de fonctionnalités avancées indispensables aux traducteurs professionnels : - Gestion terminologique : Prise en charge de gabarits pour les glossaires et la terminologie métier. - Contrôle du style et des préférences : Alignement avec les consignes de style de l'utilisateur. - Respect des structures de données : Préservation stricte des délimiteurs et capacité à traduire au sein de formats structurés comme le JSON ou le HTML. - Traduction contextualisée : Prise en compte de l'environnement textuel global pour affiner le sens.
Sur OpenRouter, bien que l'appel d'outils (function calling) ne soit pas pris en charge, le modèle accepte les sorties structurées via un schéma JSON (response_format). La fenêtre de contexte s'élève à 8 192 tokens, avec une limite stricte de génération fixée à 4 096 tokens, conformément aux recommandations de Tencent pour optimiser la qualité de l'inférence.
Performances revendiquées face aux géants du secteur
Les performances de Hy-MT2-7B, détaillées dans l'article technique publié par Tencent sur arXiv, mettent en avant des gains significatifs par rapport aux générations précédentes et à des modèles de taille bien supérieure. Il convient de noter que ces données proviennent directement de l'éditeur et attendent des validations tierces indépendantes.
Sur le benchmark de référence FLORES-200, dans la configuration globale XX↔XX, Hy-MT2-7B affiche un score XCOMET-XXL de 86,89, marquant une progression notable face aux 80,98 obtenus par son prédécesseur Hy-MT1.5-7B. Selon les rapports de Tencent, cette version surpasse dans ce scénario des architectures massives ou réputées telles que DeepSeek-V4-Pro, Kimi K2.6, Qwen3.5-397B-A17B ou encore Gemma4-26B-A4B. Sur l'évaluation WMT25, le modèle obtient les métriques respectives de 63,86 / 71,21 / 82,24. De plus, sur IFMTBench, un benchmark évaluant la capacité à suivre des instructions complexes de traduction, Hy-MT2-7B enregistre un score global solide de 83,14.
Cas d'usage concrets et limites identifiées
Hy-MT2-7B se révèle particulièrement pertinent pour les scénarios suivants : - La localisation de plateformes web et de logiciels : Grâce à sa capacité à traduire des chaînes au sein de balises JSON ou HTML sans altérer le code sous-jacent. - La traduction technique d'entreprise : L'intégration de glossaires spécifiques permet de respecter scrupuleusement le jargon d'une industrie. - Le sous-titrage et la traduction de scripts : La préservation du style et la fluidité de la génération directe conviennent parfaitement aux flux de travail audiovisuels.
Néanmoins, le modèle souffre de certaines limites intrinsèques. Sa fenêtre de contexte de 8 192 tokens s'avère relativement étroite pour le traitement de volumes documentaires massifs en un seul bloc. De plus, l'absence de support pour le « tool calling » sur OpenRouter restreint les possibilités d'interaction avec des APIs externes. Enfin, en tant que modèle hautement spécialisé, il ne doit pas être exploité comme une solution généraliste de raisonnement logique ou de génération de code informatique.
Tencent Hy-MT2-7B est proposé sur OpenRouter via l'infrastructure Tencent Cloud. Le coût d'utilisation s'avère particulièrement compétitif : - Tarif d'entrée : 0,074 $ par million de tokens. - Tarif de sortie : 0,295 $ par million de tokens.
Capacités
Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.
Texte
Type principal de contenu traité ou produit par ce modèle.
Outils
Peut appeler des outils ou des fonctions (recherche, calcul, actions).
Historique des versions
1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.
- Date non communiquée
Tencent Hy-MT2-7B
Dernière versiontencent/hy-mt2-7bOutils- Fenêtre de contexte
- 8 192 tokens
- Génération maximale
- 4 096 tokens
- Taille réelle du modèle
- 8 milliards de paramètres (BF16)
- Licence
- Apache-2.0
- Tarif Entrée / Sortie (par million de tokens)
- 0,074 $ / 0,295 $
Tarif annoncé : 0.07 $ en entrée, 0.30 $ en sortie, par million de jetons (USD)