Texte

Baidu

Ernie 4.5 VL 424B A47b

Modèle multimodal de 424B paramètres de Baidu, hautement performant pour l'analyse d'images complexes et le raisonnement avancé avec support d'outils.

Dernière version
Baidu Ernie 4.5 VL
Numéro de version
4.5
Type
Texte
Versions recensées
1

Ce que fait ce modèle

Le modèle ERNIE 4.5 VL de Baidu, accessible via OpenRouter, est une solution de très grande envergure (424 milliards de paramètres) spécialisée dans le traitement multimodal (vision-langage). Il se distingue par d'excellentes capacités d'analyse d'images, de lecture de documents visuels complexes et de raisonnement logique de haut niveau, tout en prenant en charge l'appel d'outils externes.

Pour les projets intégrés à ProductivIA, ce modèle offre une alternative performante pour le traitement de données multilingues et visuelles. Néanmoins, l'infrastructure de traitement étant située hors du Canada, l'utilisation de ce modèle pour des données publiques ou hautement sensibles nécessite une validation de conformité rigoureuse au regard des exigences de souveraineté numérique du Québec et de la Loi 25.

Les points de vigilance incluent la latence de réponse, qui peut être plus élevée en raison de la taille massive du modèle, ainsi que la consommation de jetons lors de la soumission d'images de haute résolution.

Capacités

Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.

Texte

Type principal de contenu traité ou produit par ce modèle.

Vision

Analyse d'images fournies en entrée (photos, captures, documents visuels).

Outils

Peut appeler des outils ou des fonctions (recherche, calcul, actions).

Historique des versions

1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.

  1. Date non communiquée

    Baidu Ernie 4.5 VL

    Dernière version

    baidu/ernie-4.5-vl-424b-a47b

    VisionOutils
    Fournisseur
    OpenRouter
    Identifiant
    baidu/ernie-4.5-vl-424b-a47b
    Architecture
    Multimodal (Vision & Texte)
    Capacités
    Vision, Appel d'outils (Tools)
    Tarif Entrée
    0,42 $ / million de jetons
    Tarif Sortie
    1,25 $ / million de jetons

    Tarif annoncé : 0.42 $ en entrée, 1.25 $ en sortie, par million de jetons (USD)

Liste de modèles fournie par la plateforme ProductivIA

productivia.ca