Ce que fait ce modèle
Ce modèle multimodal de 8 milliards de paramètres est optimisé pour les tâches combinant la compréhension d'images et le traitement textuel. Grâce à ses capacités de vision (OCR, analyse de documents, reconnaissance d'objets) et son support natif des outils (tool calling), il répond efficacement aux besoins d'automatisation et d'intégration de systèmes complexes.
Son positionnement tarifaire particulièrement avantageux en fait un choix d'infrastructure performant pour les traitements volumineux. Pour les organisations québécoises, l'exploitation de ce modèle via OpenRouter permet d'optimiser les coûts de traitement des données non structurées, s'inscrivant ainsi dans une démarche d'indépendance technologique face aux solutions propriétaires plus onéreuses.
Points de vigilance : Le transit de données visuelles par des API tierces comme OpenRouter requiert une validation de conformité avec les règles de gouvernance locales, notamment en matière de protection des renseignements personnels au Québec.
Capacités
Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.
Texte
Type principal de contenu traité ou produit par ce modèle.
Vision
Analyse d'images fournies en entrée (photos, captures, documents visuels).
Outils
Peut appeler des outils ou des fonctions (recherche, calcul, actions).
Historique des versions
1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.
- Date non communiquée
Qwen 3 VL 8B Instruct
Dernière versionqwen/qwen3-vl-8b-instructVisionOutils- Identifiant
- qwen/qwen3-vl-8b-instruct
- Capacités
- Vision, Appel d'outils (Tools)
- Tarif Entrée
- 0,117 $ / M tokens
- Tarif Sortie
- 0,455 $ / M tokens
Tarif annoncé : 0.12 $ en entrée, 0.46 $ en sortie, par million de jetons (USD)