Ce que fait ce modèle
Le modèle c4ai-aya-vision-32b développé par Cohere est une solution d'intelligence artificielle de pointe combinant le traitement du texte et la compréhension d'images. Issu des travaux de recherche de Cohere, il se distingue par son approche multilingue et sa capacité à traiter des tâches complexes associant texte et vision.
Ce modèle est particulièrement adapté aux cas d'usage nécessitant l'extraction d'informations à partir de documents visuels, l'analyse d'images, ainsi que l'automatisation de processus via l'appel d'outils externes (supports_tools). Ses capacités multimodales (supports_vision) en font un choix robuste pour les flux de travail collaboratifs et techniques.
Sur le plan de la gestion de la plateforme, l'utilisation de ce modèle est soumise à un tarif de 30,00 $ pour les requêtes en entrée et de 50,00 $ pour les réponses en sortie (par million de jetons). Une attention particulière doit être portée à la planification des coûts lors des déploiements à grande échelle.
Capacités
Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.
Texte
Type principal de contenu traité ou produit par ce modèle.
Vision
Analyse d'images fournies en entrée (photos, captures, documents visuels).
Outils
Peut appeler des outils ou des fonctions (recherche, calcul, actions).
Historique des versions
1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.
- Date non communiquée
Aya Vision 32B
Dernière versioncohere:c4ai-aya-vision-32bVisionOutils- Type principal
- Texte
- Capacités
- Vision (supports_vision), Appel d'outils (supports_tools)
- Tarif Entrée
- 30,00 $ / million de jetons
- Tarif Sortie
- 50,00 $ / million de jetons
Tarif annoncé : 0.50 $ en entrée, 1.50 $ en sortie, par million de jetons (USD)