Ce que fait ce modèle
Introduction et contexte de sortie
Développé par Aion Labs et référencé sur OpenRouter sous l'identifiant aion-labs/aion-3.5, Aion 3.5 marque une étape notable dans la gamme du fournisseur. Inscrit au catalogue officiel le 23 septembre 2026, ce modèle propriétaire succède directement à Aion 3.0 (sorti en mai 2026) et arrive conjointement avec une version plus légère nommée Aion 3.5 Mini. Bien que sa présence soit documentée dans l'API et la documentation tarifaire, Aion Labs n'a pas publié de note de version exhaustive, de livre blanc technique ni de poids ouverts, maintenant le projet sous un format purement propriétaire.
Sur le plan architectural, Aion Labs décrit Aion 3.5 non pas comme un modèle monolithique traditionnel, mais comme un système multi-modèles collaboratif articulé autour de la famille GLM. Selon le concepteur, plusieurs sous-modèles spécialisés conjuguent leurs analyses pour composer chaque réponse. Ce fonctionnement viserait à renforcer la cohérence globale, la tension narrative et la gestion de thématiques complexes ou sombres, bien que ces bénéfices relèvent pour l'instant d'un positionnement éditorial sans validation par des organismes indépendants.
Spécifications techniques et modalités
Sur le volet des modalités d'entrée et de sortie, Aion 3.5 s'en tient à un traitement strictement textuel (texte vers texte). Les métadonnées officielles n'indiquent aucune prise en charge des images, des fichiers audio, des flux vidéo ou de l'analyse directe de documents scannés.
En revanche, ses spécifications d'échanges textuels se révèlent particulièrement amples :
- Fenêtre de contexte : Le modèle prend en charge jusqu'à 262 144 tokens (soit 256 K), ce qui représente un doublement par rapport aux 131 072 tokens de la version 3.0.
- Volume maximal de génération : Le plafond de complétion s'établit à 32 768 tokens (32 K), permettant la rédaction de textes volumineux en une unique requête.
- Raisonnement : Le modèle est formellement catégorisé comme compatible avec le raisonnement dans le catalogue du fournisseur. Toutefois, si l'API d'Aion Labs intègre des paramètres de découpage (
reasoning_split) et de modulation d'effort pour les générations précédentes, la documentation spécifique aux réglages d'Aion 3.5 n'a pas encore été rendue publique.
En raison de l'ampleur du contexte admissible, Aion Labs préconise le recours systématique au mode de diffusion continue (streaming). Le calcul de préremplissage d'un prompt approchant les centaines de milliers de tokens risquerait sinon de dépasser les délais d'attente (timeouts) des requêtes HTTP synchrones standard.
Positionnement tarifaire et concurrentiel
Malgré l'extension considérable de la mémoire contextuelle, Aion Labs maintient une grille tarifaire rigoureusement identique à celle d'Aion 3.0. Les coûts officiels s'établissent ainsi :
- 3,00 $ par million de tokens en entrée ;
- 0,75 $ par million de tokens pour la lecture de cache ;
- 6,00 $ par million de tokens en sortie.
L'évaluation comparative face aux modèles leaders du marché (tels que Claude d'Anthropic, GPT d'OpenAI ou Gemini de Google) demeure délicate. Aion Labs n'a communiqué aucun score sur les bancs d'essai de référence du secteur, à l'instar de MMLU, HumanEval, GPQA ou SWE-bench. En l'absence de métriques standardisées, Aion 3.5 se positionne principalement par ses capacités fonctionnelles : un coût d'inférence contenu au regard de sa fenêtre de 256 K tokens et une interface compatible avec le standard OpenAI facilitant son intégration dans les architectures existantes.
Cas d'usage recommandés et limites identifiées
De par son architecture multi-modèles et son large contexte, Aion 3.5 cible des applications précises nécessitant une rétention d'informations sur la durée et une grande expressivité :
- Narration longue et création littéraire : Le maintien de la continuité narrative sur plusieurs dizaines de milliers de tokens constitue l'atout mis en avant par le fournisseur, particulièrement pour l'élaboration d'intrigues denses et le roleplay interactif.
- Synthèse documentaire et recherche textuelle : Sa fenêtre de 256 K tokens permet d'ingérer de vastes corpus textuels, des transcriptions complètes ou des bases contractuelles afin d'en extraire des analyses approfondies.
- Charges de production écrites : Son format compatible OpenAI et la prise en charge du cache d'entrée en font une option pour les pipelines de génération de contenu à fort volume.
Cependant, plusieurs limites notables doivent être prises en compte avant tout déploiement :
- Absence de repères quantitatifs : Sans benchmarks indépendants, il est impossible de mesurer avec certitude son niveau en logique formelle, en programmation ou face aux hallucinations.
- Opacité architecturale : Les détails sur l'orchestration interne des modèles GLM et le surcoût de latence lié à la collaboration multi-modèles ne sont pas documentés.
- Unimodalité stricte : L'absence totale de fonctionnalités multimodales (vision, audio) restreint son périmètre aux seuls flux textuels.
- Documentation incomplète des outils : Si l'infrastructure globale d'Aion Labs gère les appels d'outils (tool use), la documentation n'atteste pas formellement de leur pleine prise en charge native pour la version 3.5.
Aion 3.5 se présente ainsi comme une solution textuelle spécialisée, axée sur les contextes longs et l'écriture nuancée, dont la pertinence opérationnelle dépendra des retours d'expérience pratiques sur le terrain.
Capacités
Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.
Texte
Type principal de contenu traité ou produit par ce modèle.
Outils
Peut appeler des outils ou des fonctions (recherche, calcul, actions).
Raisonnement
Peut enchaîner une réflexion prolongée avant de répondre, utile pour les tâches difficiles.
Historique des versions
1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.
- Date non communiquée
Aion 3.5
Dernière versionaion-labs/aion-3.5OutilsRaisonnement- Fenêtre de contexte
- 262 144 jetons
- Sortie maximale
- 32 768 jetons
- Fenêtre de contexte
- 262 144 tokens
- Génération maximale
- 32 768 tokens
- Tarif entrée
- 3,00 $ / M tokens
- Tarif lecture de cache
- 0,75 $ / M tokens
- Tarif sortie
- 6,00 $ / M tokens
- Modalité
- Texte à texte
- Architecture
- Système multi-modèles (base GLM)
Tarif annoncé : 3.00 $ en entrée, 6.00 $ en sortie, par million de jetons (USD)