Texte

InclusionAI

Ling 3.0 Flash Sante:free

Un modèle MoE de 124B paramètres spécialisé en santé, offrant 256K de contexte et temporairement gratuit.

Dernière version
Ling-3.0-Flash-Sante
Numéro de version
3.0
Type
Texte
Versions recensées
1

Ce que fait ce modèle

Un nouvel acteur spécialisé pour la santé numérique

Le paysage des modèles d'intelligence artificielle spécialisés accueille un nouveau représentant : Ling-3.0-Flash-Sante. Développé par inclusionAI et distribué par Novita AI, ce modèle est désormais visible chez les agrégateurs sous l'identifiant inclusionai/ling-3.0-flash-sante:free. L'ajout de ce modèle au catalogue de Novita AI a été réalisé le 3 septembre 2026, suivi d'une apparition sur la fiche Vercel AI Gateway le 4 septembre 2026, marquant ainsi sa mise à disposition publique.

Conçu comme une déclinaison de la famille Ling-3.0-Flash, cet endpoint met l'accent sur le traitement de l'information clinique, le raisonnement médical et la synthèse documentaire. En proposant une architecture hybride très large mais optimisée, il s'adresse aux professionnels du traitement de données et de la recherche clinique.

Une architecture MoE de pointe et un contexte massif

Sur le plan technique, Ling-3.0-Flash-Sante s'appuie sur une architecture de type Mixture-of-Experts (MoE) particulièrement robuste. Le modèle embarque un total de 124 milliards de paramètres, tout en maintenant une efficacité de calcul élevée grâce à l'activation de seulement 5,1 milliards de paramètres par jeton.

Cette efficacité repose sur l'architecture socle de la famille Ling-3.0-Flash, qui emploie un MoE hybride linéaire alternant entre la technologie Kimi Delta Attention et le mécanisme MLA (Multi-head Latent Attention). Le modèle de base comporte ainsi 512 experts routés, dont 8 sont activés simultanément pour chaque jeton.

L'un des atouts majeurs de ce modèle réside dans ses capacités de gestion du contexte : - Fenêtre de contexte : 262 144 jetons (soit 256K), permettant d'ingérer d'épais dossiers ou plusieurs études cliniques complètes. - Génération maximale : Jusqu'à 32 768 jetons en sortie (32K), une capacité de rédaction particulièrement généreuse pour des rapports détaillés ou des synthèses de grande envergure.

Capacités fonctionnelles et positionnement technique

Ling-3.0-Flash-Sante est un modèle strictement multimodal restreint au texte (entrée texte, sortie texte). Il ne prend pas en charge la vision, l'audio, la génération d'images ou la création de vidéos. En revanche, il excelle sur les aspects logiques et opérationnels en supportant nativement : - Le raisonnement complexe (reasoning). - Les appels de fonctions (function calling). - Une compatibilité API alignée sur les standards établis par OpenAI et Anthropic.

Un positionnement face à la concurrence qui incite à la prudence

Lorsqu'on cherche à évaluer la précision clinique de Ling-3.0-Flash-Sante, une grande réserve s'impose. Aucun tableau de benchmarks médicaux publics, aucune métrique de précision clinique et aucune comparaison indépendante propre à cette variante médicale n'ont été diffusés par Novita AI ou inclusionAI.

Pour situer ses capacités, on doit se référer au modèle de base, Ling-3.0-Flash. InclusionAI affirme que ce dernier affiche une parité, voire une supériorité, face au modèle géant Ring-2.6-1T (un modèle à un trillion de paramètres) sur plusieurs benchmarks de code, d'agents et de contexte long. Néanmoins, ces éléments de comparaison au lancement ont été présentés sous forme de graphiques sans tableaux de données brutes exploitables. La plateforme Vercel AI Gateway souligne d'ailleurs que la marge de supériorité exacte vis-à-vis du modèle à un trillion de paramètres reste difficile à évaluer de manière transparente. Ces résultats généraux ne doivent en aucun cas être extrapolés comme une validation scientifique ou clinique de la déclinaison "Sante".

Cas d'usage identifiés et limites d'utilisation

Compte tenu de ses spécifications et de son absence de validation clinique formelle, Ling-3.0-Flash-Sante doit être cantonné à des tâches de support et d'analyse documentaire supervisée.

### Applications recommandées : 1. Synthèse de littérature scientifique : Analyse et résumé d'études cliniques fournies directement au modèle dans sa fenêtre de contexte. 2. Tri et indexation documentaire : Classification de documents administratifs ou cliniques au sein d'un système d'information de santé. 3. Assistance à la recherche : Extraction d'informations à partir de sources contrôlées et préalablement nettoyées. 4. Workflows d'agents outillés : Déploiement d'agents de recherche exploitant des outils externes via l'appel de fonctions.

### Limites majeures et avertissements : - Absence de vision : Incapacité à analyser des imageries médicales (radiographies, IRM, scans). - Absence de validation clinique publiée : Ses réponses ne s'appuient pas sur des garanties de fiabilité médicale mesurées de manière indépendante. - Garantie des sorties structurées : Aucune garantie technique n'est fournie concernant le formatage des données en sortie. - Usage interdit en autonomie : Conformément aux avertissements de Novita AI, ce modèle ne doit pas être utilisé pour poser des diagnostics, éditer des consignes de traitement ou prendre des décisions cliniques de manière autonome.

Actuellement, Novita AI propose ce modèle à un tarif exceptionnel de 0 $ par million de jetons en entrée et 0 $ par million de jetons en sortie. Cette gratuité, matérialisée par le suffixe :free sur OpenRouter, présente toutefois un caractère strictement temporaire. Vercel AI Gateway indique ainsi que cette période promotionnelle doit s'achever le 4 octobre 2026. Après cette date, une tarification standard devrait s'appliquer.

Capacités

Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.

Texte

Type principal de contenu traité ou produit par ce modèle.

Outils

Peut appeler des outils ou des fonctions (recherche, calcul, actions).

Raisonnement

Peut enchaîner une réflexion prolongée avant de répondre, utile pour les tâches difficiles.

Historique des versions

1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.

  1. Date non communiquée

    Ling-3.0-Flash-Sante

    Dernière version

    inclusionai/ling-3.0-flash-sante:free

    OutilsRaisonnement
    Fenêtre de contexte
    262 144 jetons
    Sortie maximale
    32 768 jetons
    Fenêtre de contexte
    262 144 jetons (256K)
    Génération maximale
    32 768 jetons (32K)
    Architecture
    Mixture-of-Experts (MoE)
    Paramètres totaux
    124 milliards
    Paramètres activés
    5,1 milliards par jeton

    Tarif annoncé : 0.00 $ en entrée, 0.00 $ en sortie, par million de jetons (USD)

Liste de modèles fournie par la plateforme ProductivIA

productivia.ca