Ce que fait ce modèle
Le modèle Nemotron-3 Ultra de NVIDIA s'appuie sur une architecture de type mélange d'experts (MoE) comportant environ 550 milliards de paramètres au total, dont 55 milliards d'actifs par jeton. Cette configuration hybride permet de concilier la richesse d'analyse d'un modèle de très grande taille avec une efficacité d'exécution optimisée pour le traitement linguistique.
Ce modèle est particulièrement adapté pour la génération de contenu complexe, la synthèse documentaire, la reformulation et le raisonnement logique. Grâce au support natif de l'appel d'outils (tool use), il peut s'intégrer efficacement dans des architectures applicatives nécessitant l'interconnexion avec des services externes.
Proposé gratuitement sur OpenRouter, cet accès est idéal pour le prototypage et l'évaluation au sein de la plateforme ProductivIA. Cependant, la bande passante et la disponibilité de cette version gratuite peuvent être limitées et ne s'accompagnent d'aucun engagement de niveau de service (SLA). Pour les données d'entreprise sensibles ou les applications en production, il convient de tenir compte de la localisation des serveurs d'inférence tiers.
Capacités
Ce que les versions de cette famille savent faire, d'après les annonces du fournisseur et les observations de la veille.
Texte
Type principal de contenu traité ou produit par ce modèle.
Outils
Peut appeler des outils ou des fonctions (recherche, calcul, actions).
Historique des versions
1 version reconstituée à partir des identifiants techniques et des dates de sortie, de la plus récente à la plus ancienne.
- mai 2026
Nemotron-3 Ultra (MoE) - Gratuit
Dernière versionnvidia/nemotron-3-ultra-550b-a55b:freeOutils- Éditeur
- NVIDIA
- Architecture
- Mélange d'experts (550B total / 55B actifs)
- Fournisseur
- OpenRouter
- Capacités
- Texte, Appel d'outils
- Tarification
- Gratuit (0 $)
Tarif annoncé : 0.00 $ en entrée, 0.00 $ en sortie, par million de jetons (USD)