Nvidia, fondée en 1993 à Santa Clara par Jensen Huang, Chris Malachowsky et Curtis Priem, est d’abord le fournisseur d’infrastructure sur lequel repose toute l’industrie de l’IA : ses GPU équipent l’essentiel des datacenters d’entraînement et d’inférence de la planète. Mais Nvidia est aussi devenue un éditeur de modèles avec sa famille Nemotron — des LLM ouverts, optimisés pour ses propres puces.
La stratégie est verticale : vendre les puces, puis les logiciels qui les exploitent au mieux (NIM, NeMo, TensorRT), puis des modèles « vitrines » qui démontrent ce que le matériel peut faire. Les Nemotron sont publiés en poids ouverts sous la NVIDIA Open Model License (usage commercial autorisé) et servis via build.nvidia.com, la plateforme qui agrège aussi des dizaines de modèles tiers en endpoints gratuits ou payants.
Les modèles Nvidia
| Modèle | Type | Fiche Authoritaire |
|---|---|---|
| Nemotron 3 Super | LLM de raisonnement, poids ouverts | NVIDIA Nemotron 3 Super : prix, benchmarks et avis |
| Nemotron 3 Ultra | LLM haut de gamme, poids ouverts | nom seul — fiche à venir |
| Nemotron 3 Nano | LLM compact | nom seul — fiche à venir |
Positionnement : ce qui distingue Nvidia
Nvidia est le seul acteur qui vend à la fois la pelle et le terrain : ses modèles sont co-designés avec son matériel, d’où des performances d’inférence remarquables par dollar sur GPU Nvidia. Pour les équipes qui auto-hébergent déjà sur Nvidia, Nemotron est le choix naturel — d’autant que la licence autorise l’usage commercial et que les poids sont gratuits.
En revanche, Nvidia ne cherche pas à concurrencer ChatGPT ou Claude comme produit grand public : il n’y a pas d’assistant « Nvidia » grand public, et l’offre API gratuite de build.nvidia.com est un banc d’essai pour développeurs (quotas limités), pas une plateforme de production.
Accès et tarifs
| Offre | Prix indicatif | Notes |
|---|---|---|
| build.nvidia.com — endpoints gratuits | 0 $ | 1 000 crédits à l’inscription ; ~40 requêtes/minute ; sans carte bancaire |
| NIM via partenaires cloud | Ex. Nemotron 3 Super : ~0,20 $/0,80 $ par M tokens | Production managée (Bitdeer, CoreWeave, DigitalOcean…) |
| Poids ouverts Nemotron | 0 $ | NVIDIA Open Model License, usage commercial autorisé |
| NIM auto-hébergé | Licence AI Enterprise (~4 500 $/GPU/an) | Production sur sa propre infra |
Catalogue et quotas sur build.nvidia.com.
Notre verdict
Nvidia est le choix des équipes infra : si vous avez déjà des GPU, les Nemotron offrent un excellent rapport performance/coût auto-hébergé, et les endpoints gratuits de build.nvidia.com sont parfaits pour prototyper sans sortir la carte bancaire. Pour un usage « je veux juste une API qui marche », les fournisseurs classiques restent plus simples. Pensez Nemotron quand le contrôle et le coût à l’échelle priment.