Aller au contenu
Matériel

NVIDIA GeForce RTX 5090

Carte graphique grand public la plus rapide (1 792 Go/s) mais limitée à 32 Go : trop peu pour gpt-oss-120b, et vendue 4 200 à 7 400 $ sur le marché en 2026, soit plus qu'un Framework Desktop 128 Go complet.

À vérifier#benchmark#pricingPublié le 16 sept. 2026Mis à jour le 16 sept. 2026Vérifié le 16 sept. 2026À revérifier le 15 déc. 2026

Fiche technique

GPUConstructeur
GeForce RTX 5090 (Blackwell)
Unités de calculEstimation
21 760 cœurs CUDA
ArchitectureConstructeur
GPU discret, PCIe
MémoireConstructeur
32 Go GDDR7 (VRAM dédiée)
Type mémoireConstructeur
GDDR7
Bande passanteEstimation
1 792 Go/s
Mémoire GPU maxConstructeur
32 Go
TDPNon vérifié
575 W (donnée usuelle, non vérifiée dans nos sources)
PrixConstructeur
6 900 $ — Prix de marché relevé le 15/09/2026 (6 899,99 $) ; MSRP 1 999 $ (01/2025) ; fourchette 4 200–7 370 $ juil.–sept. 2026 ; carte seule
DisponibilitéEstimation
Disponible au-dessus du MSRP
LinuxConstructeur
Pilotes NVIDIA propriétaires ; CUDA
ROCmConstructeur
Non applicable (CUDA)

Avantages

  • +1 792 Go/s : 7 fois la bande passante du Strix Halo ; génération très rapide sur les modèles qui tiennent en 32 Go
  • +CUDA, pilotes et outillage sans équivalent

Limites

  • 32 Go : gpt-oss-120b (≈ 61 Go) ne tient pas ; il faudrait deux cartes ou un modèle de 30 Md
  • Prix de marché 4 200 à 7 370 $ pour la carte seule, à quoi s'ajoutent un châssis, une alimentation de 1 000 W et un CPU
  • 575 W : consommation, chaleur et bruit incompatibles avec un placard de cabinet

L'essentiel

  • La RTX 5090 est la référence de la génération sur GPU discret : 32 Go de GDDR7 à 1 792 Go/s, 21 760 cœurs CUDA 1.
  • Elle est hors sujet pour la Box : 32 Go de VRAM excluent gpt-oss-120b et tout modèle de plus de ≈ 30 Md en 4 bits avec un KV cache multi-utilisateurs.
  • Son prix de marché (6 899,99 $ le 15 septembre 2026, fourchette 4 200–7 370 $ depuis juillet) dépasse celui du Framework Desktop 128 Go, pour la carte seule 1.
  • Elle sert de repère de bande passante dans la comparaison : ce que la Box perd en vitesse, elle le gagne en capacité. Statut À vérifier.

Ce que disent les sources

Une seule source, un tracker de prix 1 : MSRP 1 999 $ au lancement (30 janvier 2025), marché 4 200 à 7 370 $ entre juillet et septembre 2026. Les caractéristiques (32 Go, 1 792 Go/s, 21 760 CUDA) y sont reprises de la fiche NVIDIA. Aucun benchmark LLM n'a été relevé dans le cadre de cette recherche ; le TDP de 575 W est une donnée usuelle non vérifiée ici Non vérifié.

Pour la Box

ScénarioFaisable sur RTX 5090 ?
gpt-oss-120b MXFP4 (≈ 61 Go)Non : deux cartes nécessaires (plus de 12 000 $)
Qwen3 30B-A3B Q4 (≈ 18 Go) + KV cache 3 utilisateursOui, très rapide (estimation, non mesuré)
Gemma 3 27B Q4 (≈ 16 Go)Oui
Llama 3.3 70B Q4 (≈ 40 Go)Non

Une Box bâtie sur une RTX 5090 serait plus rapide sur des modèles de 30 Md, mais coûterait plus cher, consommerait 5 fois plus et fermerait la porte aux modèles de 100 Md et plus. Ce compromis ne correspond pas au cahier des charges (voir ADR-002).

Limites et risques

  • Prix volatil et spéculatif ; disponibilité irrégulière.
  • Consommation et bruit : une station avec RTX 5090 dépasse 700 W en charge (estimation) ; refroidissement bruyant.
  • Pilotes propriétaires NVIDIA sous Linux : stables mais hors noyau, mises à jour à gérer.
content/hardware/nvidia-rtx-5090.md377 mots