Aller au contenu
Expérimentation

Mesurer la mémoire GPU allouable sur le Framework Desktop

Établir combien de Go de GTT le GPU gfx1151 peut utiliser de façon stable sous Linux (108 ? 120 ?) avec BIOS 3.06 et noyau 6.18.4+, et le comportement à l'échec.

En test#amd#strix-halo#linux#rocm#vulkan#benchmarkPublié le 16 sept. 2026Mis à jour le 16 sept. 2026
Statut du test
À tester
Priorité
Haute
Prévu pour
Octobre 2026
Hypothèse
Avec BIOS 3.06, UMA à 512 Mo, noyau 6.18.4+ et ttm.pages_limit fixé via amd-ttm, le GPU peut allouer au moins 100 Go de façon stable ; gpt-oss-120b MXFP4 se charge avec 32k tokens de contexte pour 4 slots.
Procédure
1) BIOS 3.06+, UMA minimum. 2) Relever noyau, firmware, modules présents dans /sys/module (ttm, amdttm, amdgpu) et valeur par défaut de pages_limit. 3) amd-ttm --set 100 ; vérifier ; redémarrer ; vérifier la persistance. 4) Charger avec llama.cpp Vulkan puis ROCm des modèles de taille croissante et gpt-oss-120b avec contexte croissant jusqu'à l'échec ; noter le type d'échec (OOM, segfault, hard lock). 5) Répéter à 110 puis 120 Go. 6) Consigner BIOS, noyau, firmware, paramètre, allocation maximale stable.
Prochaine action
Recevoir la machine, mettre le BIOS à jour, installer la distribution retenue (Q-007) ou Fedora 43 par défaut.

Pourquoi

La mémoire GPU allouable décide du modèle principal et du nombre d'utilisateurs simultanés. Les sources donnent 108 Go (août 2025, segfaults à 110 Go) 2 ou 120 Go (2026) 3 ; AMD documente la méthode sans plafond 1. Le BIOS 3.06 a corrigé un plafond à 24 Go 4. Aucune mesure n'existe sur notre configuration.

Variables à consigner

VariableValeur
BIOSà relever
UMA Frame Bufferà relever
Distribution, noyau, linux-firmwareà relever
Modules présents (ttm, amdttm, amdgpu)à relever
pages_limit par défaut puis fixéà relever
Backend llama.cpp et versionà relever
Allocation maximale stable (Go)à mesurer
Type d'échec au-delàà décrire

Critère de succès

Au moins 100 Go allouables ; gpt-oss-120b MXFP4 chargé avec 32k tokens de contexte pour 4 slots, 1 heure sans erreur. En dessous de 96 Go stables : revoir le modèle principal ou la machine.

Résultat

À venir.

Sources

  1. 1AMD Strix Halo / RDNA3.5 system optimization (ROCm 10.0)Documentation officielleFiabilité hauteAMD · publié 2026 · consulté le 16 sept. 2026 · fiche source
  2. 2Increasing the VRAM allocation on AMD AI APUs under Linux (Jeff Geerling)BlogFiabilité moyennejeffgeerling.com · Jeff Geerling · publié 2025-08-08 · consulté le 16 sept. 2026 · fiche source
  3. 3strix-halo-guide (README + BENCHMARKS.md)GitHubFiabilité moyenneGitHub (communauté) · hogeheer499 · publié 2026-03 → 2026-08-30 · consulté le 16 sept. 2026 · fiche source
  4. 4Framework Desktop AMD Ryzen AI Max 300 — BIOS & Drivers (notes de version)Documentation officielleFiabilité hauteFramework Computer Inc. · publié 2026-08-03 (BIOS 3.06) · consulté le 16 sept. 2026 · fiche source
content/experiments/mesurer-memoire-gpu-allouable.md163 mots