Expérimentation
Mesurer la mémoire GPU allouable sur le Framework Desktop
Établir combien de Go de GTT le GPU gfx1151 peut utiliser de façon stable sous Linux (108 ? 120 ?) avec BIOS 3.06 et noyau 6.18.4+, et le comportement à l'échec.
En test#amd#strix-halo#linux#rocm#vulkan#benchmarkPublié le 16 sept. 2026Mis à jour le 16 sept. 2026
- Statut du test
- À tester
- Priorité
- Haute
- Prévu pour
- Octobre 2026
- Hypothèse
- Avec BIOS 3.06, UMA à 512 Mo, noyau 6.18.4+ et ttm.pages_limit fixé via amd-ttm, le GPU peut allouer au moins 100 Go de façon stable ; gpt-oss-120b MXFP4 se charge avec 32k tokens de contexte pour 4 slots.
- Procédure
- 1) BIOS 3.06+, UMA minimum. 2) Relever noyau, firmware, modules présents dans /sys/module (ttm, amdttm, amdgpu) et valeur par défaut de pages_limit. 3) amd-ttm --set 100 ; vérifier ; redémarrer ; vérifier la persistance. 4) Charger avec llama.cpp Vulkan puis ROCm des modèles de taille croissante et gpt-oss-120b avec contexte croissant jusqu'à l'échec ; noter le type d'échec (OOM, segfault, hard lock). 5) Répéter à 110 puis 120 Go. 6) Consigner BIOS, noyau, firmware, paramètre, allocation maximale stable.
- Prochaine action
- Recevoir la machine, mettre le BIOS à jour, installer la distribution retenue (Q-007) ou Fedora 43 par défaut.
Pourquoi
La mémoire GPU allouable décide du modèle principal et du nombre d'utilisateurs simultanés. Les sources donnent 108 Go (août 2025, segfaults à 110 Go) 2 ou 120 Go (2026) 3 ; AMD documente la méthode sans plafond 1. Le BIOS 3.06 a corrigé un plafond à 24 Go 4. Aucune mesure n'existe sur notre configuration.
Variables à consigner
| Variable | Valeur |
|---|---|
| BIOS | à relever |
| UMA Frame Buffer | à relever |
| Distribution, noyau, linux-firmware | à relever |
Modules présents (ttm, amdttm, amdgpu) | à relever |
pages_limit par défaut puis fixé | à relever |
| Backend llama.cpp et version | à relever |
| Allocation maximale stable (Go) | à mesurer |
| Type d'échec au-delà | à décrire |
Critère de succès
Au moins 100 Go allouables ; gpt-oss-120b MXFP4 chargé avec 32k tokens de contexte pour 4 slots, 1 heure sans erreur. En dessous de 96 Go stables : revoir le modèle principal ou la machine.
Résultat
À venir.
Sources
- 1AMD Strix Halo / RDNA3.5 system optimization (ROCm 10.0)Documentation officielleFiabilité hauteAMD · publié 2026 · consulté le 16 sept. 2026 · fiche source
- 2Increasing the VRAM allocation on AMD AI APUs under Linux (Jeff Geerling)BlogFiabilité moyennejeffgeerling.com · Jeff Geerling · publié 2025-08-08 · consulté le 16 sept. 2026 · fiche source
- 3strix-halo-guide (README + BENCHMARKS.md)GitHubFiabilité moyenneGitHub (communauté) · hogeheer499 · publié 2026-03 → 2026-08-30 · consulté le 16 sept. 2026 · fiche source
- 4Framework Desktop AMD Ryzen AI Max 300 — BIOS & Drivers (notes de version)Documentation officielleFiabilité hauteFramework Computer Inc. · publié 2026-08-03 (BIOS 3.06) · consulté le 16 sept. 2026 · fiche source