Source
AMD Strix Halo / RDNA3.5 system optimization (ROCm 10.0)
ConfirméePublié le 16 sept. 2026Mis à jour le 16 sept. 2026
- Organisation
- AMD
- Type
- Documentation officielle
- Fiabilité
- Fiabilité haute
- Publié
- 2026
- Consulté le
- 16 septembre 2026
- Sujets
- rocm, amd, strix-halo, gtt, linux
Citée par 9 page(s)
Inférence : panorama des moteursInférence · Comparaison des moteurs de serving (llama-server, Ollama, LM Studio, vLLM, SGLang, Lemonade) pour un Strix Halo sous Linux, et recommandation initiale prudente : llama-server d'abord, vLLM à évaluer.Linux : vue d'ensembleLinux · Rôle du système serveur de la Box, choix de distribution (Fedora, Ubuntu, Debian, Bazzite) face au support Framework et à la matrice ROCm, noyau requis, pilotes, conteneurs, mises à jour et rollback, administration distante.Installation reproductibleLinux · Canevas d'installation du serveur Linux de la Box, du BIOS aux conteneurs, présenté étape par étape avec, pour chacune, l'indication de ce qui est sourcé et de ce qui reste à valider sur la machine.Mémoire GPU allouable sous LinuxLinux · Comment dépasser les 64 Go de GTT par défaut sur Strix Halo (UMA BIOS, ttm.pages_limit, amd-ttm), avec les plafonds observés (108 et 120 Go), les paramètres contradictoires et la procédure de mesure à réaliser.ROCm et Vulkan sur gfx1151Linux · État du support ROCm pour le GPU Strix Halo (gfx1151), officiel depuis ROCm 7.13 preview et 10.0 stable, et comparaison Vulkan/RADV contre ROCm/HIP pour llama.cpp, avec des sources contradictoires.KV cache : calcul et dimensionnementMulti-utilisateurs · Formule du KV cache, effet de GQA et MLA, quantification q8_0/q4_0, tableau d'estimations pour gpt-oss-120b, Qwen3-30B-A3B et Llama 70B à 8k/32k/128k, et impact du nombre de slots sur la mémoire.Framework Desktop (Ryzen AI Max+ 395, 128 Go)Matériel · Machine candidate de la Box IA : APU AMD Strix Halo avec 128 Go de mémoire unifiée, compacte et silencieuse, mais dont le support ROCm n'est officiel que depuis août 2026 et dont la stabilité sous forte charge GPU reste à démontrer.Mesurer la mémoire GPU allouable sur le Framework DesktopExpérimentation · Établir combien de Go de GTT le GPU gfx1151 peut utiliser de façon stable sous Linux (108 ? 120 ?) avec BIOS 3.06 et noyau 6.18.4+, et le comportement à l'échec.Valider l'installation reproductibleExpérimentation · Réinstaller la Box de zéro en suivant uniquement la page Installation et le dépôt de configuration, et vérifier que l'état obtenu est identique au premier, pour transformer le canevas en procédure.
Ce que dit la source
Guide officiel : mémoire physiquement partagée (GART vs GTT) ; GTT limité par défaut à ≈ 50 % de la RAM ; recommandation de garder la réservation VRAM BIOS petite (0,5 Go) et d'augmenter la limite TTM/GTT ; paramètre /sys/module/ttm/parameters/pages_limit (pages de 4 Kio) ; outil amd-ttm (pipx install amd-debug-tools ; amd-ttm --set 100) ; prérequis noyau 6.18.4+ ; Fedora 43, Ubuntu 26.04, Arch listés stables ; tableau mentionnant ROCm 7.11.0/7.12.0 et 7.2.1–7.2.3 comme stables avec noyaux recommandés.
Ce qu'on en retient
Procédure d'allocation mémoire GPU de référence (préfixe ttm., outil amd-ttm) et exigence de noyau 6.18.4+.
Limites
L'exemple « 100 Go » n'est pas un plafond documenté ; aucune valeur maximale garantie n'est donnée.