Source
Strix Halo Wiki — llama.cpp Performance (kyuz0)
ConfirméePublié le 16 sept. 2026Mis à jour le 16 sept. 2026
- Organisation
- strixhalo.wiki
- Auteur
- kyuz0
- Type
- Blog
- Fiabilité
- Fiabilité moyenne
- Publié
- 2025–2026
- Consulté le
- 16 septembre 2026
- Sujets
- strix-halo, llama-cpp, vulkan, rocm, benchmark
Citée par 3 page(s)
ROCm et Vulkan sur gfx1151Linux · État du support ROCm pour le GPU Strix Halo (gfx1151), officiel depuis ROCm 7.13 preview et 10.0 stable, et comparaison Vulkan/RADV contre ROCm/HIP pour llama.cpp, avec des sources contradictoires.Framework Desktop (Ryzen AI Max+ 395, 128 Go)Matériel · Machine candidate de la Box IA : APU AMD Strix Halo avec 128 Go de mémoire unifiée, compacte et silencieuse, mais dont le support ROCm n'est officiel que depuis août 2026 et dont la stabilité sous forte charge GPU reste à démontrer.Comparer Vulkan/RADV et ROCm/HIP dans llama.cppExpérimentation · Mesurer sur nos modèles cibles et nos longueurs de prompt RAG le débit de prompt processing et de génération des deux backends GPU de llama.cpp, pour trancher Q-008.
Ce que dit la source
Qwen3 30B-A3B UD-Q4_K_XL : ROCm pp512 650,6 / tg128 64,2 (rocWMMA), 659,1 / 67,7 (tuned) ; Vulkan RADV pp 755,1 / tg 85,1 ; AMDVLK 741,6 / 81,8. Conseil : tester soi-même, les pilotes évoluent constamment.
Ce qu'on en retient
Vulkan RADV devant ROCm sur ce modèle MoE, en pp comme en tg.
Limites
Wiki communautaire, versions non toujours précisées.