Question· Q-008
Vulkan (RADV) ou ROCm (HIP) pour llama.cpp sur Strix Halo ?
Les sources se contredisent : Vulkan plus simple et parfois plus rapide en génération, ROCm meilleur en prompt processing selon certains ; à mesurer.
À vérifier#vulkan#rocm#llama-cpp#amd#benchmarkPublié le 16 sept. 2026Mis à jour le 16 sept. 2026À revérifier le 15 déc. 2026
- Identifiant
- Q-008
- Statut
- Ouverte
- Priorité
- Haute
Sources contradictoires
Une source 2025 recommande Vulkan partout ; une source d'août 2026 mesure ROCm environ 20 % plus rapide en prompt processing et Vulkan environ 25 % plus rapide en génération ; une troisième juge la différence négligeable. Pour un usage RAG (prompts longs, réponses moyennes), le prompt processing pèse lourd : la réponse n'est pas évidente.
Prochaine étape
Même modèle, même contexte, deux backends, prompts de 512 et 8 000 tokens, sur notre machine.