Aller au contenu
Question· Q-008

Vulkan (RADV) ou ROCm (HIP) pour llama.cpp sur Strix Halo ?

Les sources se contredisent : Vulkan plus simple et parfois plus rapide en génération, ROCm meilleur en prompt processing selon certains ; à mesurer.

À vérifier#vulkan#rocm#llama-cpp#amd#benchmarkPublié le 16 sept. 2026Mis à jour le 16 sept. 2026À revérifier le 15 déc. 2026
Identifiant
Q-008
Statut
Ouverte
Priorité
Haute

Sources contradictoires

Une source 2025 recommande Vulkan partout ; une source d'août 2026 mesure ROCm environ 20 % plus rapide en prompt processing et Vulkan environ 25 % plus rapide en génération ; une troisième juge la différence négligeable. Pour un usage RAG (prompts longs, réponses moyennes), le prompt processing pèse lourd : la réponse n'est pas évidente.

Prochaine étape

Même modèle, même contexte, deux backends, prompts de 512 et 8 000 tokens, sur notre machine.

content/questions/q-008-vulkan-ou-rocm.md76 mots