Aller au contenu
Source

The 2026 Strix Halo Ultimate Benchmark Suite (dev.to)

ConfirméePublié le 16 sept. 2026Mis à jour le 16 sept. 2026
Organisation
dev.to
Auteur
Agustin Sacco
Type
Benchmark
Fiabilité
Fiabilité moyenne
Publié
2026-05-31
Consulté le
16 septembre 2026
Sujets
strix-halo, llama-cpp, vulkan, benchmark, qwen

Citée par 4 page(s)

Ce que dit la source

llama.cpp Vulkan, ROCm 7.2.2 : Qwen 3.6 27B dense Q4_K_XL tg 11,8 t/s (20,0 avec MTP) ; Qwen 3.5 122B MoE Q4_K_M tg 23,2 (24,4 MTP) à 32k de contexte.

Ce qu'on en retient

Ordre de grandeur pour un 27B dense (≈ 12 t/s) faute de chiffre Gemma 3 27B.

Limites

Modèles Qwen 3.5/3.6 non retenus dans le dossier ; MTP est une optimisation spécifique.

content/sources/devto-sacco-strix-halo-benchmark-suite.md70 mots