Aller au contenu
Benchmark

gpt-oss-120b — LM Studio (runtime ROCm llama.cpp) — environ 30 t/s (MindStudio)

gpt-oss-120b servi par LM Studio avec le runtime ROCm : environ 30 t/s, soit près de la moitié des mesures llama.cpp directes. Contradiction documentée.

À vérifier#benchmark#strix-halo#rocm#gpt-ossPublié le 16 sept. 2026Mis à jour le 16 sept. 2026Vérifié le 16 sept. 2026
Benchmark indépendantRésultat : DégradéSérie : strix-halo-gpt-oss-120bsource de la mesure

Conditions

Date
21 juillet 2026
Runtime
LM Studio runtime llama.cpp ROCm (version non relevée)
Quantification
MXFP4
Utilisateurs simultanés
1

Mesures

GénérationBenchmark indépendant
30 tok/s

Conditions

Test MindStudio du 21 juillet 2026 sur une machine Strix Halo 128 Go : LM Studio avec le runtime llama.cpp ROCm 1. Version, flags, contexte et machine exacte non relevés dans nos notes.

Résultat

Environ 30 t/s en génération. result: degraded traduit l'écart avec la série, pas un échec de l'outil.

Lecture

content/benchmarks/2026-07-21-gpt-oss-120b-lm-studio-rocm-mindstudio.md111 mots