Benchmark
gpt-oss-120b — LM Studio (runtime ROCm llama.cpp) — environ 30 t/s (MindStudio)
gpt-oss-120b servi par LM Studio avec le runtime ROCm : environ 30 t/s, soit près de la moitié des mesures llama.cpp directes. Contradiction documentée.
À vérifier#benchmark#strix-halo#rocm#gpt-ossPublié le 16 sept. 2026Mis à jour le 16 sept. 2026Vérifié le 16 sept. 2026
Conditions
- Date
- 21 juillet 2026
- Runtime
- LM Studio runtime llama.cpp ROCm (version non relevée)
- Modèle
- gpt-oss-120b (4 bits)
- Quantification
- MXFP4
- Utilisateurs simultanés
- 1
Mesures
- GénérationBenchmark indépendant
- 30 tok/s
Conditions
Test MindStudio du 21 juillet 2026 sur une machine Strix Halo 128 Go : LM Studio avec le runtime llama.cpp ROCm 1. Version, flags, contexte et machine exacte non relevés dans nos notes.
Résultat
Environ 30 t/s en génération. result: degraded traduit l'écart avec la série, pas un échec de l'outil.
Lecture
Sources
- 1Local LLM Speed Test: GPT-OSS, Qwen3.6 and Hermes on 128GB Unified Memory (MindStudio)BenchmarkFiabilité moyenneMindStudio · publié 2026-07-21 · consulté le 16 sept. 2026 · fiche source
- 2Using a Framework Desktop for local AI (blog Framework)Constructeur / éditeurFiabilité moyenneFramework Computer Inc. · Nirav Patel · publié 2025-07-07 (màj 2025-12-02) · consulté le 16 sept. 2026 · fiche source