Source
Using a Framework Desktop for local AI (blog Framework)
ConfirméePublié le 16 sept. 2026Mis à jour le 16 sept. 2026
- Organisation
- Framework Computer Inc.
- Auteur
- Nirav Patel
- Type
- Constructeur / éditeur
- Fiabilité
- Fiabilité moyenne
- Publié
- 2025-07-07 (màj 2025-12-02)
- Consulté le
- 16 septembre 2026
- Sujets
- hardware, framework, benchmark, gpt-oss
Citée par 5 page(s)
Ollama, LM Studio, Lemonade : les moteurs « faciles »Inférence · Trois surcouches de llama.cpp orientées simplicité : variables de parallélisme d'Ollama, requêtes concurrentes de LM Studio, Lemonade porté par AMD ; limites pour un serveur multi-utilisateurs.Framework Desktop (Ryzen AI Max+ 395, 128 Go)Matériel · Machine candidate de la Box IA : APU AMD Strix Halo avec 128 Go de mémoire unifiée, compacte et silencieuse, mais dont le support ROCm n'est officiel que depuis août 2026 et dont la stabilité sous forte charge GPU reste à démontrer.gpt-oss-120bModèle · MoE OpenAI de 117 Md (5,1 Md actifs) sous Apache 2.0 : le candidat principal de la Box, mesuré entre 30 et 56 t/s sur Strix Halo selon le runtime.Mistral Small 3.2 (24B, 2506)Modèle · Dense 24 Md de Mistral AI, Apache 2.0, vision et function calling : l'option « éditeur français » de taille moyenne, environ 10 à 12 t/s en Q6 selon Framework.gpt-oss-120b — LM Studio (runtime ROCm llama.cpp) — environ 30 t/s (MindStudio)Benchmark · gpt-oss-120b servi par LM Studio avec le runtime ROCm : environ 30 t/s, soit près de la moitié des mesures llama.cpp directes. Contradiction documentée.
Ce que dit la source
Billet constructeur : 256 Go/s de bande passante sur toutes les configurations ; jusqu'à 16 To de stockage ; chiffres LM Studio indicatifs (gpt-oss-120b 4 bits ≈ 40 t/s Windows / 48 t/s Linux ; Mistral Small 3.2 24B Q6_K ≈ 10 / 12 t/s).
Ce qu'on en retient
Ordre de grandeur constructeur pour gpt-oss-120b ; Linux annoncé plus rapide que Windows par le constructeur lui-même.
Limites
Chiffres promotionnels, conditions de mesure (backend, contexte, version) non détaillées.