Tag
#amd
34 entrée(s) portent ce tag.
Pages
6
Comparaisons matériellesComparaisons · Lecture guidée du tableau comparatif des machines : bande passante, mémoire adressable, prix par Go de mémoire GPU, consommation, écosystème logiciel, bruit et disponibilité, avec l'origine de chaque donnée et une conclusion prudente sur le choix du Framework Desktop.16 sept. 2026Linux : vue d'ensembleLinux · Rôle du système serveur de la Box, choix de distribution (Fedora, Ubuntu, Debian, Bazzite) face au support Framework et à la matrice ROCm, noyau requis, pilotes, conteneurs, mises à jour et rollback, administration distante.16 sept. 2026Mémoire GPU allouable sous LinuxLinux · Comment dépasser les 64 Go de GTT par défaut sur Strix Halo (UMA BIOS, ttm.pages_limit, amd-ttm), avec les plafonds observés (108 et 120 Go), les paramètres contradictoires et la procédure de mesure à réaliser.16 sept. 2026ROCm et Vulkan sur gfx1151Linux · État du support ROCm pour le GPU Strix Halo (gfx1151), officiel depuis ROCm 7.13 preview et 10.0 stable, et comparaison Vulkan/RADV contre ROCm/HIP pour llama.cpp, avec des sources contradictoires.16 sept. 2026Stabilité et problèmes connusLinux · Inventaire sourcé des problèmes de fiabilité rapportés sur Strix Halo et Framework Desktop sous Linux (crashs GPU, VGPR, MES ring timeout, xHCI/s2idle, USB-C, BIOS, NIC Beelink) avec leur état et les contournements.16 sept. 2026Monitoring : ce que l'on surveille et commentMonitoring · Métriques système, GPU, inférence et applicatives ; pile proposée (node_exporter, amd-smi, llama-server --metrics, Prometheus, Grafana, Uptime Kuma) et alternatives simples ; seuils d'alerte et tableau de bord type.16 sept. 2026
Matériel
4
Beelink GTR9 Pro (Ryzen AI Max+ 395, 128 Go)Matériel · Mini-PC Strix Halo 128 Go avec deux ports 10 GbE Intel E610, machine de référence des guides communautaires Linux, mais dont les cartes réseau plantent sous charge selon des utilisateurs et dont le prix a plus que doublé (4 349 $ en août 2026).16 sept. 2026Framework Desktop (Ryzen AI Max+ 395, 128 Go)Matériel · Machine candidate de la Box IA : APU AMD Strix Halo avec 128 Go de mémoire unifiée, compacte et silencieuse, mais dont le support ROCm n'est officiel que depuis août 2026 et dont la stabilité sous forte charge GPU reste à démontrer.16 sept. 2026GMKtec EVO-X2 (Ryzen AI Max+ 395, 128 Go)Matériel · Mini-PC Strix Halo 128 Go au même silicium que le Framework Desktop, plus cher en août 2026 (3 649,99 $), limité au 2,5 GbE et décrit comme bruyant.16 sept. 2026HP Z2 Mini G1a (Ryzen AI Max+ PRO 395, 128 Go)Matériel · Station compacte HP sur Strix Halo PRO : seule machine 128 Go de la famille à annoncer de la mémoire ECC et un support professionnel, à un prix proche du Framework (3 342 à 3 734 $).16 sept. 2026
Décisions
3
Utiliser Linux comme système du serveur IADécision · Le serveur Box IA tourne sous Linux ; les utilisateurs n'y touchent jamais et passent par un navigateur.16 sept. 2026Retenir le Framework Desktop Ryzen AI Max+ 395 / 128 Go comme machine candidateDécision · Machine de référence pour le prototype et le POC ; le choix sera confirmé ou infirmé par nos benchmarks.16 sept. 2026Démarrer avec llama.cpp (llama-server) comme runtime d'inférenceDécision · Runtime initial du prototype : llama-server, API OpenAI-compatible, slots parallèles ; vLLM sera évalué ensuite.16 sept. 2026
Questions
5
Quel runtime d'inférence est le plus performant sur AMD Strix Halo ?Question · llama.cpp est le point de départ (ADR-004) ; vLLM et SGLang sur ROCm restent à évaluer pour le multi-utilisateur.16 sept. 2026Quelle distribution Linux pour la Box ?Question · Fedora (support Framework, noyau récent) contre Ubuntu LTS (support ROCm officiel, stabilité longue) ; Debian et Bazzite en second rang.16 sept. 2026Vulkan (RADV) ou ROCm (HIP) pour llama.cpp sur Strix Halo ?Question · Les sources se contredisent : Vulkan plus simple et parfois plus rapide en génération, ROCm meilleur en prompt processing selon certains ; à mesurer.16 sept. 2026Combien de mémoire GPU peut-on réellement allouer sur 128 Go ?Question · Les retours vont de 96 Go (UMA BIOS) à 108 ou 120 Go via paramètres noyau ; la valeur stable sur notre machine est à mesurer.16 sept. 2026La plateforme Strix Halo est-elle assez stable pour un serveur 24 h/24 ?Question · Des blocages sous charge GPU et des problèmes de reprise sont rapportés depuis mars 2026 ; un test d'endurance sur notre machine est indispensable avant tout client.16 sept. 2026
Sources
2
Lemonade Server — FAQSource · Licence Apache 2.0 ; projet communautaire avec optimisations d'ingénieurs AMD ; backends llama.cpp (Vulkan/ROCm/CPU/Metal), OnnxRuntime GenAI (NPU), F.16 sept. 2026Ollama — support matériel GPUSource · Ollama s'appuie sur ROCm ; Vulkan en complément sous Windows et Linux ; gfx1151 (Ryzen AI Max+ 395) listé supporté sous Linux.16 sept. 2026
Glossaire
11
Bande passante mémoireTerme · Quantité de données que le processeur ou le GPU peut lire en mémoire par seconde, exprimée en gigaoctets par seconde ; elle borne la vitesse de génération d'un modèle de langage.16 sept. 2026GTT (Graphics Translation Table)Terme · Mécanisme du pilote graphique Linux (amdgpu, via TTM) qui permet au GPU d'adresser de la mémoire système au-delà de la réservation fixée dans le BIOS.16 sept. 2026HIPTerme · Interface de programmation GPU d'AMD, proche de CUDA, qui fait partie de ROCm et permet de compiler le même code pour GPU AMD et NVIDIA.16 sept. 2026Mémoire unifiéeTerme · Architecture dans laquelle le processeur et le processeur graphique partagent la même mémoire physique, ce qui permet au GPU d'utiliser une grande partie de la RAM du système pour charger un modèle.16 sept. 2026NPUTerme · Accélérateur spécialisé pour les réseaux de neurones, intégré au processeur, conçu pour des inférences à faible consommation plutôt que pour les grands modèles de langage.16 sept. 2026RADVTerme · Pilote Vulkan open source pour GPU AMD inclus dans Mesa, livré par défaut avec les distributions Linux.16 sept. 2026ROCmTerme · Pile logicielle open source d'AMD pour le calcul sur GPU (pilotes, bibliothèques, compilateur HIP), équivalent de CUDA chez NVIDIA.16 sept. 2026Strix HaloTerme · Nom de code de la famille de processeurs AMD Ryzen AI Max, qui réunit sur une même puce des cœurs Zen 5, un GPU intégré RDNA 3.5 de grande taille (Radeon 8060S) et un NPU, avec jusqu'à 128 Go de mémoire unifiée LPDDR5X.16 sept. 2026TDPTerme · Puissance thermique de conception d'un processeur, en watts, que le système de refroidissement doit dissiper ; souvent configurable (cTDP) dans une plage définie par le fabricant.16 sept. 2026VRAMTerme · Mémoire dédiée au processeur graphique, dans laquelle doivent résider les poids du modèle et le KV cache pour une inférence rapide sur GPU.16 sept. 2026VulkanTerme · API graphique et de calcul multiplateforme, ouverte, utilisée par llama.cpp comme backend GPU indépendant du fabricant, disponible sur AMD via les pilotes Mesa.16 sept. 2026