Source
AMD — binaires llama.cpp validés pour ROCm 7.1.1 (Radeon/Ryzen)
Binaires llama.cpp « AMD-validated » pour gfx1150/gfx1151, ROCm 7.1.1, Ubuntu 24.04, incluant llama-server, llama-bench et llama-cli.
- Organisation
- AMD
- Type
- Documentation officielle
- Fiabilité
- Fiabilité haute
- Publié
- 2025–2026
- Consulté le
- 16 septembre 2026
- Sujets
- rocm, llama-cpp, strix-halo
Citée par 2 page(s)
Inférence : panorama des moteursInférence · Comparaison des moteurs de serving (llama-server, Ollama, LM Studio, vLLM, SGLang, Lemonade) pour un Strix Halo sous Linux, et recommandation initiale prudente : llama-server d'abord, vLLM à évaluer.llama.cpp et llama-serverInférence · Le moteur de départ de la Box : slots, contexte partagé, KV cache quantifié, flash attention, métriques Prometheus, images Docker ROCm/Vulkan et flags connus pour gfx1151.
Ce que dit la source
Binaires llama.cpp « AMD-validated » pour gfx1150/gfx1151, ROCm 7.1.1, Ubuntu 24.04, incluant llama-server, llama-bench et llama-cli.
Ce qu'on en retient
AMD supporte explicitement llama.cpp sur la puce cible.
Limites
Liés à une version ROCm précise (7.1.1).