Tag
#lemonade
5 entrée(s) portent ce tag.
Pages
2
Inférence : panorama des moteursInférence · Comparaison des moteurs de serving (llama-server, Ollama, LM Studio, vLLM, SGLang, Lemonade) pour un Strix Halo sous Linux, et recommandation initiale prudente : llama-server d'abord, vLLM à évaluer.16 sept. 2026Ollama, LM Studio, Lemonade : les moteurs « faciles »Inférence · Trois surcouches de llama.cpp orientées simplicité : variables de parallélisme d'Ollama, requêtes concurrentes de LM Studio, Lemonade porté par AMD ; limites pour un serveur multi-utilisateurs.16 sept. 2026
Sources
3
Lemonade Server — FAQSource · Licence Apache 2.0 ; projet communautaire avec optimisations d'ingénieurs AMD ; backends llama.cpp (Vulkan/ROCm/CPU/Metal), OnnxRuntime GenAI (NPU), F.16 sept. 2026lemonade-sdk/lemonade — dépôt GitHubSource · API OpenAI sur http://localhost:13305/v1 ; installeurs .deb/.rpm/Snap/Arch et Docker ; vLLM « expérimental, ROCm for Strix Halo » ; Apache 2.0.16 sept. 2026Lemonade Server — options du backend llama.cppSource · Canal ROCm stable (lemonade-sdk/llama.cpp) ou nightly (lemonade-sdk/llamacpp-rocm) avec builds par architecture dont gfx1151 ; commande lemonade confi.16 sept. 2026