Source
Ollama — compatibilité API OpenAI
Endpoints /v1/chat/completions, /v1/completions, /v1/embeddings, /v1/models, /v1/responses ; tools, streaming, JSON mode, vision ; logprobs non suppor.
- Organisation
- Ollama
- Type
- Documentation officielle
- Fiabilité
- Fiabilité haute
- Publié
- 2026
- Consulté le
- 16 septembre 2026
- Sujets
- ollama
Citée par 2 page(s)
Inférence : panorama des moteursInférence · Comparaison des moteurs de serving (llama-server, Ollama, LM Studio, vLLM, SGLang, Lemonade) pour un Strix Halo sous Linux, et recommandation initiale prudente : llama-server d'abord, vLLM à évaluer.Ollama, LM Studio, Lemonade : les moteurs « faciles »Inférence · Trois surcouches de llama.cpp orientées simplicité : variables de parallélisme d'Ollama, requêtes concurrentes de LM Studio, Lemonade porté par AMD ; limites pour un serveur multi-utilisateurs.
Ce que dit la source
Endpoints /v1/chat/completions, /v1/completions, /v1/embeddings, /v1/models, /v1/responses ; tools, streaming, JSON mode, vision ; logprobs non supporté.
Ce qu'on en retient
Compatible avec Open WebUI et LibreChat sans adaptation.
Limites
Compatibilité partielle : certains champs OpenAI sont ignorés.