Aller au contenu
Source

Guide officiel llama.cpp : running gpt-oss (#15396)

Tailles GGUF : gpt-oss-20b 11,27 Go, gpt-oss-120b 59,02 Go ; mémoire d'environ 64 Go pour le 120b ; lancement avec --jinja, -c, -np et chat-template-k.

Confirmée#gpt-oss#llama-cppPublié le 16 sept. 2026Mis à jour le 16 sept. 2026
Organisation
ggml-org
Auteur
Georgi Gerganov
Type
GitHub
Fiabilité
Fiabilité haute
Publié
2025-08
Consulté le
16 septembre 2026
Sujets
gpt-oss, llama-cpp

Citée par 4 page(s)

Ce que dit la source

Tailles GGUF : gpt-oss-20b 11,27 Go, gpt-oss-120b 59,02 Go ; mémoire d'environ 64 Go pour le 120b ; lancement avec --jinja, -c, -np et chat-template-kwargs reasoning_effort.

Ce qu'on en retient

Référence pour l'empreinte mémoire de gpt-oss sous llama.cpp et pour le format harmony via --jinja.

Limites

Guide d'août 2025 ; les flags peuvent avoir évolué.

content/sources/ggml-guide-gpt-oss.md60 mots