Aller au contenu
Source

llama.cpp — README de llama-bench

Options et valeurs par défaut de llama-bench : -p 512, -n 128, -d 0, -b 2048, -ub 512, -ctk/-ctv f16, -fa auto, -r 5, sorties csv/json/jsonl/md/sql. N.

Confirmée#benchmark#llama-cppPublié le 16 sept. 2026Mis à jour le 16 sept. 2026
Organisation
ggml-org
Type
GitHub
Fiabilité
Fiabilité haute
Publié
2026 (master)
Consulté le
16 septembre 2026
Sujets
benchmark, llama-cpp

Citée par 3 page(s)

Ce que dit la source

Options et valeurs par défaut de llama-bench : -p 512, -n 128, -d 0, -b 2048, -ub 512, -ctk/-ctv f16, -fa auto, -r 5, sorties csv/json/jsonl/md/sql. Notation pp512, tg128, pp512 @ d4096.

Ce qu'on en retient

Base du protocole mono-séquence du laboratoire : les défauts pp512/tg128 rendent nos mesures comparables aux publications.

Limites

Ne mesure ni le multi-utilisateurs ni le TTFT applicatif.

content/sources/ggml-llama-bench-readme.md67 mots