Source
Qwen/Qwen3-32B — fiche modèle
Dense 32,8 Md, 64 couches, GQA 64/8, contexte 32 768 natif (131 072 avec YaRN), Apache 2.0, plus de 100 langues, modes thinking / non-thinking.
- Organisation
- Alibaba Qwen
- Type
- Documentation officielle
- Fiabilité
- Fiabilité haute
- Publié
- 2025-04
- Consulté le
- 16 septembre 2026
- Sujets
- qwen
Citée par 2 page(s)
KV cache : calcul et dimensionnementMulti-utilisateurs · Formule du KV cache, effet de GQA et MLA, quantification q8_0/q4_0, tableau d'estimations pour gpt-oss-120b, Qwen3-30B-A3B et Llama 70B à 8k/32k/128k, et impact du nombre de slots sur la mémoire.Qwen3-32BModèle · Dense Alibaba de 32,8 Md, Apache 2.0, contexte 32k natif : référence dense de taille moyenne, plus lente qu'un MoE mais avec un mode raisonnement.
Ce que dit la source
Dense 32,8 Md, 64 couches, GQA 64/8, contexte 32 768 natif (131 072 avec YaRN), Apache 2.0, plus de 100 langues, modes thinking / non-thinking.
Ce qu'on en retient
Référence dense de taille moyenne ; contexte natif limité à 32k.