Aller au contenu
Terme

MXFP4

Format numérique à 4 bits en virgule flottante avec facteurs d'échelle partagés par blocs, utilisé notamment par les modèles gpt-oss pour leurs couches d'experts.

Confirmée#gpt-oss#llama-cppPublié le 16 sept. 2026Mis à jour le 16 sept. 2026

Format numérique à 4 bits en virgule flottante avec facteurs d'échelle partagés par blocs, utilisé notamment par les modèles gpt-oss pour leurs couches d'experts.

modèlesAussi : FP4 à micro-échelle, microscaling FP4

MXFP4 (Microscaling FP4) code chaque poids sur 4 bits, avec une échelle commune à un petit bloc de valeurs. Contrairement aux quantifications appliquées après coup, certains modèles sont entraînés ou publiés directement dans ce format.

Pour la Box, cela signifie qu'un modèle comme gpt-oss-120b est « déjà petit » à sa sortie et qu'il n'y a pas à arbitrer entre plusieurs niveaux de quantification pour ses experts. Le support du format par le backend GPU (Vulkan ou ROCm) est à vérifier.

content/glossary/mxfp4.md81 mots