NPU
Accélérateur spécialisé pour les réseaux de neurones, intégré au processeur, conçu pour des inférences à faible consommation plutôt que pour les grands modèles de langage.
Accélérateur spécialisé pour les réseaux de neurones, intégré au processeur, conçu pour des inférences à faible consommation plutôt que pour les grands modèles de langage.
Le NPU XDNA 2 de Strix Halo est annoncé à environ 50 TOPS (donnée constructeur). Il vise des tâches comme la vision, l'audio ou de petits modèles ; les runtimes LLM grand public ne l'utilisent pas ou peu sous Linux.
Pour la Box, le NPU n'est pas pris en compte dans le dimensionnement : l'inférence LLM repose sur le GPU intégré. Son usage éventuel (OCR, reconnaissance vocale) est une piste à explorer, non une hypothèse de travail.