NPU
Neural Processing Unit: un coprocesador dedicado optimizado para el cálculo matricial de la inferencia de redes neuronales. Presente en los SoC de smartphone modernos, las CPU de portátil y los PC Copilot+.
Una NPU ejecuta cargas de ML con mucho menos consumo del que pueden lograr una CPU o una GPU. Las NPU de smartphone ejecutan funciones como la fotografía computacional, la traducción en el dispositivo y el reconocimiento de voz de forma continua sin agotar la batería.
En portátiles
- Apple Neural Engine: 38 TOPS en la generación M5.
- Qualcomm Hexagon (X Elite/X2): 45–80 TOPS.
- Intel AI Boost (Lunar Lake / Panther Lake): 48+ TOPS.
- AMD XDNA 2 (Ryzen AI 300/400): 50+ TOPS.
Qué habilita
Los Windows Studio Effects (desenfoque de fondo, contacto visual, encuadre automático) se ejecutan en la NPU en lugar de en la CPU/GPU, liberando estas para trabajo productivo. En macOS, los subtítulos en directo, el dictado y la segmentación de imágenes se ejecutan en el Neural Engine.
NPU frente a GPU
Las NPU son más eficientes por vatio; las GPU tienen un rendimiento mucho mayor. Las cargas de IA generativa pesadas (Stable Diffusion, LLM grandes) siguen favoreciendo una GPU.