NPU
Neural Processing Unit — um coprocessador dedicado otimizado para a matemática de matrizes da inferência de redes neurais. Encontrado em SoCs de smartphone modernos, CPUs de notebook e PCs Copilot+.
Uma NPU executa cargas de ML com consumo muito menor do que uma CPU ou GPU conseguem. NPUs de smartphone rodam recursos como fotografia computacional, tradução no dispositivo e reconhecimento de voz continuamente sem esgotar a bateria.
Em notebooks
- Apple Neural Engine — 38 TOPS na geração M5.
- Qualcomm Hexagon (X Elite/X2) — 45–80 TOPS.
- Intel AI Boost (Lunar Lake / Panther Lake) — 48+ TOPS.
- AMD XDNA 2 (Ryzen AI 300/400) — 50+ TOPS.
O que ela viabiliza
Os Windows Studio Effects (desfoque de fundo, contato visual, auto-enquadramento) rodam na NPU em vez da CPU/GPU, liberando-as para trabalho produtivo. No macOS, Live Captions, ditado e segmentação de imagem rodam no Neural Engine.
NPU vs GPU
NPUs são mais eficientes por watt; GPUs têm throughput muito maior. Cargas pesadas de IA generativa (Stable Diffusion, LLMs grandes) ainda favorecem uma GPU.