NPU
Neural Processing Unit — ein dedizierter Co-Prozessor, optimiert für die Matrizenmathematik der Inferenz neuronaler Netze. Zu finden in modernen Smartphone-SoCs, Laptop-CPUs und Copilot+-PCs.
Eine NPU führt ML-Workloads bei viel geringerem Stromverbrauch aus, als CPU oder GPU es können. Smartphone-NPUs führen Funktionen wie Computational Photography, On-Device-Übersetzung und Spracherkennung durchgängig aus, ohne den Akku zu leeren.
In Laptops
- Apple Neural Engine — 38 TOPS in der M5-Generation.
- Qualcomm Hexagon (X Elite/X2) — 45–80 TOPS.
- Intel AI Boost (Lunar Lake / Panther Lake) — 48+ TOPS.
- AMD XDNA 2 (Ryzen AI 300/400) — 50+ TOPS.
Was es ermöglicht
Windows Studio Effects (Hintergrundunschärfe, Augenkontakt, Auto-Framing) laufen auf der NPU statt auf CPU/GPU und halten diese für produktive Arbeit frei. Unter macOS laufen Live Captions, Diktat und Bildsegmentierung allesamt auf der Neural Engine.
NPU vs. GPU
NPUs sind effizienter pro Watt; GPUs haben einen weit höheren Durchsatz. Schwere generative KI-Workloads (Stable Diffusion, große LLMs) bevorzugen weiterhin eine GPU.