
Weil Edge-KI-Budgets inzwischen echtes Geld sind. Der Markt für Edge-KI-Hardware erreichte 26,14 Milliarden US-Dollar im Jahr 2025 und soll bis 2030 auf 58,90 Milliarden US-Dollar wachsen, eine CAGR von 17,6 % (MarketsandMarkets, 2025). Wählen Sie einen zu kleinen Chip, und die Linie wächst innerhalb eines Jahres darüber hinaus; zu groß, und Sie haben GPU-Geld bezahlt, um Flaschen zu zählen. Die gute Nachricht: Die drei Klassen, CPU, NPU und GPU, teilen den Workload-Raum sauberer auf, als das Marketing vermuten lässt.
Öfter, als die Anbieter zugeben. Bescheidene Modelle mit bescheidenen Auslastungszyklen, Barcode-Lesen mit gelegentlicher OCR, eine Klassifikation alle paar Sekunden, Anomalieprüfungen auf Sensordaten, laufen akzeptabel auf denselben Prozessoren der Atom- und Celeron-Klasse, die bereits in Industrie-Box-PCs wie dem NUC-EHL stecken. Keine zusätzliche Hardware, kein neues Thermodesign, kein zweiter Lieferant.
Der Hebel, der CPUs tragfähig macht, ist die Quantisierung. Die LiteRT-Dokumentation von Google misst, dass eine vollständige INT8-Quantisierung MobileNet-v1 von 16,9 MB auf 4,3 MB verkleinert, rund 4x kleiner, und gleichzeitig die Latenz von 124 ms auf 64 ms senkt, auf derselben Hardware (Google LiteRT-Dokumentation). Wenn Ihr quantisiertes Modell seine Zykluszeit auf der CPU einhält, die Sie bereits besitzen, sind Sie fertig, geben Sie die Ersparnis anderswo aus.
Dauerhafte Inferenz ohne die Watt. Eine Neural Processing Unit ist eine Fixed-Function-Engine für die Multiplizier-Akkumulier-Rechnungen, aus denen neuronale Netze bestehen, und aktuelle Beispiele zeigen die Größenordnung: Intels Core Ultra 200V Plattform liefert bis zu 120 Plattform-TOPS, von denen die NPU 48 INT8-TOPS beisteuert (Intel Newsroom, 2024; The Register, 2024). Auf der ARM-Seite integriert der RK3588 von Rockchip eine NPU mit 6 TOPS, die Präzisionen von INT4 bis FP16 unterstützt (Rockchip, offiziell). Dedizierte Beschleunigermodule treiben die Effizienz noch weiter, der Hailo-8 von Hailo ist mit 26 TOPS bei typischen 2,5 W spezifiziert (Hailo, offiziell).
Die praktische Bedeutung: ein oder wenige kontinuierliche Kamerastreams, Fehlererkennung, Anwesenheitsüberwachung, Qualitätsgates, die die ganze Schicht über innerhalb eines lüfterlosen thermischen Rahmens laufen. In unserem Katalog ist das die Core Ultra Klasse, der EMS-ARH Box-PC, der APC-2146 Panel-PC und das EMX-PTLP Board tragen alle integrierte NPUs, und auf ARM-Seite bringt der ACP-3588 die 6 TOPS des RK3588 auf das Preisniveau eines lüfterlosen SBC.
Wenn die Anzahl der Streams oder die Modellgröße Fixed-Function-Engines überfordert. NVIDIAs Embedded-Linie Jetson Orin veranschaulicht die Obergrenze: bis zu 275 TOPS bei 15 bis 60 W beim AGX Orin, 157 TOPS beim Orin NX, 67 TOPS beim Orin Nano (NVIDIA, offiziell). Diskrete PCIe-GPUs gehen noch weiter, bei Hunderten von Watt.
GPUs rechtfertigen dieses Leistungsbudget in drei Situationen: viele gleichzeitige Streams, die ein System speisen, eine AOI-Station, die ein Dutzend Kameras überwacht; große oder nicht quantisierte Modelle, Segmentierungsnetze, Workloads der LLM-Klasse; und schnelle Iteration, bei der die Software-Reife von CUDA die Entwicklung verkürzt. Das Hardware-Muster ist eine Workstation mit vollwertigen PCIe-Steckplätzen und Kühlung, in unserem Sortiment ist das die HPS-ERSUTA Klasse, ausgestattet mit der GPU, die Ihr Framework benötigt.
Arbeiten Sie rückwärts von der Linie, nicht vorwärts von den TOPS. Zählen Sie die Streams (eine Kamera oder zwölf), benennen Sie die Zykluszeit (eine Entscheidung alle 50 ms oder alle 5 s), dimensionieren Sie das Modell (ein quantisierter Klassifikator oder ein Segmentierungsnetz) und legen Sie das Gehäusebudget fest (geschlossener lüfterloser Schrank oder belüftetes Rack). Dann: leichte Last auf einem Stream, CPU. Kontinuierliche Bildverarbeitung auf einem bis wenigen Streams in einer lüfterlosen Box, NPU. Viele Streams oder schwere Modelle mit verfügbarer Kühlung, GPU.
Und betrachten Sie TOPS als Einstiegszahl, nicht als Urteil. Die Angaben mischen Präzisionen (INT8 vs. FP16 verdoppelt die Zahl ungefähr), setzen ideale Auslastung voraus und sagen nichts über das Speicherverhalten Ihres Modells aus. Der ehrliche Test ist Ihr Modell, quantisiert so, wie Sie es ausliefern werden, auf der Kandidaten-Hardware. Genau diese Benchmark-First-Dimensionierung ist unser Ansatz im Einkaufsleitfaden für Edge-KI-Server, und wenn die Frage Edge oder Cloud noch offen ist, beginnen Sie mit unserem Vergleich Edge vs. Cloud. Nennen Sie uns Ihre Kameraanzahl und Zykluszeit, und wir stellen Ihnen eine Hardware-Auswahl zusammen, gegen die Sie Benchmarks fahren können.
TSL Automation Solutions
Marketingleiterin, TSL Automation Solutions
Sanjana berichtet über Trends in der Industrieautomation, Produkteinführungen und Technologiethemen für TSL Automation Solutions, einen Distributor für HMI, Panel-PCs und Embedded-Computing-Systeme mit Sitz in Mumbai, der Hersteller in ganz Indien und weltweit beliefert.
Unser Team in Mumbai empfiehlt Ihnen das passende HMI, den passenden Panel-PC oder das passende Embedded-System für Ihre Anwendung.
TSL Automation kontaktieren