Samsung Electronics hat auf der IFA 2026 mehrere Software- und Hardware-Updates für lokale KI-Inferenz angekündigt, um auf den signifikanten Anstieg der Downloads großer Sprachmodelle im vergangenen Jahr zu reagieren. Um das Problem der komplexen Konfiguration lokaler KI zu lösen, hat das Unternehmen angekündigt, ab September die One Click Installation-Funktion einzuführen. Nutzer mit RTX-Grafikkarten und DGX-Systemen können die Modellkonfiguration direkt über Hermes Agent und OpenClaw 2.0 vornehmen, ohne manuelle Anpassungen am Inferenz-Engine oder den Quantisierungsparametern vornehmen zu müssen.
Perplexity wird ebenfalls einen tragbaren KI-Assistenten für Nutzer von RTX-Grafikkarten mit 24 GB oder mehr Videospeicher anbieten. Nutzer können wählen, ob sie sensible Daten auf dem Gerät verarbeiten oder komplexe Probleme in die Cloud auslagern möchten. Samsung Electronics hat gleichzeitig Leistungsdaten zur lokalen Inferenz veröffentlicht: Die Durchsatzrate von Blackwell und DGX Spark-Systemen in Llama.cpp wurde um bis zu 1,9-fach gesteigert, während sie in vLLM um bis zu 1,4-fach gestiegen ist.
Samsung Electronics führt lokales KI-Task-Management-Tool Pair ein
Samsung Electronics hat gleichzeitig das kostenlose Open-Source-Tool Nvidia Pair (Personal AI Router) eingeführt, das am 3. September offiziell veröffentlicht wurde. Dieses Tool ist unter der Apache 2.0-Lizenz als Open Source verfügbar und kann KI-Inferenzaufgaben auf mehrere ungenutzte Computer im lokalen Netzwerk verteilen, die Windows, Linux und macOS unterstützen und über Ollama und LM Studio-Agents betrieben werden.
Pair verteilt die Rechenlast dynamisch basierend auf der Tiefe der Arbeitswarteschlangen und der GPU-Auslastung der einzelnen Geräte, wodurch ungenutzte Rechenleistung von Spielkonsolen, sekundären Laptops usw. genutzt wird, ohne die laufenden Spiele oder Rendering-Arbeiten der Nutzer zu stören. Diese Anordnung ermöglicht es, die Hardware-Ressourcen im lokalen Netzwerk basierend auf der tatsächlichen Last zu verteilen, anstatt sich auf ein einzelnes Gerät für alle lokalen KI-Inferenzaufgaben zu verlassen.
Erste Chips der RTX Spark-Architektur N1X mit zwei Konfigurationen vorgestellt
In Bezug auf die Hardware hat Samsung Electronics die detaillierten Spezifikationen des ersten Chips der RTX Spark-Architektur, N1X, bekannt gegeben, der im Oktober auf den Markt kommen wird und zwei Konfigurationen bietet. Die High-End-Version ist mit einer 6.144-Kern-GPU und einem 20-Kern-Grace-CPU ausgestattet, während die Laptop- und kompakten Desktop-Versionen bis zu 128 GB Unified Memory unterstützen; die andere Version ist mit einer 5.120-Kern-GPU und einem 18-Kern-Grace-CPU ausgestattet und unterstützt bis zu 32 GB Unified Memory.
Samsung Electronics hat gleichzeitig bestätigt, dass mehrere beliebte Spiele, darunter „Apex Legends“, „The Finals“ und „Anno 117: Pax Romana“, Unterstützung für Anti-Cheat und die native Spark-Plattform hinzugefügt haben. Die Unterstützung für diese Spiele umfasst Betrugsprävention und Funktionen der Spark-Plattform, was zeigt, dass die neue Plattform schrittweise auf verschiedene Arten von PC-Spielen ausgeweitet wird.
| Artikel | Spezifikationen |
|---|---|
| Prozessor | High-End-Version: 20-Kern-Grace-CPU; andere Version: 18-Kern-Grace-CPU |
| GPU | High-End-Version: 6.144 Kerne; andere Version: 5.120 Kerne |
| Unified Memory | High-End-Version bis zu 128 GB; andere Version bis zu 32 GB |
| Plattform | RTX Spark-Architektur N1X-Chip |
| Markteinführung | Oktober |
Haftungsausschluss: Dieser Artikel enthält Links zu Partnerprodukten. Wenn Sie über diese Links kaufen, kann TechRitual eine Provision erhalten, die jedoch die Produktbewertung und -empfehlung nicht beeinflusst. Weitere Informationen finden Sie in derDatenschutzrichtlinie.

