Mit dem beschleunigten Eintritt in das Zeitalter der L3-autonomen intelligenten Agenten steht die Computerindustrie vor einem beispiellosen strukturellen Widerspruch – während Unternehmen und Einzelpersonen die Produktivitätssteigerungen durch KI genießen, sind sie gleichzeitig mit den strukturellen Engpässen von Rechenleistungskosten, Datensicherheit und Erfahrungsmängeln konfrontiert. Der Aufbau einer neuen Rechenleistungsbasis, die Wirtschaftlichkeit, Datenkonformität und stabile Erfahrungen vereint, ist der Schlüssel für den Durchbruch in der gesamten Branche. Am 9. September fand in Peking das Lenovo Smart Salon unter dem Thema „AI Host – eine neue Art von Edge, die für intelligente Agenten geschaffen wurde“ statt.
Die Lenovo Group hat gemeinsam mit dem weltweit führenden IT-Marktforschungs- und Beratungsunternehmen IDC das erste Whitepaper der Branche über „AI Hosts“ veröffentlicht (im Folgenden „das Whitepaper“). Als erste autoritative Anleitung zur systematischen Definition, technischen Standards und Wertsystemen der AI Host-Kategorie markiert die Veröffentlichung des Whitepapers die offizielle Etablierung der „neuen Art von Edge-Rechenleistung“ für die Ära der L3-autonomen intelligenten Agenten und treibt die Rechenleistungsindustrie in ein neues Paradigma der „Ende-Edge-Cloud“-Kollaboration und hybriden KI voran.
Lenovo veröffentlicht das Whitepaper „AI Host“, um den Herausforderungen der Branche zu begegnen
Angesichts der beiden großen Herausforderungen der Branche – der „Rechensteuer“ und der Datensicherheitsrisiken, die mit der Evolution intelligenter Agenten einhergehen – erklärte der Vizepräsident der Lenovo Group und Exekutivvorsitzende des Technologiemanagementausschusses in China, Abulikemu: „Wenn intelligente Agenten zu einem ständigen Hintergrund werden, der private Erinnerungen trägt, benötigen sie ein eigenes ‚Zuhause‘. Die Geburt des AI Hosts soll die Rechenleistung und die Datensouveränität wirklich an die Benutzer zurückgeben, sodass jede Form von Intelligenz tatsächlich denjenigen gehört, die sie erschaffen und nutzen.“ Wang Jiping, Vizepräsident von IDC China, bemerkte, dass AI-native Endgeräte zunehmend für den autonomen Betrieb intelligenter Agenten konzipiert werden.
Als wichtige Ergänzung zur Cloud-Rechenleistung bietet der AI Host einen stabilen Betrieb rund um die Uhr, lokale Datenkontrolle und vorhersehbare Kosten in einem speziellen Hosting-Bereich, um die Kosten-, Sicherheits- und Erfahrungsmängel bei der Implementierung von KI in Unternehmen zu adressieren. IDC wird die Entwicklung dieser Kategorie weiterhin beobachten und erwartet, dass Lenovo die Branchenstandards und den Ökosystemaufbau vorantreibt.
Ähnlich wie in der Ära des mobilen Internets benötigen Benutzer sowohl öffentliche Mobilfunknetze als auch private lokale Netzwerke; im Zeitalter der intelligenten Agenten kann das Rechensystem ebenfalls nicht nur auf Cloud-Rechenleistung angewiesen sein, sondern muss durch lokal ansässige private Rechenleistung ergänzt werden. Das Whitepaper gibt dafür eine autoritative Definition: AI Hosts sind speziell für intelligente Agenten entwickelte Edge-Geräte, die L3-autonome und darüber hinaus autonome intelligente Agenten unterstützen und die kontinuierliche autonome Ausführung komplexer Aufgaben ermöglichen; sie verfügen über integrierte Fähigkeiten für lokale Inferenz, Aufgabenausführung und Datenspeicherung; eine vollständige Lösung, die Hardware und Software integriert und selbstentwickelbar ist; ein Edge-AI-Zentrum, das mit Endgeräten und der Cloud kooperiert und koexistiert.
Wang Zhuo, technischer Strategiedirektor von Lenovo China, ist der Ansicht, dass „speziell für intelligente Agenten entwickelt“ das zentrale Merkmal des AI Hosts ist, das ihn von traditionellen Endgeräten unterscheidet – sein Ziel sind die automatische Zusammenarbeit zwischen intelligenten Agenten sowie zwischen intelligenten Agenten und Hardware- und Softwaresystemen; gestützt auf eine heterogene AI-native Rechenarchitektur ist die gesamte Hardware und das System auf die Optimierung der kontinuierlichen autonomen Ausführung ausgerichtet, was eine lokale geschlossene Datenverarbeitung ermöglicht und eine dynamische Planung von „Edge-prioritär, Cloud-unterstützend“ schafft.
Der Schlüssel zur Verbreitung des AI Hosts in der Industrie liegt darin, ob es gelingt, die Rentabilität und die Sicherheitskonformität in der Geschäftlogik zu berechnen. Wang Jiping betonte besonders die Umgestaltung des Produktionsmodells durch den AI Host: „Der AI Host, kombiniert mit dem neuen Produktionsorganisationsmodell des Ein-Personen-Unternehmens, schafft ein stabil operierendes ‚digitales Mitarbeiterteam‘, das eine noch nie dagewesene Energie freisetzt.“ Konkrete Geschäftsfälle haben diesen Wert bereits verifiziert: Ein grenzüberschreitendes E-Commerce-Ein-Personen-Unternehmen, das den Lenovo Baiying AI Host als zentrale Basis für intelligente Agenten einsetzte, hatte zuvor einen Cloud-basierten großen Modell-API für den Nachtdienst verwendet, sah sich jedoch während einer Verkaufsaktion mit stark steigenden Kosten konfrontiert, die sogar die Gewinnmarge der Bestellungen überstiegen.
Nach der Einführung des AI Hosts wurde eine sofortige Reaktion rund um die Uhr und eine lokale geschlossene Schleife für sensible Daten erreicht; durch ein intelligentes Planungssystem konnten die meisten regulären Tokens lokal in einer geschlossenen Schleife verarbeitet werden, was die Ausgaben für Cloud-APIs erheblich senkte. Wang Kai, Forschungsleiter von IDC China, ist der Meinung: „Die Bewertung von AI-Rechenleistungslösungen sollte nicht nur auf den Beschaffungskosten basieren, sondern auch die wirtschaftlichen und sicherheitsrelevanten Aspekte über den gesamten Lebenszyklus hinweg berücksichtigen.“ Das im Whitepaper berechnete TCO-Modell zeigt, dass der AI Host einen sehr klaren Kostenvorteil bietet – in Szenarien mit einem monatlichen Verbrauch von 600 Millionen Tokens kann die Amortisationszeit etwa 10 Monate betragen, während Szenarien mit über 1,8 Milliarden Tokens nur 8 Monate benötigen; je höher die Nutzung, desto deutlicher die langfristigen Einsparungen, die TCO kann in fünf Jahren um bis zu 67 % gesenkt werden.
Gleichzeitig gibt die lokale geschlossene Architektur die Datensouveränität an die Benutzer zurück, sodass Unternehmen nicht mehr zwischen Effizienz und Sicherheit abwägen müssen, was der zentrale Antrieb für die beschleunigte Implementierung in Branchen wie grenzüberschreitendem E-Commerce, Content Creation, High-End-Forschung und -Entwicklung sowie Anwaltskanzleien ist.
Als Pionier der AI Host-Kategorie ist Lenovo derzeit das einzige Unternehmen in China, das sowohl im Consumer- als auch im Business-Bereich eine umfassende Produktpalette anbietet und Produkte veröffentlicht, die auf unterschiedliche Benutzerbedürfnisse zugeschnitten sind, und somit dem Markt Beispiele für die schichtweise Implementierung kommerzieller Praktiken bietet: Einsteiger-Modelle unter 5000 Yuan senken die Hemmschwelle für erste Erfahrungen; Hauptmodelle im Preisbereich von 0,5 bis 40.000 Yuan richten sich an Ein-Personen-Unternehmen und kleine Teams und ermöglichen den reibungslosen Betrieb von großen Modellen mit 35B bis 70B; Unternehmensflaggschiffe und Clusterlösungen über 40.000 Yuan unterstützen die Inferenz von großen Modellen mit Hunderten von B und die Vernetzung mehrerer Maschinen, um den Anforderungen an die Privatisierung von Unternehmen gerecht zu werden; von Lenovo AI Host MINI bis zu Lenovo Baiying AI Host 300 wurden mehrere Produkte veröffentlicht, die die gesamte Bandbreite von individuellen Erprobungen bis hin zu unternehmensschwerer Rechenleistung abdecken.
Jeder Sprung in den Rechenparadigmen verändert die Hardwarelandschaft. Derzeit führen Technologie-Giganten wie Apple und Lenovo gemeinsam die Entwicklung dieser neuen Art von Edge-Rechenleistung an – sei es der Apple Mac mini, der von Geeks als lokale Inferenzknoten rund um die Uhr genutzt wird, oder die systematisch eingeführte AI Host-Serie von Lenovo, die ein starkes Signal für einen industriellen Durchbruch sendet: Die Benutzerbedürfnisse nach kostengünstiger, hochprivater, dauerhaft ansässiger Edge-Rechenleistung treiben die Edge-Rechenleistung von einer dezentralen, spontanen Erkundung hin zu einer beschleunigten Standardisierung und Skalierung in der Industrie.
Das Whitepaper prognostiziert, dass die AI Host-Industrie in China drei Phasen durchlaufen wird: 2026 wird das Jahr der Einführung der Kategorie sein, mit einem Jahresversand von etwa 400.000 Einheiten und einem entsprechenden Marktvolumen von etwa 5 Milliarden Yuan; 2027-2028 wird die frühe Durchdringungsphase sein, in der AI OPC-Gruppen und kleine und mittlere Unternehmen schrittweise einkaufen, während der Markt noch in der Bildungsphase der Kategorie ist; 2029-2030 wird der Markt in eine beschleunigte Wachstumsphase eintreten, in der die Versandmenge von etwa 3,5 Millionen Einheiten auf etwa 7 Millionen Einheiten ansteigt und das Marktvolumen von etwa 46 Milliarden Yuan auf etwa 77 Milliarden Yuan steigt.
Die offizielle Veröffentlichung des Whitepapers „AI Host“ setzt nicht nur einen einheitlichen technischen Standard und Auswahlkriterien für die Branche, sondern klärt auch die Grenzen zwischen AI Hosts, traditionellen Endgeräten und Cloud-Rechenleistung und deutet auf die Eröffnung eines milliardenschweren Marktes und einen historischen Sprung im persönlichen Rechenparadigma hin. Intelligenz wird schließlich wie Wasser und Strom überall vorhanden und nach Bedarf genutzt werden, und durch neue Arten wie den AI Host sicher und kostengünstig jedem Benutzer gehören.
| Posten | Spezifikationen |
|---|---|
| Monatlicher Tokenverbrauch | 600 Millionen Tokens |
| Amortisationszeitraum | ca. 10 Monate |
| Hohe Nutzungsszenarien Tokens | 1,8 Milliarden Tokens |
| Hohe Nutzung Amortisationszeitraum | ca. 8 Monate |
| Fünfjahres-TCO-Senkung | maximal 67 % senkbar |

