LM Studio Bionic integriert GLM-5.3-Flash: Unterstützung für multimodale Eingaben und 1 Million Token Kontext

LM Studio hat auf seiner Bionic-KI-Agenturplattform die Unterstützung für das neue GLM-5.3-Flash-Modell von Z.ai hinzugefügt, das multimodale Eingabefunktionen, ein Kontextfenster von 1 Million Token und eine deutliche Preissenkung im Vergleich zum Vorgängermodell GLM-5.2 bietet. Bionic ist die Plattform von LM Studio für Aufgaben wie Codierung, Forschung und Dokumentenverarbeitung und unterstützt die Betriebssysteme macOS und Windows. Gleichzeitig ermöglicht sie den Nutzern, zwischen lokal bereitgestellten Modellen oder cloudbasierten Modellen, die auf Servern in den USA gehostet werden, zu wählen, wobei letztere eine strenge Null-Datenaufbewahrungspolitik haben.

Seit der offiziellen Ankündigung Mitte Juli hat LM Studio die Anzahl der verfügbaren Modelle und Funktionen auf der Bionic-Plattform kontinuierlich erweitert. Nach der vorherigen Unterstützung des Moonshot AI Kimi K3-Modells wird nun das neue GLM-5.3-Flash von Z.ai eingeführt. LM Studio weist darauf hin, dass die Betriebskosten dieses Modells bis zu 10-mal niedriger sein können als die von GLM-5.2. Die Ankündigung von LM Studio erfolgte nur wenige Stunden vor der offiziellen Veröffentlichung von GLM-5.3-Flash, das zuvor anonym unter dem Codenamen „Ox Alpha“ auf den Plattformen OpenCode und OpenRouter getestet wurde und große Aufmerksamkeit erregte.

GLM-5.3-Flash verwendet Experten-Mischarchitektur – Leistung auf dem Niveau führender Modelle

GLM-5.3-Flash gehört zu den Modellen mit einer Experten-Mischarchitektur (Mixture-of-Experts, MoE) und hat insgesamt 320 Milliarden Parameter, wobei bei jeder Inferenz 18 Milliarden Parameter aktiviert werden. Es unterstützt Bild- und Texteingaben und hat ein Kontextfenster von 1 Million Token. Die von Z.ai veröffentlichten Benchmark-Ergebnisse zeigen, dass dieses Modell in mehreren Kennzahlen besser abschneidet als GLM-5.2 und in der Gesamtleistung auf einem ähnlichen Niveau mit führenden Modellen wie Anthropic, OpenAI, Google und DeepSeek liegt.

LM Studio-Nutzer können dieses cloudbasierte Modell direkt über die Plattform aufrufen. Die entsprechenden Einstellungen und Nutzungshinweise sind in der offiziellen Dokumentation zu finden.

Artikel Spezifikation
Modellname GLM-5.3-Flash
Entwickler Z.ai
Architektur Experten-Mischarchitektur (MoE)
Gesamtanzahl der Parameter 320 Milliarden
Aktivierte Parameteranzahl 18 Milliarden
Kontextfenster 1 Million Token
Eingabestützung Bild, Text
Betriebsplattform LM Studio Bionic (macOS, Windows)
Originalinhalt
Dieser Artikel ist die deutsche Fassung eines Originalbeitrags von TechRitual.
Stein Yep
Stein Yep