LM Studio hat auf seiner Bionic-KI-Agenturplattform die Unterstützung für das neue GLM-5.3-Flash-Modell von Z.ai hinzugefügt, das multimodale Eingabefunktionen, ein Kontextfenster von 1 Million Token und eine deutliche Preissenkung im Vergleich zum Vorgängermodell GLM-5.2 bietet. Bionic ist die Plattform von LM Studio für Aufgaben wie Codierung, Forschung und Dokumentenverarbeitung und unterstützt die Betriebssysteme macOS und Windows. Gleichzeitig ermöglicht sie den Nutzern, zwischen lokal bereitgestellten Modellen oder cloudbasierten Modellen, die auf Servern in den USA gehostet werden, zu wählen, wobei letztere eine strenge Null-Datenaufbewahrungspolitik haben.
Seit der offiziellen Ankündigung Mitte Juli hat LM Studio die Anzahl der verfügbaren Modelle und Funktionen auf der Bionic-Plattform kontinuierlich erweitert. Nach der vorherigen Unterstützung des Moonshot AI Kimi K3-Modells wird nun das neue GLM-5.3-Flash von Z.ai eingeführt. LM Studio weist darauf hin, dass die Betriebskosten dieses Modells bis zu 10-mal niedriger sein können als die von GLM-5.2. Die Ankündigung von LM Studio erfolgte nur wenige Stunden vor der offiziellen Veröffentlichung von GLM-5.3-Flash, das zuvor anonym unter dem Codenamen „Ox Alpha“ auf den Plattformen OpenCode und OpenRouter getestet wurde und große Aufmerksamkeit erregte.
GLM-5.3-Flash verwendet Experten-Mischarchitektur – Leistung auf dem Niveau führender Modelle
GLM-5.3-Flash gehört zu den Modellen mit einer Experten-Mischarchitektur (Mixture-of-Experts, MoE) und hat insgesamt 320 Milliarden Parameter, wobei bei jeder Inferenz 18 Milliarden Parameter aktiviert werden. Es unterstützt Bild- und Texteingaben und hat ein Kontextfenster von 1 Million Token. Die von Z.ai veröffentlichten Benchmark-Ergebnisse zeigen, dass dieses Modell in mehreren Kennzahlen besser abschneidet als GLM-5.2 und in der Gesamtleistung auf einem ähnlichen Niveau mit führenden Modellen wie Anthropic, OpenAI, Google und DeepSeek liegt.
LM Studio-Nutzer können dieses cloudbasierte Modell direkt über die Plattform aufrufen. Die entsprechenden Einstellungen und Nutzungshinweise sind in der offiziellen Dokumentation zu finden.
| Artikel | Spezifikation |
|---|---|
| Modellname | GLM-5.3-Flash |
| Entwickler | Z.ai |
| Architektur | Experten-Mischarchitektur (MoE) |
| Gesamtanzahl der Parameter | 320 Milliarden |
| Aktivierte Parameteranzahl | 18 Milliarden |
| Kontextfenster | 1 Million Token |
| Eingabestützung | Bild, Text |
| Betriebsplattform | LM Studio Bionic (macOS, Windows) |

