Zum Inhalt springen
AI ConnectPowered by VELENTIS
KI-generiert2 Min.

Zhipu AI veröffentlicht Open-Weights-Modell GLM-5.3-Flash nach viralem Testlauf

Zhipu AI hat das Open-Weights-Modell GLM-5.3-Flash unter MIT-Lizenz freigegeben, nachdem das System zuvor unter dem Decknamen Ox Alpha über 62 Billionen Tokens verarbeitet hatte.

Dieser Beitrag wurde KI-generiert und automatisch veröffentlicht. Einordnung, Kennzeichnung und alle Quellen am Beitragsende.

(KI-generiertes Symbolbild: Gemini / AI Connect)

Das chinesische KI-Unternehmen Zhipu AI hat am 26. August 2026 sein neues Open-Weights-Modell GLM-5.3-Flash offiziell vorgestellt und unter einer freizügigen MIT-Lizenz bereitgestellt. Die Veröffentlichung folgt auf wochenlange Spekulationen in der weltweiten Entwickler-Community über ein hochperformantes, unbenanntes Modell, das zuvor unter dem Pseudonym Ox Alpha auf Testplattformen aufgetaucht war. Mit der Freigabe macht Zhipu AI ein System für Entwickler und Unternehmen frei zugänglich, das speziell auf hohe Geschwindigkeit und effiziente Bereitstellung ausgelegt ist.

Architektonisch setzt GLM-5.3-Flash auf ein Mixture-of-Experts-Design (MoE) mit insgesamt 320 Milliarden Parametern. Für einzelne Inferenzschritte werden jedoch nur 18 Milliarden Parameter aktiviert, was den rechnerischen Aufwand pro generiertem Token deutlich begrenzt. Gleichzeitig unterstützt das Modell ein langes Kontextfenster von bis zu einer Million Tokens. Um den immensen Speicherbedarf für den Key-Value-Cache bei derart großen Kontexten zu bewältigen, kombiniert Zhipu AI Sparse- und Linear-Attention-Mechanismen.

Vor der offiziellen Enthüllung hatte das Modell in der Entwicklerszene bereits für erhebliches Aufsehen gesorgt. Über Inferenzplattformen wie OpenRouter und OpenCode lief das Modell unter dem Codenamen Ox Alpha und bewältigte dort im anonymen Produktivbetrieb mehr als 62 Billionen Tokens. Viele Nutzer zeigten sich von der Reaktionsschnelligkeit und den Fähigkeiten des anonymen Modells überrascht, ohne zu wissen, welcher Anbieter oder welche Architektur dahinterstand.

Ein zentrales Detail des Projekts betrifft die zugrundeliegende Recheninfrastruktur. Nach Angaben von Zhipu AI wurde der gesamte Inferenz-Traffic während der Testphase auf einem Verbund aus 100.000 in China produzierten KI-Beschleunigern abgewickelt. Der erfolgreiche Einsatz dieses Clusters unterstreicht die Bemühungen des chinesischen Ökosystems, moderne Frontier-Modelle auch unabhängig von westlichen Hardware-Lieferketten in industriellem Maßstab zu betreiben.

Mit der Wahl der MIT-Lizenz eröffnet Zhipu AI Entwicklern weitreichende Freiheiten bei der kommerziellen Nutzung, Anpassung und lokalen Einbindung des Modells. Die Kombination aus reduzierten Betriebskosten, hoher Parametereffizienz und voller Open-Weights-Verfügbarkeit dürfte den Wettbewerb unter quelloffenen Inferenzlösungen im Bereich langer Kontexte weiter verschärfen.

Was heißt das für Sie?

Für Entwickler und Unternehmen bietet GLM-5.3-Flash eine leistungsfähige, unter MIT-Lizenz frei nutzbare Alternative für anspruchsvolle Aufgaben mit extrem langen Kontexten. Die Veröffentlichung demonstriert zudem, dass praxistaugliche MoE-Inferenz auch auf alternativen Hardware-Clustern effizient skaliert werden kann.

Perspektiven

Berichterstattung: 3× Weitere

Dieselbe Geschichte, mehrere Blickwinkel: So rahmen die Quellen das Thema, jeweils mit wörtlichem Zitat.

  • emergent.shWeitere

    Die Quelle betont die Geschwindigkeit, multimodale Architektur und die freie MIT-Lizenzierung des Modells als entwicklerfreundliche Alternative zu proprietären Systemen.

    Originalzitat

    Zhipu AI has officially released GLM-5.3-Flash, a multimodal artificial intelligence model designed for speed and accessibility.

    emergent.sh
  • scmp.comWeitere

    Der Bericht stellt den Anstieg der Zhipu-Aktien und den viralen Testlauf in den Mittelpunkt und hebt hervor, dass das Modell als Meilenstein gegen US-Hardwarebeschränkungen auf heimischen chinesischen Chips lief.

    Originalzitat

    Zhipu’s shares closed more than 12 per cent higher at HK$1,160 in Hong Kong on Thursday.

    scmp.com

Einordnung der Quellen redaktionell gepflegt (politisches Spektrum nur bei breitem Konsens; Anbieter-Kommunikation ist PR, kein Journalismus). Quellen ohne Etikett sind nicht eingeordnet — wir raten nicht.

Belege

Gut belegt
73/100
  • Zhipu AI veröffentlichte GLM-5.3-Flash am 26. August 2026 unter einer MIT-Lizenz.

    belegt
  • Unter dem Codenamen Ox Alpha verarbeitete das Modell vorab mehr als 62 Billionen Tokens auf OpenRouter und OpenCode.

    eine Quelle

Der Beleg-Score wird berechnet, nicht handgesetzt: aus Vertrauensgrad, Quellenzahl und dem Anteil verifizierter Aussagen.

Quelle & Transparenz

Stand: 28. August 2026

KI-generiertKI-generiert: automatisiert aus geprüften Quellen erstellt und technisch qualitätsgesichert (Quellen-, Zitat- und Zahlenabgleich); keine menschliche Einzelfreigabe vor Veröffentlichung

Quellen
3
Verifizierte Aussagen
1 / 2
Beleg-Score
73Gut belegt

Wollen Sie das umsetzen?

Wir vermitteln Ihnen passende KI-Anbieter aus der DACH-Region, kostenlos und unverbindlich.

Wie geht's weiter?