Sechs Tage lang führte ein anonymes Modell namens Ox Alpha die Rangliste des Marktplatzes OpenRouter an, bevor Zhipu die Maske lüftete. Dahinter steckt GLM-5.3-Flash, ein offenes Modell auf dem Niveau von Anthropics Claude Opus 4.8. Der Bruch mit der Branche liegt aber in der Hardware: Das Modell lief komplett auf rund 100.000 chinesischen Chips, ohne eine einzige Nvidia-Karte.

drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügen

Mit GLM-5.3-Flash hat der chinesische Entwickler Zhipu am 27. August 2026 ein Modell offengelegt, das zuvor unter dem Tarnnamen Ox Alpha für Wirbel sorgte. Die eigentliche Nachricht ist nicht die Rangliste, sondern die Frage, wie ein Modell auf Weltniveau heute ganz ohne westliche Beschleuniger entsteht.

Das Wichtigste in Kürze

  • GLM-5.3-Flash erreicht 57 Punkte im Intelligenz-Index von Artificial Analysis und liegt damit gleichauf mit Claude Opus 4.8, vor DeepSeek V4 Pro (53 Punkte).
  • Das Modell lief im Testbetrieb ausschließlich auf rund 100.000 chinesischen KI-Chips, der Chipentwickler Cambricon meldete noch am selben Tag Kompatibilität.
  • Vor dem offiziellen Start verarbeitete es 62 Billionen Token und stand eine Woche lang an der Spitze von OpenRouter.
  • Zhipu gibt die Gewichte frei und ruft rund 0,13 Euro je Million Eingabe-Token auf, etwa ein Zehntel des Vorgängers.

Was steckt hinter dem Rätselmodell Ox Alpha?

Ein IC „HEIMISCH“ und ein Rucksack mit DE-Flaggen-Symbol auf Platz 1 eines Siegertreppchens
Entwickler testeten sechs Tage lang ein anonymes KI-Modell auf Marktplätzen, bevor Zhipu am 27. August GLM-5.3-Flash mit 320 Milliarden Parametern offenbarte

Sechs Tage lang testeten Entwickler weltweit ein anonymes Modell auf Marktplätzen wie OpenRouter und OpenCode, ohne dessen Herkunft zu kennen. Am 27. August bestätigte Zhipu die Urheberschaft und stellte GLM-5.3-Flash als offenes Modell mit 320 Milliarden Parametern bereit, von denen pro Anfrage nur 18 Milliarden rechnen.[1]

Sparsame Architektur: Dieser Mixture-of-Experts-Aufbau drückt die Rechenlast und macht das Modell günstig genug für den Masseneinsatz. Auf dem Intelligenz-Index des Analysehauses Artificial Analysis erreicht es 57 Punkte, den Wert von Claude Opus 4.8, und schiebt sich damit vor das bisherige Spitzenmodell von DeepSeek.

Warum sind 100.000 heimische Chips der eigentliche Coup?

Unabhängig von Nvidia: Den gesamten Testbetrieb wickelte Zhipu auf rund 100.000 im Inland gefertigten Beschleunigern ab. Welcher Hersteller genau dahintersteht, lässt das Unternehmen offen; belegt ist, dass Cambricon noch am selben Tag die Kompatibilität herstellte, während Zhipu selbst nur allgemein von heimischen Beschleunigern spricht.[2]

Der Mechanismus dahinter ist geopolitisch: Washington beschränkt die Ausfuhr von Nvidias Spitzenchips nach China. Liefert ein chinesischer Anbieter ein Modell auf Weltniveau allein auf eigener Hardware aus, verliert diese Exportkontrolle einen Teil ihrer Wirkung. Schon DeepSeeks Effizienzsprung deutete dieses Muster an, jetzt setzt es sich in der Breite fort.

GLM-5.3-Flash in Zahlen
Zhipus offenes Modell, das heimlich als „Ox Alpha“ lief
57
Punkte im Intelligenz-Index von Artificial Analysis, gleichauf mit Claude Opus 4.8 (DeepSeek V4 Pro: 53)
100.000
heimische KI-Chips im Testbetrieb, keine einzige Nvidia-Karte
62 Bio.
Token, verarbeitet vor dem offiziellen Marktstart
320 Mrd.
Parameter, davon nur 18 Mrd. je Anfrage aktiv
0,13 €
je Million Eingabe-Token, rund ein Zehntel des Vorgängers GLM-5.2

Nicht das Benchmark-Ergebnis ist die Nachricht, sondern der Beleg, dass Spitzen-KI die westliche Chip-Sperre umgehen kann. Europäische Firmen mit dem Ziel Modell-Souveränität sollten offene chinesische Modelle ab jetzt ernsthaft einplanen.

— Markus Seyfferth, Chefredakteur Dr. Web

Was bedeutet das für europäische Unternehmen?

Offene Gewichte, offene Fragen: Weil Zhipu die Modellgewichte freigibt, lässt sich GLM-5.3-Flash im eigenen Rechenzentrum betreiben, ohne Anfragen an einen US-Dienst zu schicken. Das Modell reiht sich in eine wachsende Zahl offener KI-Modelle aus China ein, deren Preis westliche Angebote klar unterbietet: rund 0,13 Euro je Million Eingabe-Token und 0,44 Euro je Million Ausgabe-Token (Stand 28. August 2026, Kurs 0,87).

Sicherheit vor Sparpreis: Der niedrige Tarif ersetzt keine Prüfung. Bei GLM-5.3 stießen Fachleute bereits auf Schwachstellen im Zugangsschutz, und europäische Datenschutzbehörden nehmen chinesische Modelle wie DeepSeek genau unter die Lupe. Für den produktiven Einsatz empfiehlt sich eine abgeschottete Umgebung mit protokollierten Ausgaben, freigegeben entlang der BSI-Empfehlungen und der DSGVO.

Quellen

[1] Zhipu AI (Z.ai): GLM-5.3-Flash, Modellkarte auf Hugging Face

[2] South China Morning Post: „Zhipu AI shares jump as viral Ox Alpha model revealed as GLM-5.3-Flash on Chinese chips“

Mehr Newshunger?

4,1 15 Bewertungen

Wie hat Ihnen dieser Artikel gefallen?