LIVE
+++ GLM-5.3-Flash: Zhipu-Aktie springt über 12 Prozent +++ OpenGrok oeffnet Grok Bot fuer fremde Modelle +++ Sepia-Skill greift die Struktur von KI-Texten an +++ Microduck: Hugging Face bringt Roboter-Ente für 399 Dollar +++ Gemini Omni 1.1 Flash: 360p-Entwurf für 0,03 Dollar +++ Brockman gewinnt: OpenAIs Führungsriege bricht weg ++++++ GLM-5.3-Flash: Zhipu-Aktie springt über 12 Prozent +++ OpenGrok oeffnet Grok Bot fuer fremde Modelle +++ Sepia-Skill greift die Struktur von KI-Texten an +++ Microduck: Hugging Face bringt Roboter-Ente für 399 Dollar +++ Gemini Omni 1.1 Flash: 360p-Entwurf für 0,03 Dollar +++ Brockman gewinnt: OpenAIs Führungsriege bricht weg +++
Alle News ›
AI IN LIFE AI IN LIFENEWS
DAILY
DE EN
MODELLE

GLM-5.3-Flash: Zhipu-Aktie springt über 12 Prozent

Das Modell lief laut SCMP auf 100.000 chinesischen Chips, verarbeitete 62 Billionen Token vor dem Start — und die Aktie schloss bei 1.160 HK$.

GLM-5.3-Flash: Zhipu-Aktie springt über 12 Prozent

Symbolbild: eine weite Rechenzentrumshalle, in der sich Serverreihen im kühlen Licht bis in die Tiefe verlieren.

Ox Alpha ist GLM-5.3-Flash: Zhipu AI hat das viral gegangene Testmodell mit offenen Gewichten veröffentlicht, der Testlauf lief nach Darstellung der South China Morning Post vollständig auf 100.000 in China gefertigten Chips, und die Aktie schloss daraufhin am Donnerstag mehr als 12 Prozent höher bei 1.160 HK$.

Auf einen Blick

  • Architektur laut SiliconANGLE: Mixture of Experts mit 320 Milliarden Parametern, davon 18 Milliarden aktiv.
  • Kontext: 1 Million Token Eingabe für Text, Bild und Video; Ausgabe bis 131.072 Token.
  • Preis laut Product Hunt: 0,15 US-Dollar je Million Input-Token, 0,50 US-Dollar je Million Output-Token, zwei Wochen lang 50 % Rabatt.
  • Benchmarks: bester Wert auf GDPval-AA v2, Platz zwei auf AutomationBench — verglichen mit Claude Opus 4.8 und GPT-5.6 Terra.
  • Gewichte auf Hugging Face unter zai-org/GLM-5.3-Flash; OpenRouter hostet eine kostenlose Variante.

Zhipu AI hat das unter dem Decknamen Ox Alpha getestete System offiziell als GLM-5.3-Flash veröffentlicht. Der Testlauf lief nach Darstellung der South China Morning Post vollständig auf einem Cluster aus 100.000 in China gefertigten Chips. An der Börse in Hongkong schloss die Aktie am Donnerstag, dem 27. August 2026, mehr als 12 Prozent höher bei 1.160 HK$.

Der Datenverkehr, der den Decknamen verriet

Vor der formellen Freigabe am Mittwoch hatte das System laut SCMP bereits 62 Billionen Token verarbeitet. Auf OpenRouter kamen in den ersten drei Tagen mehr als 11 Billionen Token zusammen — nach Angaben der Plattform der bislang größte Start dort. Unter den Coding-Systemen führt das Modell die Liste an.

SCMP nennt zusätzlich ein Wochenvolumen von 10,3 Billionen Token, was knapp 31 Prozent des gesamten Wochenvolumens der Plattform entspreche. Beide Zahlen beziehen sich auf unterschiedliche Zeitfenster, und der Bericht löst die Differenz nicht auf. Wir geben sie deshalb getrennt wieder, statt sie zu einer Zahl zu verrechnen.

Technische Eckdaten

SiliconANGLE beschreibt eine Mixture-of-Experts-Architektur mit 320 Milliarden Parametern, von denen 18 Milliarden je Anfrage aktiv sind. Die Eingabe fasst 1 Million Token aus Text, Bildern und Video, die Ausgabe reicht bis 131.072 Token. Trainiert wurde auf 30 Billionen Token, optimiert mit einem Verfahren namens mHC.

Sparse Attention und lineare Attention sollen den Hardware-Aufwand senken; an die Stelle der Softmax-Funktion tritt ein sparsamerer Algorithmus. Gegenüber dem Vorgänger nennt SiliconANGLE eine zehnfach bessere Kosteneffizienz.

Benchmarks, Preis und Verfügbarkeit

In der Auswertung GDPval-AA v2 zu Wissensarbeit erreicht GLM-5.3-Flash den höchsten Wert, auf AutomationBench zu Aufgaben in Cloud-Anwendungen Platz zwei. Verglichen wurde mit Claude Opus 4.8, GPT-5.6 Terra und Gemini 3.7 Flash. Die Gewichte liegen auf Hugging Face unter zai-org/GLM-5.3-Flash, dazu betreibt OpenRouter eine kostenlose gehostete Variante.

Product Hunt listet die API mit 0,15 US-Dollar je Million Input-Token und 0,50 US-Dollar je Million Output-Token, in den ersten zwei Wochen mit 50 % Rabatt. Dort steht der Eintrag mit 96 Stimmen auf Tagesrang 20 und kommt aus sieben Bewertungen auf 4,7 von 5 Sternen. Die GLM-Modelle führt dieselbe Seite als MIT-lizenziert.

Was offen bleibt

Welcher Hersteller die 100.000 Chips geliefert hat, nennt keine der drei ausgewerteten Quellen. Eine unabhängige Bestätigung des Testlaufs auf heimischer Hardware liegt uns ebenfalls nicht vor — die Angabe stammt aus der Darstellung des Unternehmens, wiedergegeben von SCMP. Für dieselbe Veröffentlichung benutzen die Quellen sowohl den Namen Zhipu AI als auch die Marke Z.ai.

◈ KI-GENERIERTER BERICHT · QUELLEN VERLINKT

Häufige Fragen

Was ist Ox Alpha?

Der Deckname, unter dem Zhipu AI das Modell GLM-5.3-Flash vor der offiziellen Ankündigung im Betrieb getestet hat.

Was kostet GLM-5.3-Flash über die API?

Product Hunt nennt 0,15 US-Dollar je Million Input-Token und 0,50 US-Dollar je Million Output-Token, in den ersten zwei Wochen mit 50 % Rabatt.

Wo bekomme ich die Gewichte von GLM-5.3-Flash?

Auf Hugging Face unter zai-org/GLM-5.3-Flash. OpenRouter betreibt zusätzlich eine kostenlose gehostete Variante.