LIVE
+++ GLM-5.3-Flash: Zhipu-Aktie springt nach Ox-Alpha-Start +++ Nvidia greift nach Hugging Face – 12,9 Milliarden Dollar +++ OpenAIs Chefetage leert sich — Brockman zieht die Fäden +++ Microduck: Hugging Face verkauft Roboterente für 399 Dollar +++ OpenAI-Bericht: 688 Agenten griffen Hugging Face an +++ Gemini Omni 1.1 Flash: 40-Sekunden-Szenen und 360p-Modus ++++++ GLM-5.3-Flash: Zhipu-Aktie springt nach Ox-Alpha-Start +++ Nvidia greift nach Hugging Face – 12,9 Milliarden Dollar +++ OpenAIs Chefetage leert sich — Brockman zieht die Fäden +++ Microduck: Hugging Face verkauft Roboterente für 399 Dollar +++ OpenAI-Bericht: 688 Agenten griffen Hugging Face an +++ Gemini Omni 1.1 Flash: 40-Sekunden-Szenen und 360p-Modus +++
Alle News ›
AI IN LIFE AI IN LIFENEWS
DAILY
DE EN
MODELLE

GLM-5.3-Flash: Zhipu-Aktie springt nach Ox-Alpha-Start

Das anonyme Testmodell Ox Alpha ist GLM-5.3-Flash: 320 Milliarden Parameter, MIT-Lizenz, laut Zhipu auf 100.000 chinesischen Chips betrieben.

GLM-5.3-Flash: Zhipu-Aktie springt nach Ox-Alpha-Start

Symbolbild: Eine weitläufige Rechenzentrumshalle mit langen Reihen dunkler Serverschränke im kühlen blauen Licht.

Ox Alpha ist GLM-5.3-Flash: Zhipu AI hat die Gewichte des Modells freigegeben, und die Aktie schloss am Donnerstag um mindestens 12 % höher.

Auf einen Blick

  • Ox Alpha ist offiziell GLM-5.3-Flash: 320 Milliarden Parameter, davon 18 Milliarden pro Anfrage aktiv (Mixture of Experts).
  • Der verdeckte Testbetrieb lief laut SCMP auf 100.000 in China gefertigten Chips; der Hersteller der Chips wird nicht genannt.
  • Die Zhipu-Aktie schloss am Donnerstag in Hongkong um mindestens 12 % höher bei 1.160 Hongkong-Dollar.
  • Die Gewichte liegen unter MIT-Lizenz auf Hugging Face (zai-org/GLM-5.3-Flash).
  • Listenpreis: 0,15 US-Dollar je Million Eingabe-Token, 0,50 US-Dollar je Million Ausgabe-Token, zwei Wochen lang 50 % Rabatt.

Zhipu AI hat das wochenlang anonym getestete Modell Ox Alpha als GLM-5.3-Flash offengelegt und die Gewichte freigegeben. Die Aktie des Unternehmens schloss am Donnerstag in Hongkong um mindestens 12 % höher bei 1.160 Hongkong-Dollar. Auffällig ist dabei weniger das Modell selbst als der Ort, an dem es lief: laut South China Morning Post ein Verbund aus 100.000 in China gefertigten Chips.

Was in dem Modell steckt

GLM-5.3-Flash ist ein Mixture-of-Experts-Modell mit 320 Milliarden Parametern, von denen pro Anfrage 18 Milliarden aktiv sind. Es verarbeitet nach Angaben von SiliconANGLE bis zu 1 Million Token Eingabe – Text, Bild und Video – und gibt bis zu 131.072 Token aus. Trainiert wurde es auf 30 Billionen Token. Z.ai nennt das Modell zehnmal kosteneffizienter als seinen Vorgänger.

Bei den Benchmarks meldet der Anbieter den höchsten Wert auf GDPval-AA v2 und Platz zwei auf AutomationBench. Beide Angaben stammen vom Hersteller; eine unabhängige Nachmessung liegt bislang nicht vor.

Der eigentliche Testfall ist die Hardware

Vor der Veröffentlichung lief das Modell im verdeckten Betrieb und verarbeitete dabei nach SCMP-Angaben 62 Billionen Token. In der Woche der Enthüllung entfielen auf OpenRouter 10,3 Billionen Token auf GLM-5.3-Flash, rund 31 % des dortigen Wochenvolumens, und bei den Coding-Systemen lag es auf Platz eins.

Der Punkt daran ist industriepolitisch. Ein Inferenzbetrieb dieser Größenordnung auf heimischer Hardware wäre ein Beleg dafür, dass sich globale Last auch ohne Nvidia-Beschleuniger tragen lässt – unter den geltenden US-Exportkontrollen ein wichtiges Argument für Peking. Welcher Hersteller die 100.000 Chips geliefert hat, nennt der Bericht allerdings nicht.

Lizenz, Preis, Verfügbarkeit

Die Gewichte stehen auf Hugging Face unter zai-org/GLM-5.3-Flash bereit, die GLM-Modelle laufen unter MIT-Lizenz. Auf der Produktseite von Z.ai sind 0,15 US-Dollar je Million Eingabe-Token und 0,50 US-Dollar je Million Ausgabe-Token angegeben, in den ersten zwei Wochen mit 50 % Rabatt. OpenRouter hostet zum Start zusätzlich eine kostenlose Variante.

Was offen bleibt

Drei Dinge sind aus den vorliegenden Quellen nicht belegt: der Name des Chipherstellers, die Frage, ob auch das Training und nicht nur der Inferenzbetrieb auf heimischer Hardware stattfand, und eine unabhängige Prüfung der Benchmark-Werte. Bis dahin gilt: Die Leistungszahlen sind Herstellerangaben, wiedergegeben von den unten zitierten Redaktionen.

◈ KI-GENERIERTER BERICHT · QUELLEN VERLINKT

Häufige Fragen

Was ist Ox Alpha?

Ox Alpha war der Deckname, unter dem Zhipu AI sein neues Modell anonym testen ließ. Es handelt sich um GLM-5.3-Flash, dessen Gewichte inzwischen auf Hugging Face liegen.

Läuft GLM-5.3-Flash wirklich auf chinesischen Chips?

Laut SCMP lief der verdeckte Testbetrieb auf einem Verbund von 100.000 in China gefertigten Chips. Der Chiphersteller wird in dem Bericht nicht genannt, und ob auch das Training dort stattfand, ist offen.

Was kostet GLM-5.3-Flash?

Die Produktseite von Z.ai nennt 0,15 US-Dollar je Million Eingabe-Token und 0,50 US-Dollar je Million Ausgabe-Token, in den ersten zwei Wochen mit 50 % Rabatt. OpenRouter stellt zum Start eine kostenlose Variante bereit.