In Kürze

  • Z.ai (vormals Zhipu AI) hat am 26. August 2026 GLM-5.3-Flash veröffentlicht – zuvor unter dem Decknamen «Ox Alpha» seit dem 20. August 2026 anonym getestet – als erstes nativ multimodales Modell seiner GLM-5-Familie mit offenen, MIT-lizenzierten Gewichten auf Hugging Face.
  • Das Modell nutzt eine Mixture-of-Experts-Architektur mit 320 Milliarden Parametern, von denen 18 Milliarden pro Anfrage aktiviert werden; es verarbeitet Anfragen mit bis zu 1 Million Token aus Text, Bild und Video und liefert Antworten mit bis zu 131'072 Token.
  • Z.ai positioniert GLM-5.3-Flash als günstige Option für Coding-, Agenten- und visuelle Aufgaben zu einem Zehntel des API-Preises des Flaggschiffs GLM-5.3 – zeitweise sogar zu einem Zwanzigstel – und erreicht laut eigenen Angaben auf internen Coding-Benchmarks nahezu das Niveau von Anthropics Claude Opus 4.8.

Was ist passiert?

Das chinesische KI-Labor Z.ai, vormals Zhipu AI, hat am 26. August 2026 mit GLM-5.3-Flash ein neues Modell seiner GLM-5-Familie veröffentlicht. Das Modell war zuvor unter dem Decknamen «Ox Alpha» seit dem 20. August 2026 anonym auf verschiedenen Testplattformen zugänglich und hatte dort bereits für Aufmerksamkeit gesorgt, bevor Z.ai die Urheberschaft offiziell bestätigte. Anders als das rund zwei Wochen zuvor veröffentlichte Flaggschiff-Modell GLM-5.3, das primär auf Coding- und Agentenaufgaben ausgelegt ist, ist GLM-5.3-Flash als erstes nativ multimodales Modell der GLM-5-Familie konzipiert.

Technisch basiert GLM-5.3-Flash auf einer Mixture-of-Experts-Architektur mit 320 Milliarden Parametern, von denen pro Anfrage 18 Milliarden aktiv genutzt werden. Das Modell verarbeitet Eingaben von bis zu 1 Million Token aus Text, Bildern und Video und kann Antworten von bis zu 131'072 Token erzeugen. Die offenen Modellgewichte wurden noch am selben Tag unter MIT-Lizenz auf Hugging Face veröffentlicht.

Warum ist das wichtig?

Z.ai positioniert GLM-5.3-Flash gezielt als kostengünstige Alternative für Coding-, Agenten- und visuelle Aufgaben: Der API-Preis liegt bei einem Zehntel des Flaggschiffs GLM-5.3, zeitweise während einer befristeten Rabattaktion sogar bei einem Zwanzigstel. Auf dem Intelligence Index von Artificial Analysis erreicht das Modell einen Wert von 57 Punkten – deutlich über dem Medianwert von 27 für offene Modelle vergleichbarer Grösse – und nähert sich laut Z.ai auf internen Coding-Benchmarks der Leistung von Anthropics Claude Opus 4.8 sowie OpenAIs GPT-5.6 Terra an.

Die MIT-Lizenz erlaubt eine praktisch uneingeschränkte kommerzielle Nutzung und eigene Anpassung des Modells, was es von stärker eingeschränkten offenen Lizenzen unterscheidet. Die rasche Verfügbarkeit auf Plattformen wie Cloudflare Workers AI zeigt zudem, wie schnell neue offene Modelle inzwischen in bestehende Cloud- und Entwicklerinfrastrukturen integriert werden.

Was bedeutet das für die Schweiz?

  • Als MIT-lizenziertes Modell mit offenen Gewichten kann GLM-5.3-Flash von Schweizer KMU und Behörden auf eigener oder Schweizer Cloud-Infrastruktur betrieben werden – ein Vorteil für Organisationen, die aus Datenschutz- oder Datensouveränitätsgründen keine Anfragen an US-amerikanische oder chinesische API-Anbieter senden wollen.
  • Der sehr niedrige Preis und die native Multimodalität senken die Einstiegshürde für Schweizer KMU, die bisher aus Kostengründen auf den produktiven Einsatz von Bild- und Videoverständnis in eigenen Anwendungen verzichtet haben.
  • Da das Modell aus China stammt, bleiben für Schweizer Unternehmen dieselben Fragen zu Herkunft, Trainingsdaten und Datenfluss relevant wie bei anderen offenen chinesischen Modellen – eine sorgfältige Prüfung vor dem produktiven Einsatz bleibt insbesondere bei sensiblen oder personenbezogenen Daten unerlässlich.

Verwendete Quellen

SiliconANGLE berichtete am 26. August 2026 über die Veröffentlichung von GLM-5.3-Flash; testingcatalog.com, officechai.com und der Cloudflare-Changelog bestätigten am selben Tag die MIT-Lizenz, die technischen Spezifikationen und die Verfügbarkeit auf Workers AI.

Quellenstatus: 1 strukturierte Quelle · 0 von 1 Originaldaten verifiziert. Prüfregeln ansehen

Häufige Fragen

Was ist die Kernaussage zu Z.ai veröffentlicht multimodales Open-Weight-Modell GLM-5.3-Flash unter MIT-Lizenz?

Z.ai (vormals Zhipu AI) hat am 26. August 2026 GLM-5.3-Flash veröffentlicht – zuvor unter dem Decknamen «Ox Alpha» seit dem 20. August 2026 anonym getestet – als erstes nativ multimodales Modell seiner GLM-5-Familie mit offenen, MIT-lizenzierten Gewichten auf Hugging Face.

Warum ist diese KI-Meldung für die Schweiz relevant?

Als MIT-lizenziertes Modell mit offenen Gewichten kann GLM-5.3-Flash von Schweizer KMU und Behörden auf eigener oder Schweizer Cloud-Infrastruktur betrieben werden – ein Vorteil für Organisationen, die aus Datenschutz- oder Datensouveränitätsgründen keine Anfragen an US-amerikanische oder chinesische API-Anbieter senden wollen.

Welche Quelle nutzt KI News Schweiz für diese Einordnung?

SiliconANGLE berichtete am 26. August 2026 über die Veröffentlichung von GLM-5.3-Flash; testingcatalog.com, officechai.com und der Cloudflare-Changelog bestätigten am selben Tag die MIT-Lizenz, die technischen Spezifikationen und die Verfügbarkeit auf Workers AI.