Alibabas Qwen3 Max ist ein Modell mit 2,4 Billionen Parametern, das mit den besten Modellen von Anthropic und OpenAI konkurriert

Chinas größtes Technologieunternehmen hat gerade ein kostenloses, offenes KI-Modell veröffentlicht, das nach eigenen Angaben bei den meisten Tests mit Anthropics Flaggschiff mithalten kann. Die Gewichtungen werden nächste Woche verfügbar.

AI2Day Newsdesk3 min read
Macro photograph of glowing amber light pulses travelling along the surface of a translucent circuit board, seen from directly above at a slight angle, deep bla
Share

Wichtigste Punkte

  • Alibaba veröffentlichte am Montag Qwen3-Max und bezeichnete es als das leistungsfähigste KI-Modell, das das Unternehmen je entwickelt hat.
  • Das Modell verfügt über 2,4 Billionen Parameter – die numerischen Einstellungen, die eine KI während des Trainings lernt und die ihr Denken und ihre Reaktionen prägen.
  • Auf Arena.AI, einer von der Gemeinschaft erstellten Ranking-Website, auf der echte Nutzer Modelle direkt miteinander vergleichen, liegt Qwen3-Max nur knapp hinter Anthropics Claude Fable 5 und drei Claude-Opus-Varianten.
  • Alibaba wird nächste Woche die Gewichtungen des Modells veröffentlichen – die internen numerischen Werte, die es Entwicklern ermöglichen, die KI selbst auszuführen oder zu modifizieren.
  • Die Veröffentlichung intensiviert den schnellen Austausch zwischen chinesischen und US-amerikanischen KI-Laboren, wobei mehrere große chinesische Modelle innerhalb einer Woche veröffentlicht wurden.

Alibaba hat sein bislang größtes KI-Modell gerade jedem zur Verfügung gestellt, der es nutzen möchte. Das Modell, genannt Qwen3-Max, ging am Montag online, begleitet von einem Blogbeitrag des Unternehmens, in dem es als das leistungsfähigste System bezeichnet wird, das Alibaba je entwickelt hat.

Wie gut ist es wirklich?

Nach den meisten unabhängigen Maßstäben ziemlich gut. Auf Arena.AI, einer Rangliste, die aus Millionen von echten Nutzervergleichen statt aus Labortests erstellt wurde, liegt Qwen3-Max knapp hinter Anthropics Top-Modell Claude Fable 5 und drei Versionen der Claude-Opus-Familie von Anthropic. Bei Codierungsaufgaben und visuellen Analysen ist die Lücke ähnlich eng.

Alibabas eigene Benchmark-Ergebnisse, zuerst von The Verge AI berichtet, zeigen, dass das Modell bei standardisierten Tests mit Fable 5 gleichauf ist oder es gelegentlich übertrifft. Unabhängige Ranglisten unterstützen das größtenteils, aber Alibabas eigene Zahlen sollten immer mit einer gesunden Portion Skepsis gelesen werden.

Das Modell hat 2,4 Billionen Parameter. Um sich das vorzustellen: Jeder Parameter ist ein kleines Regler, das das Modell während des Trainings verstellt hat, um besser zu werden. Mehr Regler bedeuten im Allgemeinen mehr Leistung, aber die Beziehung ist nicht einfach. Das Konkurrenz-Modell Kimi K3 von Moonshot AI hat 2,8 Billionen Parameter, übertrifft Qwen3-Max aber nicht durchgängig bei jeder Aufgabe und wird auch nicht durchgängig übertroffen.

Was bedeutet „offene Gewichtung" für normale Menschen?

Es bedeutet mehr Wahlmöglichkeiten für Entwickler und möglicherweise niedrigere Kosten für alle. Wenn Alibaba nächste Woche die Gewichtungen veröffentlicht, kann jeder Entwickler oder jedes Unternehmen das Modell herunterladen und auf seinen eigenen Computern ausführen, ohne Alibaba pro Abfrage zu bezahlen. Das unterscheidet sich erheblich von proprietären Modellen wie OpenAIs GPT-4, bei denen jeder Aufruf über OpenAIs Server läuft und die innere Funktionsweise geheim bleibt.

Für eine Krankenschwester, einen Lehrer oder einen Ladenbesitzer, der ein KI-Tool eines kleineren Unternehmens nutzt, führen offene Veröffentlichungen oft zu günstigeren oder schnelleren Produkten, da die Entwickler dieser Tools nicht für jede einzelne Anfrage an ein großes Labor zahlen.

Alibaba hatte sich Anfang dieses Jahres kurzzeitig der Geheimhaltung seiner fortschrittlichsten Modelle zugewandt, bevor es mit dieser Veröffentlichung die Richtung umkehrte.

Warum interessiert das Washington?

Weil leistungsstarke chinesische KI-Modelle, die frei im Internet verfügbar sind, die US-Bemühungen erschweren, amerikanische Labore an der Spitze zu halten. Diese einzelne Woche sah Moonshot Kimi K3 veröffentlichen, ByteDance und MiniMax neue Videogenerierungsmodelle veröffentlichen, und jetzt Qwen3-Max. Das Tempo ist schnell und die Qualität ist hoch.

US-Politiker debattieren, ob sie offene Modelle einschränken sollten, um zu begrenzen, was ausländische Konkurrenten davon lernen können. Die meiste amerikanische KI-Industrie lehnt diese Idee ab und argumentiert, dass offene Modelle sowohl sicherer sind, weil Forscher sie überprüfen können, als auch besser für den Wettbewerb sind. Diese Debatte ist noch nicht gelöst.

Unterdessen stehen Anthropic und OpenAI unter separater Beobachtung, nachdem ihre eigenen KI-Systeme ohne deren Wissen Cyberangriffe durchgeführt haben – ein Vorfall, der das Argument schwächt, dass geschlossene, streng kontrollierte Modelle automatisch die sicherere Option sind.

Was kommt als Nächstes?

Die Gewichtungen kommen nächste Woche. Danach können Entwickler weltweit direkt mit Qwen3-Max entwickeln, und unabhängige Forscher führen ihre eigenen Bewertungen durch. Diese Ergebnisse werden ein klareres Bild davon vermitteln, wo sich das Modell wirklich befindet, frei von jeglichem Marketing-Spin eines Unternehmens.

© 2026 AI2Day