Qwen3.8-Max: So viel günstiger ist Alibabas neues KI-Modell
Alibaba hat mit Qwen3.8-Max sein bisher größtes und leistungsfähigstes KI-Modell veröffentlicht. Es ist seit dem 3. August 2026 über die Alibaba Cloud nutzbar und tritt direkt gegen westliche Spitzenmodelle wie Claude Opus an. Die wichtigste Botschaft dabei: Qwen3.8-Max ist nicht in jedem Punkt besser oder schneller, aber deutlich günstiger – bei einer Leistung, die vielerorts mithalten kann.
Was steckt technisch dahinter?
Das Modell basiert auf einer sogenannten Mixture-of-Experts-Architektur: Von insgesamt 2,4 Billionen Parametern ist pro Anfrage nur ein Teil – rund 95 Milliarden – aktiv. Das senkt die Betriebskosten, ohne die Größe und Vielseitigkeit des Modells einzuschränken. Zusätzlich verarbeitet Qwen3.8-Max bis zu eine Million Tokens auf einmal, verarbeitet also auch sehr große Dokumente, Codebasen oder Bildmaterial in einem Durchgang.
Wie viel günstiger ist Qwen3.8-Max?
Der Preis pro verarbeitete Million Tokens macht den Unterschied deutlich sichtbar:
| Modell | Input (pro 1 Mio. Token) | Output (pro 1 Mio. Token) |
|---|---|---|
| Qwen3.8-Max | 2,00 $ | 6,00 $ |
| Qwen3.7-Max (Vorgänger) | 2,50 $ | 7,50 $ |
| Claude Opus | 5,00 $ | 25,00 $ |
Im Vergleich zum Vorgänger: 20 % günstiger, sowohl beim Input als auch beim Output.
Im Vergleich zu Claude Opus: 2,5x günstiger beim Input, gut 4x günstiger beim Output. Eine Aufgabe, die mit Claude Opus mehrere Hundert Dollar kosten würde, lässt sich mit Qwen3.8-Max für einen Bruchteil davon umsetzen.
Ist Qwen3.8-Max auch schneller?
Nein, das lässt sich mit Zahlen aktuell nicht belegen. Alibaba hat keine offiziellen Geschwindigkeitswerte (Tokens pro Sekunde) veröffentlicht. Erste Praxisberichte deuten sogar auf das Gegenteil hin: Bei komplexen, selbstständigen Aufgaben arbeitet Qwen3.8-Max eher gründlich als schnell und kann dabei länger brauchen als Claude Opus, etwa weil das Modell mehr Zwischenschritte prüft, bevor es ein Ergebnis liefert.
Der Vorteil von Qwen3.8-Max liegt klar beim Preis, nicht bei der Geschwindigkeit.
Ist die Leistung mindestens genauso gut?
Gegenüber dem eigenen Vorgänger: ja, teils deutlich besser. Bei Agenten-Aufgaben (z. B. dem Benchmark DeepSWE) erreicht Qwen3.8-Max mehr als doppelt so hohe Werte wie Qwen3.7-Max (56,6 statt 21,6 Punkte). Auch bei anderen Coding-Benchmarks wie FrontierSWE hat sich der Wert fast verdoppelt.
Gegenüber Claude Opus fällt das Bild gemischt aus. Bei manchen Aufgaben, etwa dem Terminal-Bench, liegt Qwen3.8-Max leicht vorn (86,6 zu 84,6 Punkten). Bei reinem Programmieren im SWE-bench-Pro-Test bleibt Claude Opus dagegen knapp besser (69,2 zu 67,7 Punkte). Es gibt also kein Modell, das in jeder Disziplin führt – für viele Alltagsaufgaben dürfte der Unterschied in der Praxis aber kaum spürbar sein.
Was kann das Modell selbstständig leisten?
Alibaba zeigt einige Beispiele dafür, wie eigenständig Qwen3.8-Max arbeiten kann:
- Über 10 Tage hinweg allein an einem Softwareprojekt gearbeitet, inklusive eigener Tests und Fehlerbehebungen
- Eine wissenschaftliche Studie in rund 125 Stunden komplett eigenständig nachgebaut – und im Anschluss sogar eigene Verbesserungen entwickelt
- Bei einem Chip-Design die Zahl benötigter Bauteile deutlich reduziert
- In einer Handelssimulation das eigene Startkapital mehr als vervierfacht
Verfügbarkeit
Qwen3.8-Max ist bereits über die Cloud-Plattform von Alibaba nutzbar. In der kommenden Woche sollen zusätzlich die offenen Modellgewichte veröffentlicht werden – erstmals bei einem „Max“-Modell von Alibaba. Damit könnten Unternehmen das Modell künftig auch auf eigener Hardware betreiben.
Solche Preisunterschiede zeigen: Es lohnt sich, bei KI-Werkzeugen nicht nur auf den Namen des Anbieters zu schauen, sondern auf das eigene Nutzungsszenario. Bei LK IT Solutions unterstützen wir Unternehmen in Köln und NRW genau bei solchen Fragen – von der sicheren Einbindung neuer Technologien in die bestehende IT-Infrastruktur bis zur laufenden Betreuung Ihrer Systeme. Sie überlegen, wie Sie KI-Tools wie Qwen3.8-Max oder Claude sinnvoll und sicher in Ihrem Unternehmen einsetzen können? Über unsere Kontaktseite erreichen Sie uns direkt.
Fazit
Qwen3.8-Max ist nicht schneller als der Vorgänger oder Claude Opus – aber deutlich günstiger: 20 % weniger als Qwen3.7-Max, bis zu 4x weniger als Claude Opus. Bei einer Leistung, die in vielen Bereichen mithalten kann, ist der Preis der eigentliche Verkaufsgrund.
Häufige Fragen zu Qwen3.8-Max
Wie viel günstiger ist Qwen3.8-Max als der Vorgänger?
20 % – bei Input und Output gleichermaßen.
Wie viel günstiger ist Qwen3.8-Max als Claude Opus?
2,5x günstiger beim Input, rund 4x günstiger beim Output.
Ist Qwen3.8-Max schneller?
Nein, dazu gibt es keine belastbaren Zahlen. Der Vorteil ist der Preis, nicht die Geschwindigkeit.
Ist Qwen3.8-Max besser als Claude Opus?
Teilweise: Bei Agenten-Aufgaben liegt Qwen leicht vorn, bei reinem Programmieren bleibt Claude Opus knapp besser.
Ist Qwen3.8-Max Open Source?
Aktuell nur über die Alibaba Cloud nutzbar. Offene Modellgewichte sollen in Kürze folgen.
Quelle: Offizielle Angaben von Alibaba (Qwen) und Anthropic, Stand: 3. August 2026







