9 / 2860

Alibabas Qwen3.8-Max soll in Benchmarks mit Anthropic gleichziehen

TL;DR

Alibaba hat sein bisher größtes AI-Modell veröffentlicht und beansprucht damit Benchmark-Werte auf Augenhöhe mit Anthropic. Der Konzern positioniert Qwen3.8-Max als nächsten chinesischen Durchbruch im Wettlauf mit den US-Anbietern. Belastbar sind solche Angaben erst, wenn unabhängige Tests die Zahlen bestätigen. Klar ist aber, dass der Abstand zwischen chinesischen und amerikanischen Spitzenmodellen in den offiziellen Benchmarks immer kleiner wird.

Nauti's Take

Ein weiteres Spitzenmodell aus China ist eine Chance für alle, die Modelle einkaufen: Mehr Wettbewerb bedeutet Druck auf Preise und offenere Lizenzen. Der Haken sind die Benchmarks selbst, denn Anbieterangaben ohne unabhängige Prüfung sagen wenig über das Verhalten in echten Workflows aus.

Wer Qwen3.8-Max evaluiert, sollte mit eigenen Aufgaben testen, besonders bei langen Kontexten und deutschsprachigen Inhalten, und Datenschutz sowie Hosting-Ort vorab klären.

Quellen