5 / 3608

Xiaomi verspricht 80 % weniger Rechenkosten für das unveröffentlichte MiMo V3

TL;DR

AI-Modelle kämpfen seit Langem mit Speichereffizienz, Rechenkosten und langen Kontexten. Xiaomi und DeepSeek stellen neue Ansätze vor: DeepSeeks V4.1 Flash teilt Informationen zwischen Layern, um Speicher zu sparen, und Xiaomis HySparse2 Design soll die Rechenkosten beim unveröffentlichten MiMo V3 um 80 Prozent senken. Unabhängige Benchmarks fehlen bisher.

Nauti's Take

Ein Rechenkostenrückgang von 80 Prozent wäre ein echter Fortschritt für günstigere Inferenz und längere Kontexte. Der Haken: Das Modell ist unveröffentlicht, und die Zahl stammt vom Hersteller selbst.

Entwickler sollten die Ankündigung als vielversprechend einordnen, aber auf unabhängige Benchmarks warten, bevor sie Pläne darauf bauen.

Video

Quellen