Xiaomi hat mit dem MiMo-V2.6-Pro ein KI-Modell veröffentlicht, das in Rankings offener Systeme führt und gleichzeitig die Preiserwartungen der Branche durcheinander wirbelt. Das Spitzenmodell erreicht nach Angaben des Unternehmens 46 Punkte im Intelligence Index der Analysefirma Artificial Analysis und ist damit das derzeit stärkste frei verfügbare Modell – vor Konkurrenten wie Qwen. Der entscheidende Unterschied liegt im Preis: Eine Testaufgabe kostet nur rund 0,13 US-Dollar, ein Bruchteil dessen, was vergleichbar starke Modelle verlangen.
Kurz & knapp
- MiMo-V2.6-Pro erreicht 46 Punkte im Intelligence Index und führt Rankings offener KI-Modelle an
- Kosten pro Token: 0,435 USD pro Million Input-Token, 0,87 USD pro Million Output-Token
- Reinforcement-Learning-Training dauerte weniger als 6 Tage und kostete 2,62 Millionen US-Dollar
- Xiaomi veröffentlicht RL-Werkzeuge, Trainingsframework und 7.000 fertige Trainingsaufgaben offen
- Anthropic wirft Xiaomi vor, unerlaubt Daten von Claude abgegriffen zu haben
Der Preis-Leistungs-Durchbruch durch Reinforcement Learning
Den Leistungssprung führt Xiaomi auf stark ausgeweitetes Reinforcement Learning zurück – ein Trainingsverfahren, bei dem Modelle durch Versuch, Feedback und Belohnung lernen. Der Konzern skalierte diese Phase entlang dreier Achsen: größere Datenmengen pro Trainingsschritt, vielfältigere Aufgaben-Umgebungen und mehr Rechenleistung für die Bewertung der Lösungen.
Die Ergebnisse sind beeindruckend: Auf dem Programmier-Test DeepSWE kletterte die Punktzahl des Pro-Modells von 58,4 auf 72,6, die des kleineren Flash-Modells von 48,8 auf 65,7. Das Training für Pro dauerte weniger als sechs Tage und kostete rund 2,62 Millionen US-Dollar; das Flash-Modell entstand für 0,85 Millionen Dollar.
Technisch ist MiMo-V2.6-Pro ein Mixture-of-Experts-Modell mit 1,02 Billionen Parametern, von denen pro Anfrage nur 42 Milliarden aktiv sind. Damit bleibt das System trotz seiner Größe effizient.
Offenheit mit Fragezeichen
Ungewöhnlich ist, dass Xiaomi seine RL-Werkzeuge offenlegt: den technischen Bericht, das komplette Trainingsframework, ein kleineres Modell zum Weitertrainieren sowie rund 7.000 fertige Trainingsaufgaben mit automatischen Prüfern. Diese decken Softwareentwicklung, Cybersicherheit, Büroarbeit, Webdesign und etwa 1.000 Aufgaben zur Musikkomposition ab.
Doch diese demonstrative Offenheit steht in auffälligem Kontrast zu Vorwürfen, die Anthropic nur zwei Wochen zuvor erhob: Der Claude-Entwickler wirft Xiaomi vor, unerlaubt Trainingsdaten über das Modell Claude abgegriffen zu haben, um die eigene MiMo-Modellreihe zu trainieren. Xiaomi hat sich zu diesen Vorwürfen bislang nicht geäußert.
| Aspekt | MiMo-V2.6-Pro | MiMo-V2.6-Flash |
|---|---|---|
| Intelligence Index | 46 Punkte | – |
| Parameter | 1,02 Billionen | – |
| Aktive Parameter | 42 Milliarden | – |
| RL-Kosten | 2,62 Mio. USD | 0,85 Mio. USD |
| Training-Dauer | < 6 Tage | < 6 Tage |
Was das für deutsche Unternehmen bedeutet
Die Nachricht signalisiert eine Verschiebung der KI-Marktdynamik: Etablierte Hardware-Hersteller wie Xiaomi drängen mit eigenen Spitzenmodellen in ein Feld, das lange von OpenAI, Anthropic und Deepseek dominiert wurde. Der aggressive Preis-Punkt könnte Druck auf europäische KI-Anbieter ausüben und den Kostendruck für Unternehmen, die KI-Modelle nutzen, weiter erhöhen. Gleichzeitig wirft der Vorwurf gegen Xiaomi Fragen zur Datensicherheit und zum Schutz proprietärer Trainingsmethoden auf – ein Thema, das für deutsche Firmen mit sensiblen Daten relevant werden könnte, wenn sie ihre Modelle mit offenen Systemen trainieren.
Quellen
Redaktionell verantwortet von Ideal Syka. Quellen und Arbeitsweise: Redaktion & Methode. Hinweise und Korrekturen: ai@i6eal.de.




