Xiaomi hat zwei offene multimodale KI-Modelle veröffentlicht, die anspruchsvolle Agentenaufgaben zu deutlich niedrigeren Kosten als viele proprietäre Angebote übernehmen sollen. MiMo-V2.6-Pro und MiMo-V2.6-Flash verarbeiten Text, Bilder, Audio und Video. Sie unterstützen ein Kontextfenster von bis zu einer Million Tokens und richten sich an Aufgaben mit vielen Arbeitsschritten, etwa Programmierung, Recherche, Gestaltung und die Bedienung von Software.
Nach Angaben von Xiaomi ist MiMo-V2.6-Pro das bisher leistungsfähigste Modell des Unternehmens. Xiaomi nennt einen Wert von 46,32 im Intelligence Index von Artificial Analysis. Damit liege das Modell vor anderen Open-Weight-Modellen. Carl Franzen berichtet für VentureBeat, MiMo-V2.6-Pro liege in diesem Index gleichauf mit xAIs Grok 4.7 und sei dort das am höchsten bewertete Open-Weight-Modell.
Mit MiMo-V2.6-Flash stellt Xiaomi zudem eine kleinere Variante für viele parallele Anfragen vor. Das Unternehmen sieht Flash als günstigeres Modell, das bei mehreren eigenen und herstellergeführten Agenten-Benchmarks nah an Pro herankommt. Beide Modelle erscheinen unter der MIT-Lizenz. Unternehmen und Entwickler können die Modellgewichte damit herunterladen, anpassen und selbst betreiben.
Training für lange Arbeitsabläufe
Xiaomi hat die Modelle mit Reinforcement Learning weitertrainiert. Bei diesem Verfahren erhält ein Modell Rückmeldungen dafür, ob es Aufgaben erfolgreich löst. Nach Angaben des Unternehmens durchliefen Pro und Flash jeweils 30 große Trainingsschritte mit zusammen rund 750.000 Aufgabenverläufen in weniger als sechs Tagen. Xiaomi beziffert die Kosten auf etwa 2,62 Millionen Dollar für Pro und 850.000 Dollar für Flash.
Im Mittelpunkt standen dabei nicht nur kurze Antworten. Xiaomi erklärt, die Modelle seien auf längere Arbeitsabläufe trainiert worden. Dazu gehören Planung, der Einsatz von Werkzeugen, Tests, Fehlerkorrekturen und die Prüfung von Ergebnissen. Die Trainingsumgebungen deckten Programmierung, allgemeine Agentenaufgaben, visuelle Aufgaben und Cybersicherheit ab.
Ein besonderes Problem ist dabei das sogenannte Reward Hacking. Ein Modell kann Tests bestehen, ohne die eigentliche Aufgabe sauber zu lösen. Xiaomi erklärt, es habe mögliche Quellen für vorgefertigte Antworten gesperrt, Artefakte aus Softwareumgebungen entfernt und separate Systeme nach Schwachstellen suchen lassen. Außerdem verglich das Unternehmen erfolgreiche Lösungswege miteinander. So sollten präzise und effiziente Lösungen stärker belohnt werden als bloße Notlösungen.
Auf dem Software-Engineering-Benchmark DeepSWE v1.1 erreicht MiMo-V2.6-Pro laut Xiaomi 71,9 Punkte. MiMo-V2.5-Pro lag dort bei 19,0 Punkten. Diese Werte stammen vom Hersteller. Xiaomi beansprucht ausdrücklich nicht, geschlossene Modelle wie Claude Opus 5 von Anthropic oder GPT-5.6 Sol von OpenAI in allen Tests zu übertreffen.
Günstige Nutzung und kreative Anwendungen
Für die API nennt Xiaomi bei Pro Preise von 0,435 Dollar pro Million nicht zwischengespeicherter Eingabe-Tokens und 0,87 Dollar pro Million Ausgabe-Tokens. Flash kostet 0,14 Dollar für Eingaben und 0,28 Dollar für Ausgaben. Zusätzlich bietet Xiaomi für Pro einen UltraSpeed-Modus an, der laut Unternehmen eine bis zu 20-mal schnellere Ausgabe ermöglicht.
Neben Programmieraufgaben zeigt Xiaomi Anwendungen für Websites, Präsentationen, Videos, 3D-Szenen und Musik. Die Beispiele reichen von Blender-Objekten über interaktive 3D-Welten bis zur Steuerung eines simulierten Roboterarms mit Kameraeingaben. Xiaomi beschreibt außerdem Versuche zur Materialforschung und zur Formalisierung eines mathematischen Satzes in Lean 4.
Diese Beispiele zeigen das angestrebte Einsatzspektrum. Sie belegen jedoch nicht unabhängig, dass die Modelle solche Aufgaben ohne fachliche Kontrolle zuverlässig erledigen. Bemerkenswert ist die Veröffentlichung dennoch, weil Xiaomi nicht nur Modellgewichte bereitstellt. Das Unternehmen will auch Trainingsumgebungen, Code für Reinforcement Learning und technische Dokumentationen offenlegen. Damit erhalten andere Teams einen genaueren Einblick in das Training großer KI-Agenten.
Quellen
- Xiaomi debuts open-weight omnimodal models MiMo-V2.6 Pro and Flash – Xiaomi MiMo
- MiMo-V2.6-Pro ties Grok 4.7 and beats GLM-5.3 on Artificial Analysis’ Intelligence Index – VentureBeat
Bleib auf dem Laufenden
KI für Contentprofis: die neuesten Tools, Tipps und Trends. Alle 14 Tage in deine Inbox: