Xiaomi MiMo-V2.6 bringt eine Million Token Kontext

Xiaomi MiMo-V2.6 bietet 1 Million Token Kontext, multimodale Eingaben und offene Modellgewichte für eigene KI-Setups.

Heller KI-Prozessor mit Symbolen für Text, Bild, Video und Audio als Motiv für Xiaomi MiMo-V2.6.

Xiaomi hat am 22. September 2026 die Modellreihe MiMo-V2.6 veröffentlicht. Pro und Flash verarbeiten Text, Bilder, Video und Audio und unterstützen laut Xiaomi ein Kontextfenster von einer Million Token.

Für Unternehmen ist vor allem die Kombination aus offenen Modellgewichten, API-Zugang und langem Kontext interessant. Damit wächst die Auswahl zwischen Cloud AI und selbst betriebenen KI-Modellen um eine weitere Modellfamilie.

Was Xiaomi mit MiMo-V2.6 veröffentlicht

Die Reihe umfasst MiMo-V2.6-Pro und MiMo-V2.6-Flash. Xiaomi stellt beide Modelle über die eigene API bereit und veröffentlicht zusätzlich Modellgewichte sowie einen technischen Bericht. Hinzu kommt das kleinere MiMo-V2.6-Distill-Qwen-9B.

Xiaomi veröffentlicht außerdem mehr als 7.000 Umgebungen für Reinforcement Learning. Sie decken unter anderem Softwareentwicklung, Schwachstellenreproduktion, wissensintensive Aufgaben und Webentwicklung ab. Bestandteile des RL-Trainingsframeworks und sogenannte Harnesses stehen ebenfalls zur Verfügung.

Der Hersteller bezeichnet die Veröffentlichung als vollständig Open Source. Öffentlich belegt sind unter anderem Modellgewichte, technischer Bericht, RL-Code und Trainingsressourcen. Für die Modelle selbst lässt sich damit mindestens eine Open-Weights-Verfügbarkeit eindeutig feststellen.

MiMo-V2.6 verarbeitet bis zu eine Million Token

MiMo-V2.6-Pro nutzt eine Sparse-Mixture-of-Experts-Architektur. Die Modellkarte nennt rund 1,02 Billionen Parameter, von denen pro Token 42 Milliarden aktiviert werden. Als Eingaben unterstützt das Modell Text, Bilder, Video und Audio. Die Ausgabe erfolgt als Text.

Das Kontextfenster umfasst eine Million Token. Lange Kontexte können bei großen Codebeständen, umfangreichen Dokumentensammlungen oder länger laufenden Agentenprozessen relevant werden. Die maximale Kontextgröße allein sagt jedoch nichts darüber aus, wie zuverlässig das Modell Informationen über diese gesamte Länge verarbeitet.

Open Weights ermöglichen eigene Betriebsmodelle

Die Gewichte von MiMo-V2.6-Pro stehen auf Hugging Face unter MIT-Lizenz bereit. Die Modellseite dokumentiert unter anderem Bereitstellung über Transformers, vLLM und SGLang. Auch Quantisierungen für weitere Laufzeitumgebungen werden dort angeboten.

Damit lässt sich das Modell grundsätzlich auf eigener Infrastruktur einsetzen. Wie praktikabel das bei dieser Modellgröße ist, hängt jedoch von Hardware, Quantisierung, Inferenzsoftware und den gewünschten Antwortzeiten ab.

Die grundsätzlichen Anforderungen ähneln anderen Szenarien, in denen Unternehmen KI lokal betreiben. Offene Gewichte ersetzen dabei keine Produktionsarchitektur. Zugriffsschutz, Monitoring, Updates, Datenklassifizierung und belastbare Betriebsprozesse bleiben notwendig.

Wie MiMo-V2.6 in unabhängigen Benchmarks abschneidet

Artificial Analysis bewertet MiMo-V2.6-Pro aktuell mit 46 Punkten im eigenen Intelligence Index. Innerhalb der dort verglichenen Klasse offener Modelle steht MiMo-V2.6-Pro derzeit auf Rang eins von 114 erfassten Modellen.

Das Ergebnis ist eine Benchmark-Messung und kein allgemeiner Nachweis für die beste Modellwahl. Qualität kann je nach Anwendung, Prompting, Sprache, Latenz und Sicherheitsanforderungen deutlich variieren. Für produktive Unternehmensanwendungen bleiben eigene Tests mit realen Workloads entscheidend.

Die Ausrichtung auf Agenten und lange Aufgabenketten passt zugleich zu einer Entwicklung, die IT-Dock bereits beim Thema Agentic AI betrachtet hat. Modelle werden zunehmend nicht nur für einzelne Antworten, sondern als Bestandteil längerer automatisierter Abläufe eingesetzt.

Was MiMo-V2.6 für Unternehmen interessant macht

Neben dem eigenen Betrieb bietet Xiaomi die Modelle über eine API an. Artificial Analysis weist für MiMo-V2.6-Pro derzeit 0,435 US-Dollar je Million nicht gecachter Input-Token und 0,87 US-Dollar je Million Output-Token aus.

MiMo-V2.6-Flash kostet laut Xiaomi 0,14 US-Dollar je Million nicht gecachter Input-Token und 0,28 US-Dollar je Million Output-Token. Für Cache-Treffer nennt Xiaomi 0,0028 US-Dollar je Million Token.

Damit entsteht eine weitere Option für Unternehmen, die zwischen eigener Inferenz und API-Nutzung abwägen. Bei hohen Volumina beeinflussen Hardwarebedarf, Auslastung, Antwortzeit und Tokenpreise die Gesamtkosten stärker als einzelne Benchmarkwerte.

Welche Fragen zum Unternehmenseinsatz noch offen sind

Die Modellreihe ist erst seit dem 22. September verfügbar. Belastbare Praxiserfahrungen zu Stabilität, Hardwarebedarf, Support und Betrieb in europäischen Unternehmensumgebungen liegen deshalb noch kaum vor.

Auch ein Kontextfenster von einer Million Token sollte nicht mit garantierter Ergebnisqualität gleichgesetzt werden. Vor einem produktiven Einsatz sind Tests mit eigenen Dokumenten, Sicherheitsanforderungen und typischen Workloads notwendig.

Xiaomi MiMo-V2.6 erweitert den Markt für offene KI-Modelle um eine große multimodale Modellfamilie. Für IT-Entscheider sind besonders offene Gewichte, API-Kosten und alternative Betriebsmodelle relevant.

Der IT-Dock Newsletter bündelt regelmäßig Entwicklungen rund um KI-Infrastruktur, Cloud und Unternehmens-IT.

Weiterführende Artikel

News
25 Sep. 2026 4 Min. Lesezeit

ADFGVX-Funkspruch: KI entschlüsselt Nachricht von 1918

Was belegt ist, warum der Schlüssel Fragen aufwirft und was offenbleibt.

IT-Dock Redaktion Jetzt lesen →
News
24 Sep. 2026 3 Min. Lesezeit

Googlebook: Neue KI-Laptops starten im Oktober in Deutschland

Google nennt Preis und Gemini-Funktionen. Für Unternehmen bleiben Fragen offen.

IT-Dock Redaktion Jetzt lesen →
News
24 Sep. 2026 4 Min. Lesezeit

Linux-Sicherheitslücken: Angriffe auf Kernel-Lücken

Was Unternehmen zu drei Kernel-CVEs und verfügbaren Updates wissen müssen.

IT-Dock Redaktion Jetzt lesen →
News
23 Sep. 2026 3 Min. Lesezeit

Alibaba Cloud baut Rechenzentren in Deutschland aus

Eine Cloud-Regionen in Europa soll eröffnet werden. Die Pläne im Überblick.

IT-Dock Redaktion Jetzt lesen →
News
23 Sep. 2026 3 Min. Lesezeit

CVE-2026-93616: Check Point meldet aktive Angriffe

CVE-2026-93616 trifft Check Point Management. Der Hersteller bestätigt Angriffe und empfiehlt Hotfixes und Log-Prüfung.

IT-Dock Redaktion Jetzt lesen →
News
23 Sep. 2026 5 Min. Lesezeit

HPE Oracle AI Networking: Neue Netze für KI-Cluster

Oracle setzt für große KI-Cluster auf Juniper-Netze mit RoCEv2, Telemetrie und Congestion Management.

IT-Dock Redaktion Jetzt lesen →
News
22 Sep. 2026 4 Min. Lesezeit

KI-Nutzung: Deutschland 32,3 Prozent, Schweiz 39,1 Prozent

Microsoft-Daten zeigen auch für Schweiz und Österreich weitere Zuwächse.

IT-Dock Redaktion Jetzt lesen →
News
22 Sep. 2026 4 Min. Lesezeit

HERMES Kurzwellenfunk: Digitale Daten ohne Mobilfunk

HERMES Kurzwellenfunk überträgt Dateien ohne Mobilfunk oder Satelliten. Das Open-Source-System nutzt dafür HF-Funk.

IT-Dock Redaktion Jetzt lesen →
News
22 Sep. 2026 4 Min. Lesezeit

AWS European Sovereign Cloud: Bedrock jetzt verfügbar

AWS European Sovereign Cloud erhält Amazon Bedrock mit Gemma 4. Die KI-Inferenz bleibt laut AWS innerhalb der EU-Region.

IT-Dock Redaktion Jetzt lesen →
News
21 Sep. 2026 4 Min. Lesezeit

BSI KI-Agenten: Neue Prüfanforderungen für mehr Sicherheit

PRAKI soll neue Prüfanforderungen entwickeln und die Sicherheit agentischer KI systematisch bewerten.

IT-Dock Redaktion Jetzt lesen →

Kommentare (0)

Noch keine Kommentare vorhanden.

Back to top