Przejdź do treści

Szczegóły modelu

Xiaomi: MiMo-V2.5

Status: AktywnyDostęp API

🤗 HuggingFace · 📰 Blog · 🎨 Platforma API Xiaomi MiMo · 🗨️ Xiaomi MiMo Studio · Grupa społecznościowa WeChat · Discord · Telegram · Reddit ⚠️ Ważne: Informacja o aktualizacji konfiguracji Pliki config.json i tokenizerconfig.json w tym repozytorium zostały zaktualizowane od czasu pierwszej wersji. Jeśli pobrałeś MiMo-V2.5 przed tym commitem (4da2748), pobierz ponownie lub ręcznie zaktualizuj te dwa pliki, aby zapewnić poprawne działanie modelu. Użycie nieaktualnej konfiguracji może prowadzić do obniżonej wydajności modelu. Przepraszamy za wszelkie niedogodności. Szybka naprawa: hf download XiaomiMiMo/MiMo-V2.5 config.json tokenizerconfig.json –local-dir ./MiMo-V2.5 MiMo-V2.5 to natywny model omnimodalny z silnymi możliwościami agentowymi, obsługujący tekst, obraz, wideo i dźwięk w jednolitej architekturze. Zbudowany na bazie MiMo-V2-Flash i rozszerzony o dedykowane enkodery wizyjne i audio, zapewnia solidną wydajność w multimodalnej percepcji, rozumowaniu długiego kontekstu i przepływach pracy agenta. Kluczowe cechy obejmują:

  • Hybrydowa architektura uwagi: Dziedziczy hybrydowy projekt z MiMo-V2-Flash, przeplatając Sliding Window Attention (SWA) i Global Attention (GA) w stosunku 5:1 z oknem przesuwnym o rozmiarze 128. Zmniejsza to przechowywanie KV-cache prawie 6-krotnie, jednocześnie utrzymując wydajność długiego kontekstu dzięki możliwej do nauczenia biasowi attention sink.
  • Natywne omnimodalne enkodery: Wyposażony w Vision Transformer (ViT) o 729M parametrów z hybrydową uwagą okienną i dedykowany enkoder audio zainicjowany wagami z MiMo-Audio, umożliwiający wysokiej jakości rozumienie obrazu, wideo i dźwięku.
  • Wielotokenowa predykcja (MTP): Trzy lekkie moduły MTP z gęstymi FFN przyspieszają wnioskowanie poprzez spekulacyjne dekodowanie i poprawiają efektywność treningu RL.
  • Efektywny trening wstępny: Trenowany na łącznie ~48T tokenów przy użyciu mieszanej precyzji FP8. Okno kontekstu obsługuje do 1M tokenów.

Dostawca: xiaomi →Dodaj do porównania

Dostawca
xiaomi
Modalność
text+image+audio+video->text
Licencja
Nie określono
Kontekst
1 048 576 tokenów
Parametry
Nie określono
Architektura
Nie określono

Ostatnia aktualizacja: 2026-08-07

Szybka opinia

Czy ten model pomógł Ci w realnym zadaniu? To zajmuje jedno kliknięcie. Szczegółowa ocena jest opcjonalna.

Brak szybkich opinii.

Zaloguj się, aby oddać szybką opinię.

Ocena użytkowników

Brak ocen użytkowników. Wynik AI-TOP pozostaje odrębną miarą techniczną.

API i ceny

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API.

Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-07.

Aktualne źródłowe stawki API
Dostawca APIWejście / 1 mln tokenówWyjście / 1 mln tokenówPozostałe stawki źródłoweMożliwości
OpenRouter0,523 zł / 1 mln tokenów1,05 zł / 1 mln tokenówŻądanie: 0 zł / 1 żądanie
Obraz: 0 zł / 1 obraz
Wyszukiwanie: 0 zł / 1 operacja
Reasoning: 0 zł / 1 mln tokenów
Cache odczyt: 0,01 zł / 1 mln tokenów
Cache zapis: 0 zł / 1 mln tokenów
Kontekst providera: 1 048 576 · Maks. odpowiedź: 131 072 · Tokenizer: Other · Wejście: text, audio, image, video · Wyjście: text · API: frequency_penalty, include_reasoning, logit_bias, logprobs, max_tokens · Bez moderacji providera

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API. Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-07.

Język polski

Wsparcie języka polskiego: deklarowane. Jakość języka polskiego: NIEZWERYFIKOWANA.

Dyskusja o modelu

Komentarze dotyczące praktycznego użycia tego modelu.

Nie ma jeszcze zatwierdzonych komentarzy.

Zaloguj się, aby komentować.

Historia modelu

Wykres pokazuje wyłącznie porównywalne punkty głównego rankingu. Tabela zawiera wynik, pozycję, dane źródłowe i stan każdego dnia.

Dane porównywalne

Historia wyniku AI-TOP

Seria używa snapshotów głównego rankingu z metodologii 1.2.

Skala adaptacyjna: obserwowany zakres 73,8–74,6 pkt / 100.

  • Wynik AI-TOP
Historia wyniku AI-TOPWykres obejmuje 5 dat od 2026-07-20 do 2026-08-07. Zakres osi: 73,8–74,6 pkt / 100. Skala osi jest adaptacyjna do obserwowanego zakresu.74,674,474,274,073,820 lip22 lip25 lip26 lip7 sie
Dzienny zapis wyniku, pozycji, źródeł i statusu
DataWynik AI-TOPMiejsceDane źródłoweMetodologiaStan dnia
2026-08-07
  • 74,03 / 100
  • #6
  • OpenRouter: popularność #4
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-26
  • 74,51 / 100
  • #10
  • Artificial Analysis 37,20 score
  • OpenRouter: popularność #1
  • 1.2
  • Ranking zapisany
  • Źródła: 2
2026-07-25
  • 74,52 / 100
  • #12
  • OpenRouter: popularność #1
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-22
  • 74,51 / 100
  • #11
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-21
  • Artificial Analysis 37,20 score
  • OpenRouter: popularność #1
  • Brak snapshotu rankingu
  • Źródła: 2
2026-07-20
  • 74,37 / 100
  • #6
  • OpenRouter: popularność #2
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-19
  • 74,67 / 100
  • #4
  • OpenRouter: popularność #2
  • 1.1
  • Ranking zapisany
  • Źródła: 1
  • Aktualizacja ceny API
2026-07-18
  • 74,70 / 100
  • #11
  • OpenRouter: popularność #2
  • 1.1
  • Ranking zapisany
  • Źródła: 1
  • Aktualizacja ceny API
2026-07-17
  • OpenRouter: popularność #2
  • Brak snapshotu rankingu
  • Źródła: 1
  • Aktualizacja ceny API

Dane historii w formacie JSON