Przejdź do treści

Szczegóły modelu

Xiaomi: MiMo-V2.5-Pro

Status: AktywnyDostęp API

Dostawca: xiaomi →Dodaj do porównania

Profil techniczny

Kluczowe dane modelu

Pokazujemy wyłącznie dostępne, potwierdzone informacje.

Modalność
Tekst → tekst

Opis modelu

? HuggingFace · ? Blog · ? Xiaomi MiMo API Platform · ?️ Xiaomi MiMo Studio · Community WeChat Group · Discord · Telegram · Reddit MiMo-V2.5-Pro to otwarty model językowy oparty na mieszance ekspertów (MoE) z łączną liczbą 1,02T parametrów i 42B aktywnymi parametrami. Wykorzystuje architekturę hybrydowej uwagi oraz 3-warstwową wielotokenową predykcję (MTP) wprowadzoną w MiMo-V2-Flash, z długością kontekstu do 1M tokenów. MiMo-V2.5-Pro to nasz najbardziej zaawansowany model do tej pory, zaprojektowany do najbardziej wymagających zadań agentowych, złożonej inżynierii oprogramowania i długoterminowych zadań. Obsługuje złożone trajektorie obejmujące tysiące wywołań narzędzi z silnym przestrzeganiem instrukcji i spójnością w oknie kontekstowym 1M tokenów. Kluczowe cechy obejmują:

  • Hybrydowa architektura uwagi: Przeplata uwagę okienną przesuwną (SWA) i uwagę globalną (GA) w stosunku 6:1 z przesuwnym oknem 128. Zmniejsza to przechowywanie pamięci podręcznej KV prawie 7-krotnie, przy jednoczesnym utrzymaniu wydajności długiego kontekstu za pomocą uczonego obciążenia uwagi.
  • Wielotokenowa predykcja (MTP): Wyposażony w trzy lekkie moduły MTP wykorzystujące gęste FFN. To potraja prędkość wyjściową podczas wnioskowania i będzie dobrą metodą przyspieszenia wdrożenia w treningu RL.
  • Wydajne przedtrening: Trenowany na 27T tokenach z użyciem mieszanej precyzji FP8 i natywnej długości sekwencji 32k. Okno kontekstowe obsługuje do 1M tokenów.
  • Zdolności agentowe: Potrening wykorzystuje SFT, wielkoskalowe agentowe RL i wielonauczycielską dystylację na-polityce (MOPD), osiągając doskonałą wydajność w najbardziej wymagających zadaniach agentowych, złożonej inżynierii oprogramowania i długoterminowych zadaniach.
ModelCałkowita liczba parametrówAktywna liczba parametrówDługość kontekstuPrecyzjaPobierz
MiMo-V2.5-Pro1.02T42B1MFP8 (E4M3) Mixed? HuggingFace ? ModelScope
MiMo-V2.5-Pro-Base1.02T42B256KFP8 (E4M3) Mixed? HuggingFace ? ModelScope
KategoriaBenchmarkUstawienieMiMo-V2.5-Pro BaseMiMo-V2.5 BaseDeepSeek-V4-Pro BaseDeepSeek-V4-Flash BaseKimi-K2 Base
Parametry#Aktywowane / #Całkowite42B / 1.02T15B / 310B49B / 1.6T13B / 284B32B / 1.04T
OgólneBBH3-shot88.487.287.586.988.7
MMLU5-shot89.486.390.188.787.8
MMLU-Redux5-shot92.889.890.889.490.2
MMLU-Pro5-shot68.565.873.568.369.2
DROP3-shot86.383.788.788.683.6
ARC-Challenge25-shot97.296.596.2
HellaSwag10-shot89.888.688.085.794.6
WinoGrande5-shot85.684.781.579.585.3
TriviaQA5-shot81.380.785.682.885.1
GPQA-Diamond5-shot66.758.148.1
MatematykaGSM8K8-shot99.683.392.690.892.1
MATH4-shot86.267.764.557.470.2
AIME 24&252-shot37.336.931.6
KodHumanEval+1-shot75.671.384.8
MBPP+3-shot74.170.973.8
LiveCodeBench v61-shot39.635.526.3
SWE-Bench (AgentLess)3-shot35.730.828.2
ChińskiC-Eval5-shot91.588.693.192.192.5
CMMLU5-shot90.288.290.890.490.9
WielojęzycznyGlobalMMLU5-shot83.677.480.7

GraphWalks to benchmark długiego kontekstu firmy OpenAI, który wypełnia prompt skierowanym grafem węzłów heksadecymalnych i prosi model o przeprowadzenie przeszukiwania wszerz (węzły dokładnie na głębokości N) lub wymienienie rodziców węzła. Oceniamy w pełnym zakresie wejściowych tokenów od 32k do 1M i stosujemy te same poprawki ewaluacyjne opisane przez Anthropic.

Szybka opinia

Czy ten model pomógł Ci w realnym zadaniu? To zajmuje jedno kliknięcie. Szczegółowa ocena jest opcjonalna.

Brak szybkich opinii.

Zaloguj się, aby oddać szybką opinię.

Ocena użytkowników

Brak ocen użytkowników. Wynik AI-TOP pozostaje odrębną miarą techniczną.

API i ceny

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API.

Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.

Aktualne źródłowe stawki API
Dostawca APIWejście / 1 mln tokenówWyjście / 1 mln tokenówPozostałe stawki źródłoweMożliwości
OpenRouter1,62 zł / 1 mln tokenów3,23 zł / 1 mln tokenówCache odczyt: 0,013 zł / 1 mln tokenówKontekst providera: 1 048 576 · Maks. odpowiedź: 131 072 · Tokenizer: Other · Wejście: text · Wyjście: text · API: frequency_penalty, include_reasoning, logit_bias, logprobs, max_tokens · Bez moderacji providera

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API. Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.

Język polski

Wsparcie języka polskiego: deklarowane. Jakość języka polskiego: NIEZWERYFIKOWANA.

Dyskusja o modelu

Komentarze dotyczące praktycznego użycia tego modelu.

Nie ma jeszcze zatwierdzonych komentarzy.

Zaloguj się, aby komentować.

Historia modelu

Wykres pokazuje wyłącznie porównywalne punkty głównego rankingu. Tabela zawiera wynik, pozycję, dane źródłowe i stan każdego dnia.

Dane porównywalne

Historia wyniku AI-TOP

Seria używa snapshotów głównego rankingu z metodologii 1.2.

Skala adaptacyjna: obserwowany zakres 65–75 pkt / 100.

  • Wynik AI-TOP
Historia wyniku AI-TOPWykres obejmuje 16 dat od 2026-07-20 do 2026-08-18. Zakres osi: 65–75 pkt / 100. Skala osi jest adaptacyjna do obserwowanego zakresu.757370686520 lip7 sie11 sie14 sie18 sie
Dzienny zapis wyniku, pozycji, źródeł i statusu
DataWynik AI-TOPMiejsceDane źródłoweMetodologiaStan dnia
2026-08-18
  • 67,33 / 100
  • #23
  • OpenRouter: popularność #27
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-17
  • 67,94 / 100
  • #21
  • OpenRouter: popularność #25
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-16
  • 67,60 / 100
  • #24
  • OpenRouter: popularność #26
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-15
  • 68,09 / 100
  • #21
  • OpenRouter: popularność #25
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-14
  • 68,12 / 100
  • #21
  • OpenRouter: popularność #25
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-13
  • 68,09 / 100
  • #20
  • OpenRouter: popularność #25
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-12
  • 68,46 / 100
  • #19
  • OpenRouter: popularność #24
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-11
  • 68,43 / 100
  • #19
  • OpenRouter: popularność #24
  • 1.2
  • Ranking zapisany
  • Źródła: 1
  • Aktualizacja ceny API
2026-08-10
  • 72,49 / 100
  • #12
  • OpenRouter: popularność #24
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-09
  • 72,43 / 100
  • #12
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-08
  • 72,47 / 100
  • #12
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-07
  • 72,50 / 100
  • #12
  • OpenRouter: popularność #24
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-26
  • 73,50 / 100
  • #12
  • Artificial Analysis 27,90 score
  • OpenRouter: popularność #18
  • 1.2
  • Ranking zapisany
  • Źródła: 2
2026-07-25
  • 73,37 / 100
  • #13
  • OpenRouter: popularność #19
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-22
  • 73,80 / 100
  • #13
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-21
  • Artificial Analysis 27,90 score
  • OpenRouter: popularność #16
  • Brak snapshotu rankingu
  • Źródła: 2
2026-07-20
  • 73,67 / 100
  • #8
  • OpenRouter: popularność #17
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-19
  • 73,57 / 100
  • #7
  • 1.1
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-18
  • 73,57 / 100
  • #14
  • OpenRouter: popularność #15
  • 1.1
  • Ranking zapisany
  • Źródła: 1
  • Aktualizacja ceny API
2026-07-17
  • OpenRouter: popularność #15
  • Brak snapshotu rankingu
  • Źródła: 1
  • Aktualizacja ceny API

Dane historii w formacie JSON