Szczegóły modelu
Mistral: Mistral Small 4
Status: AktywnyDostęp API
Profil techniczny
Kluczowe dane modelu
Pokazujemy wyłącznie dostępne, potwierdzone informacje.
- Okno kontekstu
- 262 144tokenów · dane modelu/API
- Modalność
- Tekst + obraz → tekst
Opis modelu
Mistral Small 4 to potężny model hybrydowy, który może działać zarówno jako model ogólnych instrukcji, jak i model rozumowania. Łączy możliwości trzech różnych rodzin modeli—Instruct, Reasoning (wcześniej nazywany Magistral) oraz Devstral—w jeden, zintegrowany model. Dzięki swoim multimodalnym możliwościom, efektywnej architekturze i elastycznemu przełączaniu trybów, jest to potężny model ogólnego przeznaczenia do każdego zadania. W konfiguracji zoptymalizowanej pod kątem opóźnień, Mistral Small 4 osiąga 40% redukcji czasu realizacji od początku do końca, a w konfiguracji zoptymalizowanej pod kątem przepustowości obsługuje 3 razy więcej zapytań na sekundę w porównaniu do Mistral Small 3. Aby dodatkowo poprawić efektywność, można skorzystać z:
- Dekodowania spekulacyjnego dzięki naszemu wytrenowanemu modelowi
mistralai/Mistral-Small-4-119B-2603-eagle. - Kwantyzacji precyzji 4 bitów zmiennoprzecinkowych dzięki naszemu punktowi kontrolnemu NVFP4
mistralai/Mistral-Small-4-119B-2603-NVFP4. Mistral Small 4 zawiera następujące wybory architektoniczne: - MoE: 128 ekspertów, 4 aktywne.
- 119B parametrów, z 6.5B aktywowanymi na token.
- 256k długości kontekstu.
- Multimodalny input: Akceptuje zarówno tekst, jak i obrazy, z wyjściem tekstowym.
- Funkcjonalności Instruct i Reasoning z wywołaniami funkcji (wysiłek rozumowania konfigurowalny na żądanie). Mistral Small 4 oferuje następujące możliwości:
- Tryb rozumowania: Przełączanie między trybem szybkiej odpowiedzi a trybem rozumowania, zwiększając wydajność przy obliczeniach w czasie testu na żądanie.
- Wizja: Analizuje obrazy i dostarcza spostrzeżenia na podstawie treści wizualnej, oprócz tekstu.
- Wielojęzyczność: Obsługuje dziesiątki języków, w tym angielski, francuski, hiszpański, niemiecki, włoski, portugalski, niderlandzki, chiński, japoński, koreański i arabski.
- System Prompt: Silne przestrzeganie i wsparcie dla systemowych podpowiedzi.
- Agentic: Najlepsze w swojej klasie możliwości agentowe z natywnym wywoływaniem funkcji i wyjściem JSON.
- Optymalizacja prędkości: Oferuje najlepszą w swojej klasie wydajność i prędkość.
- Licencja Apache 2.0: Licencja open-source zarówno do użytku komercyjnego, jak i niekomercyjnego.
- Duże okno kontekstowe: Obsługuje okno kontekstowe o długości 256k.
- Wysiłek rozumowania: –
'none'→ Nie używaj rozumowania –'high'→ Użyj rozumowania (zalecane dla złożonych podpowiedzi) Użyjreasoning_effort="high"dla złożonych zadań – Temperatura: 0.7 dlareasoning_effort="high". Temperatura między 0.0 a 0.7 dlareasoning_effort="none"w zależności od zadania.
Ostatnia aktualizacja: 2026-08-18
Szybka opinia
Czy ten model pomógł Ci w realnym zadaniu? To zajmuje jedno kliknięcie. Szczegółowa ocena jest opcjonalna.
Brak szybkich opinii.
API i ceny
Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API.
Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.
| Dostawca API | Wejście / 1 mln tokenów | Wyjście / 1 mln tokenów | Pozostałe stawki źródłowe | Możliwości |
|---|---|---|---|---|
| OpenRouter | 0,557 zł / 1 mln tokenów | 2,23 zł / 1 mln tokenów | Cache odczyt: 0,056 zł / 1 mln tokenów | Kontekst providera: 262 144 · Tokenizer: Mistral · Wejście: text, image · Wyjście: text · API: frequency_penalty, include_reasoning, max_tokens, presence_penalty, reasoning · Bez moderacji providera |
Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API. Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.
Język polski
Wsparcie języka polskiego: deklarowane. Jakość języka polskiego: NIEZWERYFIKOWANA.
Dyskusja o modelu
Komentarze dotyczące praktycznego użycia tego modelu.
Nie ma jeszcze zatwierdzonych komentarzy.
Historia modelu
Wykres pokazuje wyłącznie porównywalne punkty głównego rankingu. Tabela zawiera wynik, pozycję, dane źródłowe i stan każdego dnia.
Dane porównywalne
Historia wyniku AI-TOP
Seria używa snapshotów głównego rankingu z metodologii 1.2.
Skala adaptacyjna: obserwowany zakres 43,5–45,0 pkt / 100.
- Wynik AI-TOP
| Data | Wynik AI-TOP | Miejsce | Dane źródłowe | Metodologia | Stan dnia |
|---|---|---|---|---|---|
| 2026-08-18 |
|
| — |
|
|
| 2026-08-17 |
|
| — |
|
|
| 2026-08-16 |
|
| — |
|
|
| 2026-08-15 |
|
| — |
|
|
| 2026-08-14 |
|
| — |
|
|
| 2026-08-13 |
|
| — |
|
|
| 2026-08-12 |
|
| — |
|
|
| 2026-08-11 |
|
| — |
|
|
| 2026-08-10 |
|
| — |
|
|
| 2026-08-09 |
|
| — |
|
|
| 2026-07-18 | — | — |
| — |
|
| 2026-07-17 | — | — |
| — |
|