Szczegóły modelu
StepFun: Step 3.7 Flash
Status: AktywnyDostęp API
Profil techniczny
Kluczowe dane modelu
Pokazujemy wyłącznie dostępne, potwierdzone informacje.
- Okno kontekstu
- 262 144tokenów · dane modelu/API
- Modalność
- Tekst + obraz + wideo → tekst
Opis modelu
[ModelPage]: https://static.stepfun.com/blog/step-3.7-flash/ Step 3.7 Flash to rzadki model wizyjno-językowy oparty na mieszance ekspertów (MoE) z 198B parametrów, łączący szkielet językowy z 196B parametrów z enkoderem wizyjnym o 1,8B parametrów do natywnego rozumienia obrazów. Zaprojektowany do pracy w środowisku produkcyjnym o wysokiej częstotliwości, aktywuje około 11B parametrów na token i osiąga przepustowość do 400 tokenów na sekundę. Step 3.7 Flash obsługuje okno kontekstowe o wielkości 256k i oferuje trzy wybory poziomu rozumowania (niski, średni, wysoki), umożliwiając programistom łatwe równoważenie szybkości, kosztów i głębokości poznawczej. Stworzyliśmy Step 3.7 Flash dla programistów, którzy potrzebują skalować agentowe przepływy pracy łączące percepcję, wyszukiwanie i rozumowanie. Jest zaprojektowany do obsługi intensywnych zadań, takich jak jednorazowe parsowanie ogromnych raportów finansowych, przeprowadzanie wieloetapowych pętli wyszukiwania z weryfikacją krzyżową lub obsługa współbieżnych agentów kodowania w potokach o wysokiej przepustowości. Model dostarcza najwyższej klasy inteligencję wizualną, zajmując pierwsze miejsce w SimpleVQA (Search) z wynikiem 79,2 i osiągając parytet graniczny w V* (Python) z wynikiem 95,3. Te wskaźniki odzwierciedlają silne ugruntowanie wizualne i rozumowanie wspomagane wyszukiwaniem wykraczające poza podstawowy opis obrazu. Model dokładnie przetwarza gęste interfejsy wizualne, takie jak makiety UI, GUI aplikacji i wykresy danych, mapując je na ustrukturyzowany kod. Gdy napotka niekompletny zasób wizualny, może samodzielnie zidentyfikować brakujące dane i przeprowadzić wyszukiwanie w celu zweryfikowania kontekstu przed zwróceniem faktycznie zweryfikowanego wniosku. Niezawodność przepływu pracy i orkiestracja narzędzi Niezawodność wykonania jest kluczowa dla autonomicznych agentów. Step 3.7 Flash prowadzi w benchmarku ClawEval-1.1 z wynikiem 67,1, znacząco przewyższając najbliższego konkurenta z wynikiem 59,8. Ta wydajność pokazuje wysoką odporność na pułapki adwersarialne i ścisłe przestrzeganie polityk systemu podczas wieloetapowej orkiestracji. Wsparty wynikami 49,5 w Toolathlon i 48,1 w HLE z narzędziami, ten profil zapewnia wysoką integralność trajektorii. Step 3.7 Flash niezawodnie współdziała z zewnętrznymi API i wykonuje długoterminowe przepływy pracy bez odchodzenia od instrukcji lub naruszania ograniczeń systemowych. Inżynieria kodu i profesjonalne linie bazowe Step 3.7 Flash został stworzony do zadań inżynieryjnych na żywo i zdobył definitywne drugie miejsce w SWE-Bench PRO z wynikiem 56,3. Może samodzielnie śledzić repozytoria wieloplikowe, izolować błędy z surowych raportów o problemach i generować funkcjonalne łatki, które przechodzą automatyczne testy jednostkowe. Podczas gdy oceny takie jak Terminal-Bench 2.1 (59,5) i GDPVal-AA (45,8) wskazują na wyraźne obszary przyszłej optymalizacji w porównaniu do absolutnego szczytu kohorty, ustanawiają one niezawodną linię bazową dla interakcji systemowych i ustrukturyzowanych profesjonalnych wyników.
Ostatnia aktualizacja: 2026-08-18
Szybka opinia
Czy ten model pomógł Ci w realnym zadaniu? To zajmuje jedno kliknięcie. Szczegółowa ocena jest opcjonalna.
Brak szybkich opinii.
API i ceny
Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API.
Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.
| Dostawca API | Wejście / 1 mln tokenów | Wyjście / 1 mln tokenów | Pozostałe stawki źródłowe | Możliwości |
|---|---|---|---|---|
| OpenRouter | 0,743 zł / 1 mln tokenów | 4,27 zł / 1 mln tokenów | Cache odczyt: 0,149 zł / 1 mln tokenów | Kontekst providera: 256 000 · Maks. odpowiedź: 256 000 · Tokenizer: Other · Wejście: text, image, video · Wyjście: text · API: frequency_penalty, include_reasoning, logit_bias, logprobs, max_tokens · Bez moderacji providera |
Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API. Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.
Język polski
Wsparcie języka polskiego: deklarowane. Jakość języka polskiego: NIEZWERYFIKOWANA.
Dyskusja o modelu
Komentarze dotyczące praktycznego użycia tego modelu.
Nie ma jeszcze zatwierdzonych komentarzy.
Historia modelu
Wykres pokazuje wyłącznie porównywalne punkty głównego rankingu. Tabela zawiera wynik, pozycję, dane źródłowe i stan każdego dnia.
Dane porównywalne
Historia wyniku AI-TOP
Seria używa snapshotów głównego rankingu z metodologii 1.2.
Skala adaptacyjna: obserwowany zakres 64–70 pkt / 100.
- Wynik AI-TOP
| Data | Wynik AI-TOP | Miejsce | Dane źródłowe | Metodologia | Stan dnia |
|---|---|---|---|---|---|
| 2026-08-18 |
|
|
|
|
|
| 2026-08-17 |
|
|
|
|
|
| 2026-08-16 |
|
|
|
|
|
| 2026-08-15 |
|
|
|
|
|
| 2026-08-14 |
|
|
|
|
|
| 2026-08-13 |
|
|
|
|
|
| 2026-08-12 |
|
|
|
|
|
| 2026-08-11 |
|
|
|
|
|
| 2026-08-10 |
|
|
|
|
|
| 2026-08-09 |
|
| — |
|
|
| 2026-08-08 |
|
| — |
|
|
| 2026-08-07 |
|
|
|
|
|
| 2026-07-26 |
|
|
|
|
|
| 2026-07-25 |
|
|
|
|
|
| 2026-07-22 |
|
| — |
|
|
| 2026-07-21 | — | — |
| — |
|
| 2026-07-20 |
|
|
|
|
|
| 2026-07-19 |
|
| — |
|
|
| 2026-07-18 |
|
|
|
|
|
| 2026-07-17 | — | — |
| — |
|