Przejdź do treści

Szczegóły modelu

StepFun: Step 3.7 Flash

Status: AktywnyDostęp API

Dostawca: stepfun →Dodaj do porównania

Profil techniczny

Kluczowe dane modelu

Pokazujemy wyłącznie dostępne, potwierdzone informacje.

Modalność
Tekst + obraz + wideo → tekst

Opis modelu

[ModelPage]: https://static.stepfun.com/blog/step-3.7-flash/ Step 3.7 Flash to rzadki model wizyjno-językowy oparty na mieszance ekspertów (MoE) z 198B parametrów, łączący szkielet językowy z 196B parametrów z enkoderem wizyjnym o 1,8B parametrów do natywnego rozumienia obrazów. Zaprojektowany do pracy w środowisku produkcyjnym o wysokiej częstotliwości, aktywuje około 11B parametrów na token i osiąga przepustowość do 400 tokenów na sekundę. Step 3.7 Flash obsługuje okno kontekstowe o wielkości 256k i oferuje trzy wybory poziomu rozumowania (niski, średni, wysoki), umożliwiając programistom łatwe równoważenie szybkości, kosztów i głębokości poznawczej. Stworzyliśmy Step 3.7 Flash dla programistów, którzy potrzebują skalować agentowe przepływy pracy łączące percepcję, wyszukiwanie i rozumowanie. Jest zaprojektowany do obsługi intensywnych zadań, takich jak jednorazowe parsowanie ogromnych raportów finansowych, przeprowadzanie wieloetapowych pętli wyszukiwania z weryfikacją krzyżową lub obsługa współbieżnych agentów kodowania w potokach o wysokiej przepustowości. Model dostarcza najwyższej klasy inteligencję wizualną, zajmując pierwsze miejsce w SimpleVQA (Search) z wynikiem 79,2 i osiągając parytet graniczny w V* (Python) z wynikiem 95,3. Te wskaźniki odzwierciedlają silne ugruntowanie wizualne i rozumowanie wspomagane wyszukiwaniem wykraczające poza podstawowy opis obrazu. Model dokładnie przetwarza gęste interfejsy wizualne, takie jak makiety UI, GUI aplikacji i wykresy danych, mapując je na ustrukturyzowany kod. Gdy napotka niekompletny zasób wizualny, może samodzielnie zidentyfikować brakujące dane i przeprowadzić wyszukiwanie w celu zweryfikowania kontekstu przed zwróceniem faktycznie zweryfikowanego wniosku. Niezawodność przepływu pracy i orkiestracja narzędzi Niezawodność wykonania jest kluczowa dla autonomicznych agentów. Step 3.7 Flash prowadzi w benchmarku ClawEval-1.1 z wynikiem 67,1, znacząco przewyższając najbliższego konkurenta z wynikiem 59,8. Ta wydajność pokazuje wysoką odporność na pułapki adwersarialne i ścisłe przestrzeganie polityk systemu podczas wieloetapowej orkiestracji. Wsparty wynikami 49,5 w Toolathlon i 48,1 w HLE z narzędziami, ten profil zapewnia wysoką integralność trajektorii. Step 3.7 Flash niezawodnie współdziała z zewnętrznymi API i wykonuje długoterminowe przepływy pracy bez odchodzenia od instrukcji lub naruszania ograniczeń systemowych. Inżynieria kodu i profesjonalne linie bazowe Step 3.7 Flash został stworzony do zadań inżynieryjnych na żywo i zdobył definitywne drugie miejsce w SWE-Bench PRO z wynikiem 56,3. Może samodzielnie śledzić repozytoria wieloplikowe, izolować błędy z surowych raportów o problemach i generować funkcjonalne łatki, które przechodzą automatyczne testy jednostkowe. Podczas gdy oceny takie jak Terminal-Bench 2.1 (59,5) i GDPVal-AA (45,8) wskazują na wyraźne obszary przyszłej optymalizacji w porównaniu do absolutnego szczytu kohorty, ustanawiają one niezawodną linię bazową dla interakcji systemowych i ustrukturyzowanych profesjonalnych wyników.

Szybka opinia

Czy ten model pomógł Ci w realnym zadaniu? To zajmuje jedno kliknięcie. Szczegółowa ocena jest opcjonalna.

Brak szybkich opinii.

Zaloguj się, aby oddać szybką opinię.

Ocena użytkowników

Brak ocen użytkowników. Wynik AI-TOP pozostaje odrębną miarą techniczną.

API i ceny

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API.

Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.

Aktualne źródłowe stawki API
Dostawca APIWejście / 1 mln tokenówWyjście / 1 mln tokenówPozostałe stawki źródłoweMożliwości
OpenRouter0,743 zł / 1 mln tokenów4,27 zł / 1 mln tokenówCache odczyt: 0,149 zł / 1 mln tokenówKontekst providera: 256 000 · Maks. odpowiedź: 256 000 · Tokenizer: Other · Wejście: text, image, video · Wyjście: text · API: frequency_penalty, include_reasoning, logit_bias, logprobs, max_tokens · Bez moderacji providera

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API. Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.

Język polski

Wsparcie języka polskiego: deklarowane. Jakość języka polskiego: NIEZWERYFIKOWANA.

Dyskusja o modelu

Komentarze dotyczące praktycznego użycia tego modelu.

Nie ma jeszcze zatwierdzonych komentarzy.

Zaloguj się, aby komentować.

Historia modelu

Wykres pokazuje wyłącznie porównywalne punkty głównego rankingu. Tabela zawiera wynik, pozycję, dane źródłowe i stan każdego dnia.

Dane porównywalne

Historia wyniku AI-TOP

Seria używa snapshotów głównego rankingu z metodologii 1.2.

Skala adaptacyjna: obserwowany zakres 64–70 pkt / 100.

  • Wynik AI-TOP
Historia wyniku AI-TOPWykres obejmuje 16 dat od 2026-07-20 do 2026-08-18. Zakres osi: 64–70 pkt / 100. Skala osi jest adaptacyjna do obserwowanego zakresu.706967666420 lip7 sie11 sie14 sie18 sie
Dzienny zapis wyniku, pozycji, źródeł i statusu
DataWynik AI-TOPMiejsceDane źródłoweMetodologiaStan dnia
2026-08-18
  • 64,83 / 100
  • #33
  • OpenRouter: popularność #16
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-17
  • 65,14 / 100
  • #32
  • OpenRouter: popularność #15
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-16
  • 65,10 / 100
  • #32
  • OpenRouter: popularność #15
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-15
  • 65,44 / 100
  • #30
  • OpenRouter: popularność #14
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-14
  • 65,41 / 100
  • #31
  • OpenRouter: popularność #14
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-13
  • 65,69 / 100
  • #27
  • OpenRouter: popularność #14
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-12
  • 65,72 / 100
  • #28
  • OpenRouter: popularność #14
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-08-11
  • 65,75 / 100
  • #28
  • OpenRouter: popularność #14
  • 1.2
  • Ranking zapisany
  • Źródła: 1
  • Aktualizacja ceny API
2026-08-10
  • 67,70 / 100
  • #28
  • OpenRouter: popularność #14
  • 1.2
  • Ranking zapisany
  • Źródła: 1
  • Aktualizacja ceny API
2026-08-09
  • 67,81 / 100
  • #26
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-08
  • 67,85 / 100
  • #26
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-07
  • 67,88 / 100
  • #26
  • OpenRouter: popularność #13
  • 1.2
  • Ranking zapisany
  • Źródła: 1
  • Aktualizacja ceny API
2026-07-26
  • 68,93 / 100
  • #23
  • Artificial Analysis 30,30 score
  • OpenRouter: popularność #8
  • 1.2
  • Ranking zapisany
  • Źródła: 2
2026-07-25
  • 68,95 / 100
  • #24
  • OpenRouter: popularność #8
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-22
  • 68,33 / 100
  • #24
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-21
  • Artificial Analysis 30,30 score
  • OpenRouter: popularność #12
  • Brak snapshotu rankingu
  • Źródła: 2
2026-07-20
  • 68,19 / 100
  • #19
  • OpenRouter: popularność #13
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-19
  • 67,53 / 100
  • #17
  • 1.1
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-18
  • 67,68 / 100
  • #25
  • OpenRouter: popularność #13
  • 1.1
  • Ranking zapisany
  • Źródła: 1
  • Aktualizacja ceny API
2026-07-17
  • OpenRouter: popularność #13
  • Brak snapshotu rankingu
  • Źródła: 1
  • Aktualizacja ceny API

Dane historii w formacie JSON