Przejdź do treści

Szczegóły modelu

DeepSeek: DeepSeek V4 Pro

Status: AktywnyW trendach Hugging FaceDostęp API

DeepSeek-V4: W kierunku wysoce wydajnej inteligencji kontekstu miliona tokenów. Przedstawiamy wersję zapoznawczą serii DeepSeek-V4, obejmującą dwa wydajne modele językowe typu Mixture-of-Experts (MoE) — DeepSeek-V4-Pro z 1,6T parametrów (49B aktywnych) oraz DeepSeek-V4-Flash z 284B parametrów (13B aktywnych) — oba obsługujące długość kontekstu jednego miliona tokenów. Seria DeepSeek-V4 zawiera kilka kluczowych ulepszeń w architekturze i optymalizacji:

  1. Hybrydowa architektura uwagi: Zaprojektowaliśmy hybrydowy mechanizm uwagi łączący Compressed Sparse Attention (CSA) i Heavily Compressed Attention (HCA), aby radykalnie poprawić wydajność długiego kontekstu. W ustawieniu kontekstu 1M tokenów, DeepSeek-V4-Pro wymaga tylko 27% FLOPs wnioskowania pojedynczego tokena i 10% pamięci podręcznej KV w porównaniu z DeepSeek-V3.2.
  2. Manifold-Constrained Hyper-Connections (mHC): Wprowadzamy mHC w celu wzmocnienia konwencjonalnych połączeń resztkowych, zwiększając stabilność propagacji sygnału między warstwami przy jednoczesnym zachowaniu ekspresywności modelu.
  3. Optymalizator Muon: Stosujemy optymalizator Muon dla szybszej zbieżności i większej stabilności treningu.

Oba modele są wstępnie trenowane na ponad 32T różnorodnych i wysokiej jakości tokenach, a następnie poddawane kompleksowemu potokowi po treningu. Potrening obejmuje dwuetapowy paradygmat: niezależne kształcenie ekspertów domenowych (poprzez SFT i RL z GRPO), a następnie ujednolicona konsolidacja modelu poprzez destylację on-policy, integrująca odrębne umiejętności z różnych dziedzin w jeden model.

DeepSeek-V4-Pro-Max, tryb maksymalnego wysiłku rozumowania DeepSeek-V4-Pro, znacząco rozwija możliwości wiedzowe modeli open-source, umacniając swoją pozycję jako najlepszy obecnie dostępny model open-source. Osiąga najwyższą wydajność w benchmarkach kodowania i znacząco zmniejsza lukę w stosunku do wiodących modeli zamkniętych w zadaniach rozumowania i agentowych. Tymczasem DeepSeek-V4-Flash-Max osiąga porównywalną wydajność rozumowania do wersji Pro, gdy otrzyma większy budżet myślenia, choć jego mniejsza skala parametrów naturalnie plasuje go nieco niżej w czysto wiedzowych zadaniach i najbardziej złożonych przepływach agentowych.

Model#Parametry całkowite#Parametry aktywowaneDługość kontekstuPrecyzjaPobierz
DeepSeek-V4-Flash-Base284B13B1MFP8 MixedHuggingFace | ModelScope
DeepSeek-V4-Flash284B13B1MFP4 + FP8 Mixed*HuggingFace | ModelScope
DeepSeek-V4-Pro-Base1.6T49B1MFP8 MixedHuggingFace | ModelScope
DeepSeek-V4-Pro1.6T49B1MFP4 + FP8 Mixed*HuggingFace | ModelScope

\FP4 + FP8 Mixed: Parametry ekspertów MoE używają precyzji FP4; większość innych parametrów używa FP8.*

Dostawca: deepseek →Dodaj do porównania

Dostawca
deepseek
Modalność
text->text
Licencja
Nie określono
Kontekst
1 048 576 tokenów
Parametry
Nie określono
Architektura
transformers

Parametry techniczne i pochodzenie

Zadanie
text-generation
Biblioteka
transformers
Dane są deklaracjami źródeł modelu; brak pola oznacza brak potwierdzonej informacji.

Szybka opinia

Czy ten model pomógł Ci w realnym zadaniu? To zajmuje jedno kliknięcie. Szczegółowa ocena jest opcjonalna.

Brak szybkich opinii.

Zaloguj się, aby oddać szybką opinię.

Ocena użytkowników

Brak ocen użytkowników. Wynik AI-TOP pozostaje odrębną miarą techniczną.

API i ceny

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API.

Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-07.

Aktualne źródłowe stawki API
Dostawca APIWejście / 1 mln tokenówWyjście / 1 mln tokenówPozostałe stawki źródłoweMożliwości
OpenRouter1,62 zł / 1 mln tokenów3,25 zł / 1 mln tokenówŻądanie: 0 zł / 1 żądanie
Obraz: 0 zł / 1 obraz
Wyszukiwanie: 0 zł / 1 operacja
Reasoning: 0 zł / 1 mln tokenów
Cache odczyt: 0,014 zł / 1 mln tokenów
Cache zapis: 0 zł / 1 mln tokenów
Kontekst providera: 1 048 576 · Maks. odpowiedź: 384 000 · Tokenizer: DeepSeek · Wejście: text · Wyjście: text · API: frequency_penalty, include_reasoning, logit_bias, logprobs, max_tokens · Bez moderacji providera

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API. Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-07.

Język polski

Wsparcie języka polskiego: deklarowane. Jakość języka polskiego: NIEZWERYFIKOWANA.

Dyskusja o modelu

Komentarze dotyczące praktycznego użycia tego modelu.

Nie ma jeszcze zatwierdzonych komentarzy.

Zaloguj się, aby komentować.

Historia modelu

Wykres pokazuje wyłącznie porównywalne punkty głównego rankingu. Tabela zawiera wynik, pozycję, dane źródłowe i stan każdego dnia.

Dane porównywalne

Historia wyniku AI-TOP

Seria używa snapshotów głównego rankingu z metodologii 1.2.

Skala adaptacyjna: obserwowany zakres 73,5–76,0 pkt / 100.

  • Wynik AI-TOP
Historia wyniku AI-TOPWykres obejmuje 5 dat od 2026-07-20 do 2026-08-07. Zakres osi: 73,5–76,0 pkt / 100. Skala osi jest adaptacyjna do obserwowanego zakresu.76,075,474,874,173,520 lip22 lip25 lip26 lip7 sie
Dzienny zapis wyniku, pozycji, źródeł i statusu
DataWynik AI-TOPMiejsceDane źródłoweMetodologiaStan dnia
2026-08-07
  • 74,20 / 100
  • #5
  • Artificial Analysis 45,30 score
  • OpenRouter: popularność #7
  • 1.2
  • Ranking zapisany
  • Źródła: 2
2026-07-26
  • 74,46 / 100
  • #11
  • Artificial Analysis 31,20 score
  • OpenRouter: popularność #5
  • 1.2
  • Ranking zapisany
  • Źródła: 2
2026-07-25
  • 74,55 / 100
  • #10
  • OpenRouter: popularność #4
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-22
  • 75,57 / 100
  • #8
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-21
  • Artificial Analysis 44,30 score
  • OpenRouter: popularność #6
  • Brak snapshotu rankingu
  • Źródła: 2
2026-07-20
  • 75,46 / 100
  • #3
  • OpenRouter: popularność #7
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-19
  • 75,06 / 100
  • #3
  • 1.1
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-18
  • 75,06 / 100
  • #10
  • OpenRouter: popularność #7
  • 1.1
  • Ranking zapisany
  • Źródła: 1
  • Aktualizacja ceny API
2026-07-17
  • OpenRouter: popularność #7
  • Brak snapshotu rankingu
  • Źródła: 1
  • Aktualizacja ceny API

Dane historii w formacie JSON