Przejdź do treści

Szczegóły modelu

NVIDIA: Nemotron 3 Ultra

Status: AktywnyDostęp API

Dostawca: nvidia →Dodaj do porównania

Profil techniczny

Kluczowe dane modelu

Pokazujemy wyłącznie dostępne, potwierdzone informacje.

Modalność
Tekst → tekst

Opis modelu

Parametry całkowite550B (55B aktywnych)
ArchitekturaLatentMoE – Mamba-2 + MoE + Attention hybryda z Multi-Token Prediction (MTP)
Długość kontekstuDo 1M tokenów
Minimalne wymagania GPU8x GB200/B200/GB300/B300, 16x H100, 8x H200
Obsługiwane językiAngielski, francuski, hiszpański, włoski, niemiecki, japoński, hindi, koreański, brazylijski portugalski i chiński
Najlepsze doZaawansowane rozumowanie, złożone przepływy pracy agentów, analiza długiego kontekstu, użycie narzędzi, wielojęzyczne rozumowanie, RAG wysokiego ryzyka
Tryb rozumowaniaKonfigurowalny włącz/wyłącz poprzez szablon czatu (enable_thinking=True/False)
LicencjaOpenMDW License Agreement, wersja 1.1
Data wydania4 czerwca 2026

Więcej szczegółów na temat wdrażania i używania modelu znajdziesz w poniższym przewodniku szybkiego startu! > Aby uruchomić Nemotron 3 Ultra na mniejszym obszarze, zobacz: NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4 Daty modelu: Grudzień 2025 – Kwiecień 2026 Dane po treningu mają datę odcięcia maj 2026. Dane przed treningiem mają datę odcięcia wrzesień 2025. NVIDIA Nemotron™ to rodzina otwartych modeli z otwartymi wagami, danymi treningowymi i przepisami, zapewniająca wiodącą wydajność i dokładność do budowania wyspecjalizowanych agentów AI. Nemotron-3-Ultra-550B-A55B-BF16 to model językowy dużej skali (LLM) na poziomie granicznym, trenowany przez NVIDIA, zaprojektowany do zapewniania silnych możliwości agentowych, rozumowania i konwersacji. Jest zoptymalizowany do najbardziej wymagających obciążeń, w tym złożonych agentów wieloetapowych, analizy długiego kontekstu i rozumowania o wysokiej dokładności w zakresie kodu, matematyki i nauki. Podobnie jak inne modele z rodziny, odpowiada na zapytania i zadania użytkowników, najpierw generując ślad rozumowania, a następnie kończąc ostateczną odpowiedzią. Możliwości rozumowania modelu można skonfigurować za pomocą flagi w szablonie czatu. Model wykorzystuje hybrydową architekturę Latent Mixture-of-Experts (LatentMoE), wykorzystując przeplatane warstwy Mamba-2 i MoE, wraz z wybranymi warstwami Attention. Podobnie jak model Super, model Ultra zawiera warstwy Multi-Token Prediction (MTP) dla szybszego generowania tekstu i lepszej jakości, i jest trenowany przy użyciu receptury przedtreningowej NVFP4, aby zmaksymalizować wydajność obliczeniową. Model ma 55B aktywnych parametrów i 550B parametrów łącznie.

Szybka opinia

Czy ten model pomógł Ci w realnym zadaniu? To zajmuje jedno kliknięcie. Szczegółowa ocena jest opcjonalna.

Brak szybkich opinii.

Zaloguj się, aby oddać szybką opinię.

Ocena użytkowników

Brak ocen użytkowników. Wynik AI-TOP pozostaje odrębną miarą techniczną.

API i ceny

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API.

Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.

Aktualne źródłowe stawki API
Dostawca APIWejście / 1 mln tokenówWyjście / 1 mln tokenówPozostałe stawki źródłoweMożliwości
OpenRouter2,23 zł / 1 mln tokenów13,37 zł / 1 mln tokenówCache odczyt: 0,743 zł / 1 mln tokenówKontekst providera: 512 288 · Tokenizer: Other · Wejście: text · Wyjście: text · API: frequency_penalty, include_reasoning, logit_bias, max_tokens, min_p · Bez moderacji providera

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API. Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.

Język polski

Wsparcie języka polskiego: deklarowane. Jakość języka polskiego: NIEZWERYFIKOWANA.

Dyskusja o modelu

Komentarze dotyczące praktycznego użycia tego modelu.

Nie ma jeszcze zatwierdzonych komentarzy.

Zaloguj się, aby komentować.

Historia modelu

Wykres pokazuje wyłącznie porównywalne punkty głównego rankingu. Tabela zawiera wynik, pozycję, dane źródłowe i stan każdego dnia.

Dane porównywalne

Historia wyniku AI-TOP

Seria używa snapshotów głównego rankingu z metodologii 1.2.

Skala adaptacyjna: obserwowany zakres 57,2–58,0 pkt / 100.

  • Wynik AI-TOP
Historia wyniku AI-TOPWykres obejmuje 16 dat od 2026-07-20 do 2026-08-18. Zakres osi: 57,2–58,0 pkt / 100. Skala osi jest adaptacyjna do obserwowanego zakresu.58,057,857,657,457,220 lip7 sie11 sie14 sie18 sie
Dzienny zapis wyniku, pozycji, źródeł i statusu
DataWynik AI-TOPMiejsceDane źródłoweMetodologiaStan dnia
2026-08-18
  • 57,49 / 100
  • #67
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-17
  • 57,53 / 100
  • #65
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-16
  • 57,57 / 100
  • #64
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-15
  • 57,62 / 100
  • #67
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-14
  • 57,64 / 100
  • #64
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-13
  • 57,70 / 100
  • #64
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-12
  • 57,74 / 100
  • #65
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-11
  • 57,76 / 100
  • #65
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
  • Aktualizacja ceny API
2026-08-10
  • 57,75 / 100
  • #78
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
  • Aktualizacja ceny API
2026-08-09
  • 57,74 / 100
  • #78
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-08
  • 57,79 / 100
  • #78
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-07
  • 57,82 / 100
  • #78
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
  • Aktualizacja ceny API
2026-07-26
  • 57,29 / 100
  • #74
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-25
  • 57,36 / 100
  • #73
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-22
  • 57,49 / 100
  • #73
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-20
  • 57,57 / 100
  • #68
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-19
  • 53,87 / 100
  • #74
  • 1.1
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-18
  • 53,90 / 100
  • #81
  • 1.1
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-17
  • OpenRouter: popularność #75
  • Brak snapshotu rankingu
  • Źródła: 1
  • Aktualizacja ceny API

Dane historii w formacie JSON