Przejdź do treści

Szczegóły modelu

nemotron-3.5-asr-streaming-0.6b

Status: AktywnyW trendach Hugging Face

Dostawca: nvidia →Dodaj do porównania

Profil techniczny

Kluczowe dane modelu

Pokazujemy wyłącznie dostępne, potwierdzone informacje.

Główne zadanie
Rozpoznawanie mowy
Biblioteka
Nemo

Opis modelu

h1, h2, h3, h4, h5, h6 { color: #76b900; / NVIDIA green / font-weight: 700; } hr { border: none; border-top: 1px solid #e5e7eb; margin: 2rem 0; } / Improve list spacing / ul, ol { margin-top: 0.5rem; margin-bottom: 0.5rem; } / Badge alignment consistency / img { display: inline; vertical-align: middle; } > [!Uwaga] > Ten model jest wielojęzycznym rozszerzeniem nvidia/nemotron-speech-streaming-en-0.6b, dodającym warunkowanie promptu identyfikatora języka, aby obsługiwać transkrypcję w 40 językach-lokalizacjach z jednego modelu. Nemotron 3.5 ASR to wielojęzyczny, strumieniowy model automatycznego rozpoznawania mowy (ASR) zaprojektowany do dostarczania wysokiej jakości wielojęzycznej transkrypcji zarówno w niskolatencyjnym strumieniowaniu, jak i wsadowych obciążeniach o wysokiej przepustowości. Opracowany przez NVIDIA, ten model o 600M parametrach transkrybuje mowę na tekst z natywnym wsparciem dla interpunkcji i wielkich liter, oraz oferuje elastyczność czasu wykonania z konfigurowalnymi rozmiarami fragmentów, w tym 80ms, 160ms, 320ms, 560ms i 1120ms. Wykorzystując najnowocześniejszą architekturę Cache-Aware FastConformer-RNNT, model eliminuje zbędne nakładające się obliczenia powszechne w tradycyjnym „buforowanym” strumieniowaniu. Pozwala to na przetwarzanie tylko nowych fragmentów audio przy ponownym użyciu buforowanego kontekstu enkodera, znacząco poprawiając efektywność obliczeniową i minimalizując opóźnienie end-to-end bez utraty dokładności. Został wytrenowany na ogromnym zbiorze danych ASR i zaprojektowany do działania w różnych i wymagających warunkach akustycznych.

Warianty do uruchomienia

Brak potwierdzonych danych o wariantach do pobrania. Nie zastępujemy brakujących wartości zerem ani szacunkiem VRAM.

Ostatnia aktualizacja: 2026-08-18

Szybka opinia

Czy ten model pomógł Ci w realnym zadaniu? To zajmuje jedno kliknięcie. Szczegółowa ocena jest opcjonalna.

Brak szybkich opinii.

Zaloguj się, aby oddać szybką opinię.

Ocena użytkowników

Brak ocen użytkowników. Wynik AI-TOP pozostaje odrębną miarą techniczną.

API i ceny

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API.

Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.

Brak aktualnej, porównywalnej oferty API.

Język polski

Wsparcie języka polskiego: deklarowane. Jakość języka polskiego: NIEZWERYFIKOWANA.

Dyskusja o modelu

Komentarze dotyczące praktycznego użycia tego modelu.

Nie ma jeszcze zatwierdzonych komentarzy.

Zaloguj się, aby komentować.

Historia modelu

Wykres pokazuje wyłącznie porównywalne punkty głównego rankingu. Tabela zawiera wynik, pozycję, dane źródłowe i stan każdego dnia.

Brak danych porównywalnych

Historia wyniku AI-TOP

Wykres pojawi się po zapisaniu co najmniej dwóch porównywalnych pomiarów.

Brak zapisanych obserwacji tego modelu.

Dane historii w formacie JSON