Przejdź do treści

Szczegóły modelu

Inflect-Micro-v2

Status: AktywnyW trendach Hugging Face

Dostawca: owensong →Dodaj do porównania

Profil techniczny

Kluczowe dane modelu

Pokazujemy wyłącznie dostępne, potwierdzone informacje.

Główne zadanie
Synteza mowy

Opis modelu

Inflect-Micro-v2 Kompletna lokalna synteza mowy tekst-na-falę poniżej 10M parametrów. TTS w języku angielskim z ustaloną głosem, obsługą długiego tekstu oraz inferencją na CPU lub CUDA. > Uwaga od Owena

Dziękuję bardzo za wszelkie wsparcie okazane temu projektowi! Zbudowałem i sfinansowałem Inflect v2 niezależnie – jeśli ta wersja znajdzie prawdziwą publiczność, chciałbym kontynuować projekt z wersją v3, która może obejmować takie rzeczy jak więcej języków, głosów i poprawy jakości głosu. Jeśli model jest dla Ciebie użyteczny, zostawienie polubienia na Hugging Face naprawdę pomaga innym ludziom go odkryć. 9,356,513 parametrów do wdrożenia · 37.53 MB FP32 · 24 kHz mono output > Nowość: publiczny zestaw narzędzi do adaptacji Przygotuj dane, audyt podziałów na trening/walidację, dostosuj ustalony głos lub język, wznowienie treningu, oceniaj punkty kontrolne i eksportuj pakiety PyTorch lub ONNX za pomocą zestawu narzędzi do adaptacji Inflect. Jakość dostosowana jest eksperymentalna i zależy od zestawu danych, frontend oraz oceny płynnych mówców. Inflect v2 używa jednego publicznego API w dwóch rozmiarach: Micro priorytetuje jakość poniżej 10M parametrów; Nano priorytetuje ślad poniżej 4M.

Zacznij tutajSzczegóły techniczne
SłuchajArchitektura
OcenaKontrole i długi tekst
Wybierz Micro lub NanoDane i adaptacja
Uruchom lokalnieEksporty i kwantyzacja
Dostosuj głos lub językProces treningu i eksportu
Mapa pakietówOcena i surowy protokół
OgraniczeniaPrzewodnik po wdrożeniu

To są generacje tekstu, a nie rekonstrukcje dźwięku treningowego. Każdy transkrypt jest pokazany dokładnie tak, jak został przekazany do publicznego frontendu.

TestDokładny transkryptWygenerowany dźwięk
KonwersacyjnyDopiero później zdałem sobie sprawę, co tak naprawdę się wydarzyło.
InterpunkcjaPo pierwsze, zamknij okno; po drugie, wyłącz lampę; w końcu, zamknij drzwi.
LiczbyPaczka waży dwanaście i sześć dziesiątych kilograma i dotarła dwudziestego pierwszego lipca.
Nazwy i miejscaGwendolyn sfotografowała drzewa eukaliptusowe na zewnątrz Lublany.
TechniczneSystem działa na trzech podstawowych komponentach, które muszą być zsynchronizowane.

Warianty do uruchomienia

Brak potwierdzonych danych o wariantach do pobrania. Nie zastępujemy brakujących wartości zerem ani szacunkiem VRAM.

Ostatnia aktualizacja: 2026-08-18

Szybka opinia

Czy ten model pomógł Ci w realnym zadaniu? To zajmuje jedno kliknięcie. Szczegółowa ocena jest opcjonalna.

Brak szybkich opinii.

Zaloguj się, aby oddać szybką opinię.

Ocena użytkowników

Brak ocen użytkowników. Wynik AI-TOP pozostaje odrębną miarą techniczną.

API i ceny

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API.

Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.

Brak aktualnej, porównywalnej oferty API.

Język polski

Wsparcie języka polskiego: deklarowane. Jakość języka polskiego: NIEZWERYFIKOWANA.

Dyskusja o modelu

Komentarze dotyczące praktycznego użycia tego modelu.

Dyskusja jest chwilowo niedostępna.

Historia modelu

Wykres pokazuje wyłącznie porównywalne punkty głównego rankingu. Tabela zawiera wynik, pozycję, dane źródłowe i stan każdego dnia.

Brak danych porównywalnych

Historia wyniku AI-TOP

Wykres pojawi się po zapisaniu co najmniej dwóch porównywalnych pomiarów.

Brak zapisanych obserwacji tego modelu.

Dane historii w formacie JSON