Przejdź do treści

Szczegóły modelu

Inkling

Status: AktywnyW trendach Hugging Face

Dostawca: thinkingmachines →Dodaj do porównania

Profil techniczny

Kluczowe dane modelu

Pokazujemy wyłącznie dostępne, potwierdzone informacje.

Główne zadanie
Obraz i tekst → tekst
Biblioteka
Transformers

Opis modelu

BF16 · NVFP4 · Tinker Cookbook · Dokumentacja · Dopuszczalne użycie Inkling to ogólnego przeznaczenia model multimodalny, który akceptuje dane wejściowe w postaci tekstu, obrazu i audio oraz generuje dane wyjściowe w postaci tekstu. Jest przeznaczony do użytku w języku angielskim i innych językach, a także w wielu językach programowania. Model został zaprojektowany do użytku przez programistów tworzących aplikacje oparte na AI, w tym systemy agentowe i narzędziowe, asystentów kodowania, chatboty i systemy generacji wspomaganej wyszukiwaniem, i nadaje się do ogólnego użytku konwersacyjnego, podążania za instrukcjami i innych zadań związanych z językiem naturalnym i multimodalnych. Jest wydawany z otwartymi wagami, aby wspierać badania, dostrajanie i integrację z produktami innych firm przez programistów downstream. Języki: Angielski, z ogólnymi możliwościami wielojęzycznymi w innych językach. Aby uzyskać dostęp do Inkling przez Tinker: Możesz zacząć, odwołując się do Tinker Cookbook tutaj i powiązanej dokumentacji tutaj. Inkling obsługuje lokalne wdrożenie przy użyciu następujących bibliotek open-source: SGLang (przepis, PR) vLLM (przepis, PR) TokenSpeed (przepis, PR) Unsloth (przepis, PR) * Huggingface (przepis, PR) Dostęp API jest również dostępny za pośrednictwem zewnętrznych dostawców inferencji. Dekoder-only transformer z 66 warstwami z rzadkim szkieletem feed-forward Mixture-of-Experts (MoE): każdy token jest kierowany do 6 z 256 ekspertów, plus 2 współdzielonych ekspertów aktywnych na każdym tokenie. Uwaga jest hybrydą warstw lokalnych i globalnych. Model jest natywnie multimodalny — obrazy i wideo są kodowane za pomocą hierarchicznego kodera kafelków, a audio za pomocą dyskretnego kodowania tokenów — przy czym wszystkie modalności są rzutowane do wspólnej ukrytej przestrzeni i przetwarzane wspólnie przez dekoder.

Warianty do uruchomienia

Brak potwierdzonych danych o wariantach do pobrania. Nie zastępujemy brakujących wartości zerem ani szacunkiem VRAM.

Ostatnia aktualizacja: 2026-08-18

Szybka opinia

Czy ten model pomógł Ci w realnym zadaniu? To zajmuje jedno kliknięcie. Szczegółowa ocena jest opcjonalna.

Brak szybkich opinii.

Zaloguj się, aby oddać szybką opinię.

Ocena użytkowników

Brak ocen użytkowników. Wynik AI-TOP pozostaje odrębną miarą techniczną.

API i ceny

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API.

Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.

Brak aktualnej, porównywalnej oferty API.

Język polski

Wsparcie języka polskiego: deklarowane. Jakość języka polskiego: NIEZWERYFIKOWANA.

Dyskusja o modelu

Komentarze dotyczące praktycznego użycia tego modelu.

Nie ma jeszcze zatwierdzonych komentarzy.

Zaloguj się, aby komentować.

Historia modelu

Wykres pokazuje wyłącznie porównywalne punkty głównego rankingu. Tabela zawiera wynik, pozycję, dane źródłowe i stan każdego dnia.

Brak danych porównywalnych

Historia wyniku AI-TOP

Wykres pojawi się po zapisaniu co najmniej dwóch porównywalnych pomiarów.

Brak zapisanych obserwacji tego modelu.

Dane historii w formacie JSON