Przejdź do treści

Metodologia AI-TOP

Jak czytamy dane

Każdy rekord ma źródło, datę pobrania i status walidacji. Wynik rankingu jest opisywany osobno od opinii użytkowników.

Jak liczymy wynik AI-TOP

Bieżące zasady oceny modeli

Obecna metodologia: v1.2. Ta wersja jest stosowana do bieżących wyników modeli widocznych w rankingu i kartach modeli.

Jawne kryteria Dane źródłowe Bieżące ceny API Aktualne wyniki

Wagi kryteriów

Jakość modelu
50%
Konkurencyjność kosztowa
20%
Aktualność danych
15%
Popularność
15%

Co oznacza wynik?

Wynik AI-TOP porządkuje modele według czterech bieżących kryteriów. Nie zastępuje sprawdzenia dopasowania do własnego zadania, ceny API ani warunków licencji.

W ocenę wchodzą tylko zweryfikowane dane dostępne dla danego modelu.

Prosty wynik ważony

Wynik to suma czterech składników 0–100 pomnożonych przez jawne wagi. Brakujący składnik wnosi 0 punktów; nie przeskalowujemy pozostałych wag.

wynik = jakość × 50% + konkurencyjność kosztowa × 20% + aktualność × 15% + popularność × 15%

Bieżące dane

Ranking jest przeliczany po udanej synchronizacji danych źródłowych. Przy wyniku pokazujemy czas ostatniej poprawnej synchronizacji.

Ceny API — stawki źródłowe

Zestawienia pokazują tylko Wejście i Wyjście jako źródłowe stawki API za 1 mln tokenów. Pełny cennik na karcie modelu obejmuje także obraz, wyszukiwanie, cache, reasoning i żądania z jednostką przekazaną przez API; kwoty są prezentowane w PLN.

Jawność źródeł

Udostępniamy źródła, definicje metryk oraz reguły normalizacji. Oceny użytkowników są odrębne i nie zmieniają wyniku AI-TOP.

Źródła i kontrola

Co dokładnie liczymy w v1.2?

Jakość modelu to średnia dostępnych sygnałów OpenRouter: Intelligence Index (już w skali 0–100) oraz Design Arena ELO przeliczonego jako (ELO − 800) / 8, zawsze ograniczonego do zakresu 0–100.

Popularność korzysta z Hugging Face i OpenRouter. Sygnał Hugging Face to 70% znormalizowanych logarytmicznie pobrań i 30% znormalizowanych logarytmicznie polubień; pozycja tygodniowa OpenRouter jest odwrócona do skali 0–100. Gdy są oba sygnały, liczymy ich średnią.

Aktualność danych wynosi 100 dla danych bieżących i maleje liniowo do 0 po 365 dniach, według czasu synchronizacji metryk źródłowych albo daty ostatniej modyfikacji źródła.

Konkurencyjność kosztowa jest składnikiem oceny AI-TOP, a nie publiczną ceną. Używa najnowszej poprawnej oferty OpenRouter dla wewnętrznego scenariusza „Analiza tekstu: 1 000 000 tokenów wejścia + 250 000 tokenów wyjścia”. Wynik kosztowy wynosi 100 dla ceny 0 i maleje liniowo do 0 przy 90. percentylu bieżących kosztów tego scenariusza.

  • katalog modeli i dostawców
  • metryki źródłowe Hugging Face i OpenRouter
  • najnowsza oferta API oraz wewnętrzny scenariusz komponentu „Konkurencyjność kosztowa”

Proces oceny

Sześć kroków od danych do decyzji

  1. Zbieramymodel, dostawcę, wariant i źródło
  2. Sprawdzamystatus, aktualność i kompletność
  3. Normalizujemyjednostki, waluty i zakresy
  4. Liczymywynik według jawnych wag
  5. Porównujemymodele w tym samym zakresie danych
  6. Publikujemybieżący wynik, stan i kontekst

Wzór v1.2

Wynik pozostaje interpretowalny

Każdy komponent ma określoną wagę, a brak zweryfikowanej wartości nie jest automatycznie zamieniany na najwyższą ocenę ani nie podnosi wagi pozostałych danych.

AI-TOP = jakość × 0,50 + konkurencyjność kosztowa × 0,20 + aktualność × 0,15 + popularność × 0,15
Jak interpretować wynik?

Wynik porządkuje modele według opisanych tutaj, bieżących kryteriów. Nie zastępuje opisu źródeł, ceny ani praktycznej oceny zastosowania.

Czego wynik nie mówi?

Nie gwarantuje jakości dla każdego promptu, środowiska ani języka. Do decyzji użyj porównania i danych kosztowych.

Zobacz ranking w akcji

Sprawdź aktualne wyniki modeli AI w oficjalnym rankingu AI-TOP.PL.

Przejdź do rankingu →