Przejdź do treści

Szczegóły modelu

MoonshotAI: Kimi K2.7 Code

Status: AktywnyW trendach Hugging FaceDostęp APIModel lokalny

Dostawca: Moonshot AI →Dodaj do porównania

Profil techniczny

Kluczowe dane modelu

Pokazujemy wyłącznie dostępne, potwierdzone informacje.

Modalność
Tekst + obraz → tekst
Format wag
SafetensorsBF16
Architektura
Kimi K25konfiguracja modelu
Główne zadanie
Obraz i tekst → tekst
Biblioteka
Transformers
Publiczne warianty: 1 · źródło: Hugging Face Hub Models API · rewizja 74797c9c62… · weryfikacja: 2026-08-09Zobacz warianty i źródła →

Opis modelu

Kimi K2.7 Code to model agencyjny skoncentrowany na kodowaniu, zbudowany na bazie Kimi K2.6. Dzięki znacznym ulepszeniom w rzeczywistych długoterminowych zadaniach kodowania, wzmacnia kompleksowe wykonywanie zadań w złożonych przepływach pracy inżynierii oprogramowania, jednocześnie poprawiając efektywność tokenów, redukując użycie tokenów myślenia o około 30% w porównaniu z Kimi K2.6.

ArchitekturaMixture-of-Experts (MoE)
Całkowita liczba parametrów1T
Aktywowane parametry32B
Liczba warstw (w tym warstwa gęsta)61
Liczba warstw gęstych1
Ukryty wymiar uwagi7168
Ukryty wymiar MoE (na eksperta)2048
Liczba głów uwagi64
Liczba ekspertów384
Wybrani eksperci na token8
Liczba współdzielonych ekspertów1
Rozmiar słownictwa160K
Długość kontekstu256K
Mechanizm uwagiMLA
Funkcja aktywacjiSwiGLU
Enkoder wizyjnyMoonViT
Parametry enkodera wizyjnego400M

Benchmark

Kimi K2.6 Kimi K2.7 Code GPT-5.5 Claude Opus 4.8

Coding Kimi Code Bench v2 50.9 62.0 69.0 67.4 Program Bench 48.3 53.6 69.1 63.8 MLS Bench Lite 26.7 35.1 35.5 42.8

Agentic Kimi Claw 24/7 Bench 42.9 46.9 52.8 50.4 MCP Atlas 69.4 76.0 79.4 81.3 MCP Mark Verified 72.8 81.1 92.9 76.4

  1. Ogólne szczegóły testowania
  • O ile nie zaznaczono inaczej, Kimi K2.7 Code i K2.6 były testowane z włączonym trybem myślenia za pomocą Kimi Code CLI przy temperature = 1.0, top-p = 0.95 i długości kontekstu 262 144 tokenów; GPT-5.5 działał w Codex z trybem xhigh, a Opus 4.8 w Claude Code z trybem xhigh. Poza tymi różnicami, wszystkie benchmarki były oceniane w tych samych warunkach.
  1. Benchmarki kodowania
  • Kimi Code Bench V2 to nasz wewnętrzny benchmark zaprojektowany do oceny agentów kodowania w realistycznych zadaniach. Obejmuje zróżnicowane zadania inżynierii oprogramowania w ponad 10 głównych językach programowania i pełny stos produkcyjny, obejmujący zadania z wewnętrznych przypadków użycia inżynieryjnych, incydentów produkcyjnych i rzeczywistych projektów open-source, z naciskiem na usługi backendowe, infrastrukturę, inżynierię wydajności, programowanie systemowe, bezpieczeństwo, rozwój frontendowy oraz inżynierię ML/danych.
  • Program Bench ocenia agentów generujących kod, prosząc ich o odtworzenie zachowania programu na podstawie tylko skompilowanego pliku binarnego i jego dokumentacji. Obejmuje 200 zadań, od małych narzędzi CLI po duże systemy, takie jak FFmpeg i SQLite. Zgłoszenia są oceniane na podstawie ponad 248 000 testów behawioralnych wygenerowanych przez fuzzowanie. W każdym zadaniu agent otrzymuje plik wykonywalny i jego dokumentację, ale bez kodu źródłowego, dekompilacji ani dostępu do internetu. Musi wybrać własny język implementacji, zbudować cały program od podstaw i przejść zestaw testów behawioralnych porównujących jego wyniki z oryginalnym plikiem binarnym.
  • MLS-Bench ocenia, czy systemy AI potrafią wymyślać uogólnialne i skalowalne metody ML. MLS-Bench-Lite to oficjalny 30-zadaniowy podzbiór MLS-Bench, obejmujący przedtrening i po treningu LLM, robotykę, modele świata, wizję komputerową, uczenie przez wzmocnienie, optymalizację, systemy ML, AI dla nauki i inne. Agenci mają 5 godzin na eksplorację przed przesłaniem rozwiązań. Opus 4.8 jest oceniany z ustawieniem max effort w Claude Code.
  1. Benchmarki agencyjne
  • Kimi Claw 24/7 Bench to nasz wewnętrzny benchmark do oceny długoterminowej wydajności agencyjnej w trwałych, wielodniowych zadaniach współpracy. Obejmuje 17 profesjonalnych scenariuszy w 610 punktach oceny, obejmujących takie dziedziny jak inżynieria oprogramowania, badania ML, rekrutacja, trading, marketing. Wszystkie zadania są wykonywane za pomocą uprzęży OpenClaw. Ostateczny wynik to średni wskaźnik zaliczeń we wszystkich punktach oceny, uśredniony z 3 uruchomień.
  • MCP-Atlas ocenia wydajność LLM w realistycznych zadaniach użycia narzędzi poprzez skalowalne MCP. Postępowaliśmy zgodnie z oficjalną konfiguracją oceny MCP-Atlas z budżetem 100 wywołań narzędzi i 32k max tokens na krok. Ostateczny wynik jest uśredniony z 3 uruchomień.
  • MCPMark-Verified to zweryfikowana przez człowieka edycja MCPMark, benchmarku do oceny użycia narzędzi MCP w pięciu rzeczywistych środowiskach serwerowych — Notion, GitHub, Filesystem, Postgres i Playwright. Każde zadanie zostało ponownie sprawdzone przez nasz zespół i oficjalny benchmark i wkrótce zostanie udostępnione jako open-source. Postępowaliśmy zgodnie z oficjalną konfiguracją oceny MCPMark z budżetem 100 kroków wywołań narzędzi i 32k max tokens na krok. Ostateczny wynik jest uśredniony z 3 uruchomień.
  1. Natywna kwantyzacja INT4

Kimi-K2.7-Code przyjmuje tę samą natywną metodę kwantyzacji int4 co Kimi-K2-Thinking.

Uwaga: Możesz uzyskać dostęp do API Kimi-K2.7-Code na https://platform.moonshot.ai i udostępniamy API kompatybilne z OpenAI/Anthropic. Obecnie Kimi-K2.7-Code jest zalecany do uruchamiania na następujących silnikach inferencyjnych: vLLM SGLang * KTransformers Kimi-K2.7-Code ma tę samą architekturę co Kimi-K2.5/Kimi-K2.6, a metoda wdrożenia może być bezpośrednio ponownie użyta. Wymagana wersja transformers to >=4.57.1.

Warianty do uruchomienia

WariantFormatRozmiar wagŹródło i weryfikacja
1 027B · SAFETENSORS
Manifest plików (65)
  • model.safetensors.index.jsonindex · 0,0 GB
  • model-00001-of-000064.safetensorsweights · 1,0 GB
  • model-00002-of-000064.safetensorsweights · 9,8 GB
  • model-00003-of-000064.safetensorsweights · 9,8 GB
  • model-00004-of-000064.safetensorsweights · 9,8 GB
  • model-00005-of-000064.safetensorsweights · 9,8 GB
  • model-00006-of-000064.safetensorsweights · 9,8 GB
  • model-00007-of-000064.safetensorsweights · 9,8 GB
  • model-00008-of-000064.safetensorsweights · 9,8 GB
  • model-00009-of-000064.safetensorsweights · 9,8 GB
  • model-00010-of-000064.safetensorsweights · 9,8 GB
  • model-00011-of-000064.safetensorsweights · 9,8 GB
  • model-00012-of-000064.safetensorsweights · 9,8 GB
  • model-00013-of-000064.safetensorsweights · 9,8 GB
  • model-00014-of-000064.safetensorsweights · 9,8 GB
  • model-00015-of-000064.safetensorsweights · 9,8 GB
  • model-00016-of-000064.safetensorsweights · 9,8 GB
  • model-00017-of-000064.safetensorsweights · 9,8 GB
  • model-00018-of-000064.safetensorsweights · 9,8 GB
  • model-00019-of-000064.safetensorsweights · 9,8 GB
  • model-00020-of-000064.safetensorsweights · 9,8 GB
  • model-00021-of-000064.safetensorsweights · 9,8 GB
  • model-00022-of-000064.safetensorsweights · 9,8 GB
  • model-00023-of-000064.safetensorsweights · 9,8 GB
  • model-00024-of-000064.safetensorsweights · 9,8 GB
  • model-00025-of-000064.safetensorsweights · 9,8 GB
  • model-00026-of-000064.safetensorsweights · 9,8 GB
  • model-00027-of-000064.safetensorsweights · 9,8 GB
  • model-00028-of-000064.safetensorsweights · 9,8 GB
  • model-00029-of-000064.safetensorsweights · 9,8 GB
  • model-00030-of-000064.safetensorsweights · 9,8 GB
  • model-00031-of-000064.safetensorsweights · 9,8 GB
  • model-00032-of-000064.safetensorsweights · 9,8 GB
  • model-00033-of-000064.safetensorsweights · 9,8 GB
  • model-00034-of-000064.safetensorsweights · 9,8 GB
  • model-00035-of-000064.safetensorsweights · 9,8 GB
  • model-00036-of-000064.safetensorsweights · 9,8 GB
  • model-00037-of-000064.safetensorsweights · 9,8 GB
  • model-00038-of-000064.safetensorsweights · 9,8 GB
  • model-00039-of-000064.safetensorsweights · 9,8 GB
  • model-00040-of-000064.safetensorsweights · 9,8 GB
  • model-00041-of-000064.safetensorsweights · 9,8 GB
  • model-00042-of-000064.safetensorsweights · 9,8 GB
  • model-00043-of-000064.safetensorsweights · 9,8 GB
  • model-00044-of-000064.safetensorsweights · 9,8 GB
  • model-00045-of-000064.safetensorsweights · 9,8 GB
  • model-00046-of-000064.safetensorsweights · 9,8 GB
  • model-00047-of-000064.safetensorsweights · 9,8 GB
  • model-00048-of-000064.safetensorsweights · 9,8 GB
  • model-00049-of-000064.safetensorsweights · 9,8 GB
  • model-00050-of-000064.safetensorsweights · 9,8 GB
  • model-00051-of-000064.safetensorsweights · 9,8 GB
  • model-00052-of-000064.safetensorsweights · 9,8 GB
  • model-00053-of-000064.safetensorsweights · 9,8 GB
  • model-00054-of-000064.safetensorsweights · 9,8 GB
  • model-00055-of-000064.safetensorsweights · 9,8 GB
  • model-00056-of-000064.safetensorsweights · 9,8 GB
  • model-00057-of-000064.safetensorsweights · 9,8 GB
  • model-00058-of-000064.safetensorsweights · 9,8 GB
  • model-00059-of-000064.safetensorsweights · 9,8 GB
  • model-00060-of-000064.safetensorsweights · 9,8 GB
  • model-00061-of-000064.safetensorsweights · 9,8 GB
  • model-00062-of-000064.safetensorsweights · 4,7 GB
  • model-00063-of-000064.safetensorsweights · 0,1 GB
  • model-00064-of-000064.safetensorsweights · 0,8 GB
SAFETENSORS595,2 GB64 shardówHugging Face Hub Models APIWeryfikacja: 2026-08-09

Ostatnia aktualizacja: 2026-08-18

Szybka opinia

Czy ten model pomógł Ci w realnym zadaniu? To zajmuje jedno kliknięcie. Szczegółowa ocena jest opcjonalna.

Brak szybkich opinii.

Zaloguj się, aby oddać szybką opinię.

Ocena użytkowników

Brak ocen użytkowników. Wynik AI-TOP pozostaje odrębną miarą techniczną.

API i ceny

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API.

Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.

Aktualne źródłowe stawki API
Dostawca APIWejście / 1 mln tokenówWyjście / 1 mln tokenówPozostałe stawki źródłoweMożliwości
OpenRouter2,64 zł / 1 mln tokenów13 zł / 1 mln tokenówCache odczyt: 0,557 zł / 1 mln tokenówKontekst providera: 262 144 · Maks. odpowiedź: 262 144 · Tokenizer: Other · Wejście: text, image · Wyjście: text · API: frequency_penalty, include_reasoning, logit_bias, logprobs, max_tokens · Bez moderacji providera

Ceny API są źródłowymi stawkami dostawcy, przeliczonymi na PLN według ostatniego zapisanego kursu średniego USD NBP. Stawki tokenowe pokazujemy za 1 mln tokenów. Dla obrazu, wyszukiwania, cache, reasoning i żądań zachowujemy jednostkę przekazaną przez API. Ceny są przeliczone na PLN według ostatniego zapisanego średniego kursu NBP USD z 2026-08-17.

Język polski

Wsparcie języka polskiego: deklarowane. Jakość języka polskiego: NIEZWERYFIKOWANA.

Dyskusja o modelu

Komentarze dotyczące praktycznego użycia tego modelu.

Nie ma jeszcze zatwierdzonych komentarzy.

Zaloguj się, aby komentować.

Historia modelu

Wykres pokazuje wyłącznie porównywalne punkty głównego rankingu. Tabela zawiera wynik, pozycję, dane źródłowe i stan każdego dnia.

Dane porównywalne

Historia wyniku AI-TOP

Seria używa snapshotów głównego rankingu z metodologii 1.2.

Skala adaptacyjna: obserwowany zakres 66–72 pkt / 100.

  • Wynik AI-TOP
Historia wyniku AI-TOPWykres obejmuje 16 dat od 2026-07-20 do 2026-08-18. Zakres osi: 66–72 pkt / 100. Skala osi jest adaptacyjna do obserwowanego zakresu.727169686620 lip7 sie11 sie14 sie18 sie
Dzienny zapis wyniku, pozycji, źródeł i statusu
DataWynik AI-TOPMiejsceDane źródłoweMetodologiaStan dnia
2026-08-18
  • 70,50 / 100
  • #14
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-17
  • 70,55 / 100
  • #14
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-16
  • 70,59 / 100
  • #14
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-15
  • 70,63 / 100
  • #14
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-14
  • 70,65 / 100
  • #14
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
  • Aktualizacja ceny API
2026-08-13
  • 70,82 / 100
  • #11
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
  • Aktualizacja ceny API
2026-08-12
  • 70,77 / 100
  • #13
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-11
  • 70,79 / 100
  • #13
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
  • Aktualizacja ceny API
2026-08-10
  • 67,73 / 100
  • #27
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
  • Aktualizacja ceny API
2026-08-09
  • 67,66 / 100
  • #27
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-08
  • 67,70 / 100
  • #27
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-08-07
  • 67,73 / 100
  • #27
  • Artificial Analysis 43,00 score
  • 1.2
  • Ranking zapisany
  • Źródła: 1
  • Aktualizacja ceny API
2026-07-26
  • 67,92 / 100
  • #26
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-25
  • 67,94 / 100
  • #27
  • OpenRouter: popularność #49
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-22
  • 67,95 / 100
  • #28
  • 1.2
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-21
  • Artificial Analysis 41,90 score
  • OpenRouter: popularność #48
  • Brak snapshotu rankingu
  • Źródła: 2
2026-07-20
  • 68,15 / 100
  • #20
  • OpenRouter: popularność #46
  • 1.2
  • Ranking zapisany
  • Źródła: 1
2026-07-19
  • 63,43 / 100
  • #30
  • 1.1
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-18
  • 63,36 / 100
  • #38
  • 1.1
  • Ranking zapisany
  • Brak metryk źródłowych
2026-07-17
  • OpenRouter: popularność #45
  • Brak snapshotu rankingu
  • Źródła: 1
  • Aktualizacja ceny API

Dane historii w formacie JSON