kimik2api.comAPI Kimi K2: pierwsze zapytanie w pięć minut
API Kimi K2: pierwsze zapytanie w pięć minut
Otrzymaj pierwszą odpowiedź w mniej niż pięć minut dzięki API kompatybilnemu z OpenAI. Przewodnik obejmuje bazowy URL, uwierzytelnianie i wzorce użycia modelu bez cenzury.
Bazowy URL i uwierzytelnianie
Połącz się z usługą kimik2api.com, wskazując klientowi adres https://api.kimik2api.com/v1. Do każdego zapytania potrzebujesz ważnego klucza API. Wygeneruj go na stronie Pobierz klucz API po rejestracji samym e-mailem i hasłem. Nie potrzebujesz karty kredytowej, a każde konto otrzymuje $0.50 kredytu próbnego ważnego przez 7 dni. Chroń klucz; możesz go wygenerować ponownie, aby unieważnić stary.
Pierwsze zapytanie (cURL)
Przetestuj łączność standardowym zapytaniem o uzupełnienie czatu. Zastąp YOUR_API_KEY swoim kluczem. ID modelu to uncensored. Endpoint przyjmuje tekst i zwraca tekst, obsługując do 100 000 tokenów w łącznym prompcie i uzupełnieniu.
curl https://api.kimik2api.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Jeśli otrzymasz 401, klucz jest nieprawidłowy. 402 oznacza wyczerpanie przedpłaconego kredytu. 429 oznacza przekroczenie limitu 300 zapytań na minutę.
Integracja z Python SDK
Użyj oficjalnego pakietu Python openai do interakcji z API. Skonfiguruj base_url i api_key, aby kierować zapytania do naszych serwerów zamiast OpenAI. Pozwala to używać standardowego kodu bez uzależnienia od dostawcy. ID modelu to nadal uncensored dla wszystkich uzupełnień.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimik2api.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Ta konfiguracja ułatwia zmianę bazowego URL. Upewnij się, że środowisko ma zainstalowane niezbędne pakiety przed uruchomieniem skryptu.
Integracja z Node.js SDK
Dla programistów JavaScript i TypeScript Node.js OpenAI SDK działa identycznie. Ustaw baseURL na nasz endpoint i podaj klucz API. To podejście zachowuje kompatybilność z istniejącym kodem klienta kompatybilnym z OpenAI. Możesz wysyłać wiadomości i odbierać odpowiedzi jak u innych dostawców LLM.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimik2api.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Pamiętaj, że nie oferujemy embeddingów ani generowania obrazów, więc standardowy endpoint uzupełnień czatu jest Twoim głównym interfejsem do interakcji tekstowych.
Odpowiedzi strumieniowe (SSE)
Włącz generowanie tokenów w czasie rzeczywistym, ustawiając stream: true w ciele żądania. API zwraca zdarzenia wysyłane serwerowo (SSE) zawierające częściowe delty. Jest to idealne dla interfejsów czatu, gdzie natychmiastowa informacja zwrotna poprawia doświadczenie użytkownika. Każdy fragment zawiera część wygenerowanego tekstu, co pozwala wyświetlać wynik w miarę jego tworzenia.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Obsłuż zdarzenia strumienia w kodzie klienta, aby aktualizować interfejs użytkownika stopniowo. Znacząco zmniejsza to postrzegane opóźnienie dla końcowego użytkownika.
Limity, błędy i kontekst
Nasze API obsługuje okno kontekstu 100 000 tokenów, obejmujące prompt i uzupełnienie. Maksymalny rozmiar ciała żądania to 8 MB. Limit to 300 zapytań na minutę na klucz. Jeśli przekroczysz limit zapytań, poczekaj przed ponowną próbą. Model jest bez cenzury, ale blokuje treści seksualne z udziałem małoletnich. Ceny są przejrzyste: $0.25 za 1M tokenów wejściowych i $1.00 za 1M tokenów wyjściowych. Kredyt nigdy nie wygasa.
Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| ID modelu | uncensored |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.kimik2api.com/v1 |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Tryb JSON | response_format: {"type": "json_object"} |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Rozmiar zapytania | do 8 MB |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Bonus | +5% od $50, +10% od $100 |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy to oficjalne API Kimi K2?
Nie, to niezależna usługa hostująca model bez cenzury kompatybilny z formatem API OpenAI. Nie jesteśmy powiązani z Moonshot AI ani oficjalnym dostawcą Kimi. Sprawdź ich dokumentację, aby poznać limity i ceny.
Czy potrzebuję karty kredytowej do próby?
Nie, potrzebujesz tylko adresu e-mail i hasła, aby się zarejestrować. Otrzymujesz $0,50 w darmowym kredycie próbnym ważnym przez 7 dni. Możesz doładować więcej kredytu później za pomocą kryptowalut (USDT lub USDC), zaczynając od $10.
Co się stanie, gdy przekroczę limit zapytań?
Otrzymasz błąd 429 Too Many Requests. Limit to 300 zapytań na minutę na klucz API. Możesz wygenerować klucz ponownie, ale limit zapytań dotyczy samego klucza.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.