kimik2api.comKimi K2 API: eerste verzoek in vijf minuten
Kimi K2 API: eerste verzoek in vijf minuten
Ontvang je eerste respons binnen vijf minuten met onze OpenAI-compatible API. Deze gids behandelt de basis-URL, authenticatie en directe gebruikspatronen voor het ongecensureerde model.
Basis-URL en authenticatie
Maak verbinding met de kimik2api.com-dienst door je client te wijzen naar https://api.kimik2api.com/v1. Je hebt een geldige API-sleutel nodig voor elk verzoek. Genereer er een op de API-sleutel ophalen-pagina na het inloggen met alleen een e-mailadres en wachtwoord. Er is geen creditcard nodig om te beginnen, en elk account krijgt $0,50 aan gratis proeftegoed geldig voor 7 dagen. Houd je sleutel veilig; je kunt hem op elk moment opnieuw genereren om de oude ongeldig te maken.
Eerste verzoek (cURL)
Test de connectiviteit direct met een standaard chat-completieverzoek. Vervang YOUR_API_KEY door je daadwerkelijke sleutel. De model-ID is uncensored. Dit endpoint accepteert tekstinput en retourneert tekstoutput, met ondersteuning voor maximaal 100.000 tokens in de gecombineerde prompt en voltooiing.
curl https://api.kimik2api.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Als je een 401 ontvangt, is je sleutel ongeldig. Een 402 betekent dat je prepaid tegoed op is. Een 429 geeft aan dat je de limiet van 300 verzoeken per minuut hebt overschreden.
Python SDK-integratie
Gebruik de officiële openai Python-pakket om met de API te communiceren. Configureer de base_url en api_key om verzoeken naar onze servers te sturen in plaats van die van OpenAI. Dit stelt je in staat standaard clientcode te gebruiken zonder vendor lock-in. De model-ID blijft uncensored voor alle voltooiingen.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimik2api.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Deze opstelling zorgt ervoor dat je de basis-URL eenvoudig kunt wijzigen. Zorg ervoor dat je omgeving de benodigde pakketten heeft geïnstalleerd voordat je het script uitvoert.
Node.js SDK-integratie
Voor JavaScript- en TypeScript-ontwikkelaars werkt de Node.js OpenAI SDK identiek. Stel de baseURL in op ons endpoint en lever je API-sleutel. Deze aanpak behoudt compatibiliteit met bestaande OpenAI-compatible clientcode. Je kunt berichten versturen en responsen ontvangen, net zoals bij andere LLM-aanbieders.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimik2api.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Onthoud dat we geen embeddings of beeldgeneratie aanbieden, dus het standaard chat-completie-endpoint is je primaire interface voor tekstgebaseerde interacties.
Streaming responsen (SSE)
Schakel realtime token-generatie in door stream: true in je request body in te stellen. De API retourneert Server-Sent Events (SSE) met gedeeltelijke deltas. Dit is ideaal voor chatinterfaces waar directe feedback de gebruikerservaring verbetert. Elke chunk bevat een deel van de gegenereerde tekst, zodat je output kunt weergeven terwijl deze wordt gemaakt.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Verwerk de stream-events in je clientcode om de UI incrementeel bij te werken. Dit vermindert de waargenomen latentie voor de eindgebruiker aanzienlijk.
Limieten, fouten en context
Onze API ondersteunt een contextvenster van 100.000 tokens, dat zowel de prompt als de completion omvat. De maximale grootte van de request body is 8 MB. Je bent beperkt tot 300 verzoeken per minuut per sleutel. Als je de rate limit raakt, wacht dan voordat je het opnieuw probeert. Het model is ongecensureerd, maar blokkeert seksuele inhoud met minderjarigen. De prijzen zijn transparant: $0,25 per 1M input tokens en $1,00 per 1M output tokens. Je tegoed vervalt nooit.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Model-ID | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.kimik2api.com/v1 |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| JSON-modus | response_format: {"type": "json_object"} |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Verzoekgrootte | tot 8 MB |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inloggen | Google of e-mail en wachtwoord |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is dit de officiële Kimi K2 API?
Nee, wij zijn een onafhankelijke dienst met een ongecensureerd taalmodel compatibel met het OpenAI API-formaat. Wij zijn niet verbonden met Moonshot AI of de officiële Kimi-aanbieder. Raadpleeg hun documentatie voor hun specifieke limieten en prijzen.
Heb ik een creditcard nodig voor de proefperiode?
Nee, je hebt alleen een e-mailadres en wachtwoord nodig om in te loggen. Je ontvangt $0,50 aan gratis proeftegoed geldig voor 7 dagen. Je kunt later meer tegoed toevoegen met crypto (USDT of USDC), vanaf $10.
Wat gebeurt er als ik de rate limit overschrijd?
Je ontvangt een 429 Too Many Requests-fout. De limiet is 300 verzoeken per minuut per API-sleutel. Je kunt je sleutel opnieuw genereren indien nodig, maar de rate limit geldt voor de sleutel zelf.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, wijzig de basis-URL. Dat is de hele opzet.