NL ▾
API-sleutel aanvragen

kimik2api.comKimi K2 API: eerste verzoek in vijf minuten

Kimi K2 API: eerste verzoek in vijf minuten

Ontvang je eerste respons binnen vijf minuten met onze OpenAI-compatible API. Deze gids behandelt de basis-URL, authenticatie en directe gebruikspatronen voor het ongecensureerde model.

Basis-URL en authenticatie

Maak verbinding met de kimik2api.com-dienst door je client te wijzen naar https://api.kimik2api.com/v1. Je hebt een geldige API-sleutel nodig voor elk verzoek. Genereer er een op de API-sleutel ophalen-pagina na het inloggen met alleen een e-mailadres en wachtwoord. Er is geen creditcard nodig om te beginnen, en elk account krijgt $0,50 aan gratis proeftegoed geldig voor 7 dagen. Houd je sleutel veilig; je kunt hem op elk moment opnieuw genereren om de oude ongeldig te maken.

Eerste verzoek (cURL)

Test de connectiviteit direct met een standaard chat-completieverzoek. Vervang YOUR_API_KEY door je daadwerkelijke sleutel. De model-ID is uncensored. Dit endpoint accepteert tekstinput en retourneert tekstoutput, met ondersteuning voor maximaal 100.000 tokens in de gecombineerde prompt en voltooiing.

curl https://api.kimik2api.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Als je een 401 ontvangt, is je sleutel ongeldig. Een 402 betekent dat je prepaid tegoed op is. Een 429 geeft aan dat je de limiet van 300 verzoeken per minuut hebt overschreden.

Python SDK-integratie

Gebruik de officiële openai Python-pakket om met de API te communiceren. Configureer de base_url en api_key om verzoeken naar onze servers te sturen in plaats van die van OpenAI. Dit stelt je in staat standaard clientcode te gebruiken zonder vendor lock-in. De model-ID blijft uncensored voor alle voltooiingen.

from openai import OpenAI

client = OpenAI(base_url="https://api.kimik2api.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Deze opstelling zorgt ervoor dat je de basis-URL eenvoudig kunt wijzigen. Zorg ervoor dat je omgeving de benodigde pakketten heeft geïnstalleerd voordat je het script uitvoert.

Node.js SDK-integratie

Voor JavaScript- en TypeScript-ontwikkelaars werkt de Node.js OpenAI SDK identiek. Stel de baseURL in op ons endpoint en lever je API-sleutel. Deze aanpak behoudt compatibiliteit met bestaande OpenAI-compatible clientcode. Je kunt berichten versturen en responsen ontvangen, net zoals bij andere LLM-aanbieders.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimik2api.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Onthoud dat we geen embeddings of beeldgeneratie aanbieden, dus het standaard chat-completie-endpoint is je primaire interface voor tekstgebaseerde interacties.

Streaming responsen (SSE)

Schakel realtime token-generatie in door stream: true in je request body in te stellen. De API retourneert Server-Sent Events (SSE) met gedeeltelijke deltas. Dit is ideaal voor chatinterfaces waar directe feedback de gebruikerservaring verbetert. Elke chunk bevat een deel van de gegenereerde tekst, zodat je output kunt weergeven terwijl deze wordt gemaakt.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Verwerk de stream-events in je clientcode om de UI incrementeel bij te werken. Dit vermindert de waargenomen latentie voor de eindgebruiker aanzienlijk.

Limieten, fouten en context

Onze API ondersteunt een contextvenster van 100.000 tokens, dat zowel de prompt als de completion omvat. De maximale grootte van de request body is 8 MB. Je bent beperkt tot 300 verzoeken per minuut per sleutel. Als je de rate limit raakt, wacht dan voordat je het opnieuw probeert. Het model is ongecensureerd, maar blokkeert seksuele inhoud met minderjarigen. De prijzen zijn transparant: $0,25 per 1M input tokens en $1,00 per 1M output tokens. Je tegoed vervalt nooit.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
AuthenticatieAuthorization: Bearer YOUR_KEY
Model-IDuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.kimik2api.com/v1
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Contextvenster100.000 tokens (invoer + uitvoer)
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
JSON-modusresponse_format: {"type": "json_object"}
Rate limit300 verzoeken per minuut per sleutel
Verzoekgroottetot 8 MB
Gelijktijdige verzoekentot 8 tegelijk per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Bonus+5% vanaf $50, +10% vanaf $100
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Is dit de officiële Kimi K2 API?

Nee, wij zijn een onafhankelijke dienst met een ongecensureerd taalmodel compatibel met het OpenAI API-formaat. Wij zijn niet verbonden met Moonshot AI of de officiële Kimi-aanbieder. Raadpleeg hun documentatie voor hun specifieke limieten en prijzen.

Heb ik een creditcard nodig voor de proefperiode?

Nee, je hebt alleen een e-mailadres en wachtwoord nodig om in te loggen. Je ontvangt $0,50 aan gratis proeftegoed geldig voor 7 dagen. Je kunt later meer tegoed toevoegen met crypto (USDT of USDC), vanaf $10.

Wat gebeurt er als ik de rate limit overschrijd?

Je ontvangt een 429 Too Many Requests-fout. De limiet is 300 verzoeken per minuut per API-sleutel. Je kunt je sleutel opnieuw genereren indien nodig, maar de rate limit geldt voor de sleutel zelf.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, wijzig de basis-URL. Dat is de hele opzet.

API-sleutel ophalenLees de documentatie