kimik2api.comKimi K2 API: Erste Anfrage in fünf Minuten
Kimi K2 API: Erste Anfrage in fünf Minuten
Erhalte deine erste Antwort in weniger als fünf Minuten mit unserer OpenAI-kompatiblen API. Dieser Leitfaden behandelt die Base URL, die Authentifizierung und sofort einsetzbare Nutzungsmuster für das unzensierte Modell.
Basis-URL und Authentifizierung
Verbinde dich mit dem kimik2api.com-Dienst, indem du deinen Client auf https://api.kimik2api.com/v1 zeigst. Du benötigst für jede Anfrage einen gültigen API-Schlüssel. Generiere ihn auf der API-Schlüssel erhalten-Seite nach der Anmeldung mit nur E-Mail und Passwort. Es wird keine Kreditkarte benötigt, um zu starten, und jedem Konto steht $0,50 an kostenlosem Testguthaben für 7 Tage zur Verfügung. Halte deinen Schlüssel sicher; du kannst ihn jederzeit neu generieren, um den alten zu widerrufen.
Erste Anfrage (cURL)
Teste die Konnektivität sofort mit einer Standard-Chat-Completion-Anfrage. Ersetze YOUR_API_KEY durch deinen tatsächlichen Schlüssel. Die Modell-ID ist uncensored. Dieser Endpunkt akzeptiert Texteingaben und gibt Textausgaben zurück und unterstützt bis zu 100.000 Token im kombinierten Prompt und der Completion.
curl https://api.kimik2api.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Wenn du einen 401 erhältst, ist dein Schlüssel ungültig. Ein 402 bedeutet, dass dein Prepaid-Guthaben aufgebraucht ist. Ein 429 zeigt an, dass du das Limit von 300 Anfragen pro Minute überschritten hast.
Python SDK-Integration
Verwende das offizielle openai Python-Paket, um mit der API zu interagieren. Konfiguriere die base_url und api_key, um Anfragen an unsere Server statt an die von OpenAI zu leiten. So kannst du Standard-Client-Code ohne Anbieterbindung verwenden. Die Modell-ID bleibt für alle Completions uncensored.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimik2api.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Diese Einrichtung stellt sicher, dass du die Base URL einfach austauschen kannst. Stelle sicher, dass deine Umgebung die erforderlichen Pakete installiert hat, bevor du das Skript ausführst.
Node.js SDK-Integration
Für JavaScript- und TypeScript-Entwickler funktioniert das Node.js OpenAI SDK identisch. Lege die baseURL auf unseren Endpunkt fest und gib deinen API-Schlüssel an. Dieser Ansatz erhält die Kompatibilität mit bestehendem OpenAI-kompatiblen Client-Code. Du kannst Nachrichten senden und Antworten empfangen, genau wie bei anderen LLM-Anbietern.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimik2api.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Denke daran, dass wir keine Embeddings oder Bildgenerierung anbieten, daher ist der Standard-Chat-Completions-Endpunkt deine primäre Schnittstelle für textbasierte Interaktionen.
Streaming-Antworten (SSE)
Aktiviere die Echtzeit-Token-Generierung, indem du stream: true im Anfragekörper festlegst. Die API gibt Server-Sent Events (SSE) zurück, die partielle Delta-Werte enthalten. Dies ist ideal für Chat-Schnittstellen, bei denen sofortiges Feedback die Benutzererfahrung verbessert. Jeder Chunk enthält einen Teil des generierten Textes, sodass du die Ausgabe angezeigt bekommst, während sie erstellt wird.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Verarbeite die Stream-Ereignisse in deinem Client-Code, um die Benutzeroberfläche inkrementell zu aktualisieren. Dies reduziert die wahrgenommene Latenz für den Endnutzer erheblich.
Limits, Fehler und Kontext
Unsere API unterstützt ein Kontextfenster mit 100.000 Token, das sowohl den Prompt als auch die Ausgabe-Token abdeckt. Die maximale Größe des Anfragekörpers beträgt 8 MB. Du bist auf 300 Anfragen pro Minute pro Schlüssel begrenzt. Wenn du das Ratenlimit erreichst, warte, bevor du es erneut versuchst. Das Modell ist unzensiert, blockiert jedoch sexuellen Inhalt mit Minderjährigen. Die Preise sind transparent: $0,25 pro 1 Mio. Input-Token und $1,00 pro 1 Mio. Output-Token. Guthaben verfällt nie.
Technische Daten
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.kimik2api.com/v1 |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| JSON-Modus | response_format: {"type": "json_object"} |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Anfragegröße | bis 8 MB |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist dies die offizielle Kimi K2 API?
Nein, wir sind ein unabhängiger Dienst, der ein unzensiertes Large Language Model hostet, das mit dem OpenAI-API-Format kompatibel ist. Wir stehen nicht in Verbindung mit Moonshot AI oder dem offiziellen Kimi-Anbieter. Prüfe deren Dokumentation für deren spezifische Limits und Preise.
Brauche ich für das Testguthaben eine Kreditkarte?
Nein, du brauchst nur eine E-Mail-Adresse und ein Passwort, um dich anzumelden. Du erhältst $0,50 an kostenlosem Testguthaben, das 7 Tage gültig ist. Du kannst später mehr Guthaben mit Krypto (USDT oder USDC) aufladen, ab $10.
Was passiert, wenn ich das Ratenlimit überschreite?
Du erhältst einen 429 Too Many Requests-Fehler. Das Limit liegt bei 300 Anfragen pro Minute pro API-Schlüssel. Du kannst deinen Schlüssel bei Bedarf neu generieren, aber das Ratenlimit gilt für den Schlüssel selbst.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.