kimik2api.comAPI Kimi K2 : première requête en cinq minutes
API Kimi K2 : première requête en cinq minutes
Obtenez votre première réponse en moins de cinq minutes grâce à notre API compatible OpenAI. Ce guide couvre l'URL de base, l'authentification et les cas d'utilisation immédiats pour le modèle sans censure.
URL de base et authentification
Connectez-vous au service kimik2api.com en pointant votre client vers https://api.kimik2api.com/v1. Une clé API valide est requise pour chaque requête. Générez-en une sur la page Obtenir la clé API après vous être inscrit avec simplement une adresse e-mail et un mot de passe. Aucune carte bancaire n'est nécessaire pour démarrer, et chaque compte reçoit 0,50 $ de crédit d'essai valable 7 jours. Gardez votre clé en sécurité ; vous pouvez la régénérer à tout moment pour révoquer l'ancienne.
Première requête (cURL)
Testez la connectivité immédiatement avec une requête standard de complétion de chat. Remplacez YOUR_API_KEY par votre clé réelle. L'ID du modèle est uncensored. Cet endpoint accepte une entrée textuelle et retourne une sortie textuelle, supportant jusqu'à 100 000 tokens dans le prompt et la complétion combinés.
curl https://api.kimik2api.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Si vous recevez une erreur 401, votre clé est invalide. Un code 402 signifie que votre crédit prépayé est épuisé. Un code 429 indique que vous avez dépassé la limite de 300 requêtes par minute.
Intégration SDK Python
Utilisez le package Python officiel openai pour interagir avec l'API. Configurez les paramètres base_url et api_key pour acheminer les requêtes vers nos serveurs au lieu de ceux d'OpenAI. Cela vous permet d'utiliser du code client standard sans dépendance à un fournisseur. L'ID du modèle reste uncensored pour toutes les complétions.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimik2api.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Cette configuration garantit que vous pouvez facilement modifier l'URL de base. Assurez-vous que votre environnement dispose des packages nécessaires installés avant d'exécuter le script.
Intégration SDK Node.js
Pour les développeurs JavaScript et TypeScript, le SDK OpenAI Node.js fonctionne de manière identique. Définissez le baseURL sur notre endpoint et fournissez votre clé API. Cette approche maintient la compatibilité avec le code client existant compatible OpenAI. Vous pouvez envoyer des messages et recevoir des réponses exactement comme avec d'autres fournisseurs de LLM.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimik2api.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
N'oubliez pas que nous ne proposons pas d'embeddings ni de génération d'images, donc l'endpoint standard de complétion de chat est votre interface principale pour les interactions textuelles.
Réponses en streaming (SSE)
Activez la génération de tokens en temps réel en définissant stream: true dans le corps de votre requête. L'API retourne des Server-Sent Events (SSE) contenant des deltas partiels. C'est idéal pour les interfaces de chat où un retour immédiat améliore l'expérience utilisateur. Chaque chunk contient une partie du texte généré, vous permettant d'afficher la sortie au fur et à mesure de sa création.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Gérez les événements de stream dans le code de votre client pour mettre à jour l'interface utilisateur de manière incrémentale. Cela réduit considérablement la latence perçue pour l'utilisateur final.
Limites, erreurs et contexte
Notre API supporte une fenêtre de contexte de 100 000 tokens, couvrant à la fois le prompt et la complétion. La taille maximale du corps de la requête est de 8 Mo. Vous êtes limité à 300 requêtes par minute par clé. Si vous atteignez la limite de débit, attendez avant de réessayer. Le modèle est sans censure mais bloque le contenu sexuel impliquant des mineurs. Les tarifs sont transparents : 0,25 $ par 1M de tokens d'entrée et 1,00 $ par 1M de tokens de sortie. Le crédit n'expire jamais.
Caractéristiques techniques
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.kimik2api.com/v1 |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Mode JSON | response_format: {"type": "json_object"} |
| Limite de débit | 300 requêtes par minute et par clé |
| Taille | jusqu'à 8 Mo par requête |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Connexion | Google ou e-mail et mot de passe |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
S'agit-il de l'API officielle Kimi K2 ?
Non, nous sommes un service indépendant hébergeant un modèle de langage sans censure compatible avec le format de l'API OpenAI. Nous ne sommes pas affiliés à Moonshot AI ni au fournisseur officiel de Kimi. Consultez leur documentation pour connaître leurs limites et tarifs spécifiques.
Faut-il une carte bancaire pour l'essai ?
Non, il suffit d'une adresse e-mail et d'un mot de passe pour vous inscrire. Vous recevez 0,50 $ de crédit d'essai valable 7 jours. Vous pouvez recharger votre compte ultérieurement en crypto (USDT ou USDC), à partir de 10 $.
Que se passe-t-il si je dépasse la limite de débit ?
Vous recevrez une erreur 429 Too Many Requests. La limite est de 300 requêtes par minute par clé API. Vous pouvez régénérer votre clé si nécessaire, mais la limite de débit s'applique à la clé elle-même.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.