kimik2api.comAPI Kimi K2: prima richiesta in cinque minuti
API Kimi K2: prima richiesta in cinque minuti
Ottieni la tua prima risposta in meno di cinque minuti con la nostra API compatibile con OpenAI. Questa guida copre l'URL di base, l'autenticazione e i pattern di utilizzo immediati per il modello senza censura.
URL di base e autenticazione
Connettiti al servizio kimik2api.com puntando il tuo client a https://api.kimik2api.com/v1. Hai bisogno di una chiave API valida per ogni richiesta. Generane una nella pagina Ottieni chiave API dopo esserti registrato con solo email e password. Non serve la carta di credito per iniziare e ogni account riceve $0,50 di credito di prova valido per 7 giorni. Tieni la chiave al sicuro; puoi rigenerarla in qualsiasi momento per revocare quella vecchia.
Prima richiesta (cURL)
Verifica la connettività immediatamente con una richiesta standard di completamento chat. Sostituisci YOUR_API_KEY con la tua chiave effettiva. L'ID del modello è uncensored. Questo endpoint accetta input testuale e restituisce output testuale, supportando fino a 100.000 token nel prompt e nel completamento combinati.
curl https://api.kimik2api.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Se ricevi un 401, la tua chiave non è valida. Un 402 significa che il tuo credito prepagato è esaurito. Un 429 indica che hai superato il limite di 300 richieste al minuto.
Integrazione SDK Python
Usa il pacchetto Python ufficiale openai per interagire con l'API. Configura base_url e api_key per instradare le richieste ai nostri server invece che a quelli di OpenAI. Questo ti permette di usare codice client standard senza vincoli. L'ID del modello rimane uncensored per tutti i testi generati.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimik2api.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Questa configurazione garantisce che tu possa cambiare facilmente l'URL di base. Assicurati che il tuo ambiente abbia i pacchetti necessari installati prima di eseguire lo script.
Integrazione SDK Node.js
Per gli sviluppatori JavaScript e TypeScript, l'SDK Node.js OpenAI funziona allo stesso modo. Imposta baseURL sul nostro endpoint e fornisci la tua chiave API. Questo approccio mantiene la compatibilità con il codice client esistente compatibile con OpenAI. Puoi inviare messaggi e ricevere risposte proprio come faresti con altri provider LLM.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimik2api.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Ricorda che non offriamo embeddings né generazione di immagini, quindi l'endpoint standard di completamento chat è la tua interfaccia principale per le interazioni basate su testo.
Risposte in streaming (SSE)
Abilita la generazione di token in tempo reale impostando stream: true nel corpo della richiesta. L'API restituisce Server-Sent Events (SSE) contenenti delta parziali. È ideale per le interfacce chat dove il feedback immediato migliora l'esperienza utente. Ogni frammento contiene una parte del testo generato, permettendoti di visualizzare l'output mentre viene creato.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Gestisci gli eventi di stream nel codice client per aggiornare l'UI in modo incrementale. Questo riduce significativamente la latenza percepita per l'utente finale.
Limiti, errori e contesto
La nostra API supporta una finestra di contesto di 100.000 token, che copre sia il prompt che il testo generato. La dimensione massima del corpo della richiesta è 8 MB. Sei limitato a 300 richieste al minuto per chiave. Se superi il limite di richieste, attendi prima di riprovare. Il modello è senza censura ma blocca i contenuti sessuali che coinvolgono minori. I prezzi sono trasparenti: $0,25 per 1M di token in input e $1,00 per 1M di token in output. Il credito non scade mai.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| ID modello | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.kimik2api.com/v1 |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Finestra di contesto | 100.000 token (input + output) |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Modalità JSON | response_format: {"type": "json_object"} |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Bonus | +5% da $50, +10% da $100 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
È l'API ufficiale Kimi K2?
No, siamo un servizio indipendente che ospita un modello linguistico di grandi dimensioni senza censura compatibile con il formato API OpenAI. Non siamo affiliati a Moonshot AI né al fornitore ufficiale di Kimi. Consulta la loro documentazione per limiti e prezzi specifici.
Serve una carta di credito per la prova?
No, ti servono solo email e password per registrarti. Ricevi $0,50 di credito di prova valido per 7 giorni. Puoi aggiungere altro credito in seguito usando criptovalute (USDT o USDC), a partire da $10.
Cosa succede se supero il limite di richieste?
Riceverai un errore 429 Troppe richieste. Il limite è di 300 richieste al minuto per chiave API. Puoi rigenerare la tua chiave se necessario, ma il limite di richieste si applica alla chiave stessa.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.