kimik2api.comAPI Kimi K2: primeira requisição em cinco minutos
API Kimi K2: primeira requisição em cinco minutos
Obtenha sua primeira resposta em menos de cinco minutos usando nossa API compatível com OpenAI. Este guia cobre a URL base, autenticação e padrões de uso imediato para o modelo sem censura.
URL base e autenticação
Conecte-se ao serviço kimik2api.com apontando seu cliente para https://api.kimik2api.com/v1. Você precisa de uma chave de API válida para cada requisição. Gere uma na página Get API key após se cadastrar com apenas um e-mail e senha. Não é necessário cartão de crédito para começar, e cada conta recebe $0,50 em crédito de teste válido por 7 dias. Mantenha sua chave segura; você pode regenerá-la a qualquer momento para revogar a anterior.
Primeira requisição (cURL)
Teste a conectividade imediatamente com uma solicitação padrão de conclusão de chat. Substitua YOUR_API_KEY pela sua chave real. O ID do modelo é uncensored. Este endpoint aceita entrada de texto e retorna saída de texto, suportando até 100.000 tokens no prompt e na conclusão combinados.
curl https://api.kimik2api.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Se você receber um erro 401, sua chave é inválida. Um erro 402 significa que seu crédito pré-pago está esgotado. Um erro 429 indica que você excedeu o limite de 300 requisições por minuto.
Integração com SDK Python
Use o pacote Python oficial openai para interagir com a API. Configure o base_url e o api_key para rotear as requisições para nossos servidores em vez dos da OpenAI. Isso permite que você use código cliente padrão sem dependência de fornecedor. O ID do modelo permanece uncensored para todas as conclusões.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimik2api.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Esta configuração garante que você possa trocar a URL base facilmente. Certifique-se de que seu ambiente tenha os pacotes necessários instalados antes de executar o script.
Integração com SDK Node.js
Para desenvolvedores JavaScript e TypeScript, o SDK OpenAI para Node.js funciona da mesma forma. Defina o baseURL para nosso endpoint e forneça sua chave de API. Esta abordagem mantém a compatibilidade com código de cliente existente compatível com OpenAI. Você pode enviar mensagens e receber respostas exatamente como faria com outros provedores de LLM.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimik2api.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Lembre-se de que não oferecemos embeddings nem geração de imagens, portanto, o endpoint padrão de conclusão de chat é sua principal interface para interações baseadas em texto.
Respostas em streaming (SSE)
Ative a geração de tokens em tempo real definindo stream: true no corpo da sua requisição. A API retorna Server-Sent Events (SSE) contendo deltas parciais. Isso é ideal para interfaces de chat onde o feedback imediato melhora a experiência do usuário. Cada fragmento contém uma parte do texto gerado, permitindo que você exiba a saída conforme ela é criada.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Manipule os eventos de stream no código do seu cliente para atualizar a interface do usuário incrementalmente. Isso reduz significativamente a latência percebida para o usuário final.
Limites, erros e contexto
Nossa API suporta uma janela de contexto de 100.000 tokens, abrangendo tanto o prompt quanto a conclusão. O tamanho máximo do corpo da requisição é 8 MB. Você está limitado a 300 requisições por minuto por chave. Se atingir o limite de requisições, aguarde antes de tentar novamente. O modelo é sem censura, mas bloqueia conteúdo sexual envolvendo menores. Os preços são transparentes: $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. O crédito nunca expira.
Especificações técnicas
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Autenticação | Authorization: Bearer YOUR_KEY |
| ID do modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.kimik2api.com/v1 |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Modo JSON | response_format: {"type": "json_object"} |
| Limite de taxa | 300 requisições por minuto por chave |
| Tamanho | até 8 MB por requisição |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Validade | crédito pago não expira, sem assinatura |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Login | Google ou e-mail e senha |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Esta é a API oficial Kimi K2?
Não, somos um serviço independente que hospeda um modelo de linguagem grande sem censura compatível com o formato da API OpenAI. Não temos afiliação com a Moonshot AI ou com o provedor oficial do Kimi. Consulte a documentação deles para ver os limites e preços específicos.
Preciso de cartão de crédito para o crédito de teste?
Não, você só precisa de um e-mail e senha para se cadastrar. Você recebe $0,50 em crédito de teste válido por 7 dias. Você pode adicionar mais crédito mais tarde usando criptomoedas (USDT ou USDC), a partir de $10.
O que acontece se eu exceder o limite de requisições?
Você receberá um erro 429. O limite é de 300 requisições por minuto por chave de API. Você pode regenerar sua chave se necessário, mas o limite de requisições aplica-se à própria chave.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.