PT ▾
Obter chave de API

kimik2api.comAPI Kimi K2: primeira requisição em cinco minutos

API Kimi K2: primeira requisição em cinco minutos

Obtenha sua primeira resposta em menos de cinco minutos usando nossa API compatível com OpenAI. Este guia cobre a URL base, autenticação e padrões de uso imediato para o modelo sem censura.

URL base e autenticação

Conecte-se ao serviço kimik2api.com apontando seu cliente para https://api.kimik2api.com/v1. Você precisa de uma chave de API válida para cada requisição. Gere uma na página Get API key após se cadastrar com apenas um e-mail e senha. Não é necessário cartão de crédito para começar, e cada conta recebe $0,50 em crédito de teste válido por 7 dias. Mantenha sua chave segura; você pode regenerá-la a qualquer momento para revogar a anterior.

Primeira requisição (cURL)

Teste a conectividade imediatamente com uma solicitação padrão de conclusão de chat. Substitua YOUR_API_KEY pela sua chave real. O ID do modelo é uncensored. Este endpoint aceita entrada de texto e retorna saída de texto, suportando até 100.000 tokens no prompt e na conclusão combinados.

curl https://api.kimik2api.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Se você receber um erro 401, sua chave é inválida. Um erro 402 significa que seu crédito pré-pago está esgotado. Um erro 429 indica que você excedeu o limite de 300 requisições por minuto.

Integração com SDK Python

Use o pacote Python oficial openai para interagir com a API. Configure o base_url e o api_key para rotear as requisições para nossos servidores em vez dos da OpenAI. Isso permite que você use código cliente padrão sem dependência de fornecedor. O ID do modelo permanece uncensored para todas as conclusões.

from openai import OpenAI

client = OpenAI(base_url="https://api.kimik2api.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Esta configuração garante que você possa trocar a URL base facilmente. Certifique-se de que seu ambiente tenha os pacotes necessários instalados antes de executar o script.

Integração com SDK Node.js

Para desenvolvedores JavaScript e TypeScript, o SDK OpenAI para Node.js funciona da mesma forma. Defina o baseURL para nosso endpoint e forneça sua chave de API. Esta abordagem mantém a compatibilidade com código de cliente existente compatível com OpenAI. Você pode enviar mensagens e receber respostas exatamente como faria com outros provedores de LLM.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimik2api.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Lembre-se de que não oferecemos embeddings nem geração de imagens, portanto, o endpoint padrão de conclusão de chat é sua principal interface para interações baseadas em texto.

Respostas em streaming (SSE)

Ative a geração de tokens em tempo real definindo stream: true no corpo da sua requisição. A API retorna Server-Sent Events (SSE) contendo deltas parciais. Isso é ideal para interfaces de chat onde o feedback imediato melhora a experiência do usuário. Cada fragmento contém uma parte do texto gerado, permitindo que você exiba a saída conforme ela é criada.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Manipule os eventos de stream no código do seu cliente para atualizar a interface do usuário incrementalmente. Isso reduz significativamente a latência percebida para o usuário final.

Limites, erros e contexto

Nossa API suporta uma janela de contexto de 100.000 tokens, abrangendo tanto o prompt quanto a conclusão. O tamanho máximo do corpo da requisição é 8 MB. Você está limitado a 300 requisições por minuto por chave. Se atingir o limite de requisições, aguarde antes de tentar novamente. O modelo é sem censura, mas bloqueia conteúdo sexual envolvendo menores. Os preços são transparentes: $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. O crédito nunca expira.

Especificações técnicas

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
AutenticaçãoAuthorization: Bearer YOUR_KEY
ID do modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.kimik2api.com/v1
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Janela de contexto100.000 tokens (entrada + saída)
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Modo JSONresponse_format: {"type": "json_object"}
Limite de taxa300 requisições por minuto por chave
Tamanhoaté 8 MB por requisição
Concorrência8 requisições ao mesmo tempo por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Bônus+5% a partir de $50, +10% a partir de $100
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Validadecrédito pago não expira, sem assinatura
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
Chavesuma chave ativa por conta; uma nova substitui a anterior
LoginGoogle ou e-mail e senha

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Esta é a API oficial Kimi K2?

Não, somos um serviço independente que hospeda um modelo de linguagem grande sem censura compatível com o formato da API OpenAI. Não temos afiliação com a Moonshot AI ou com o provedor oficial do Kimi. Consulte a documentação deles para ver os limites e preços específicos.

Preciso de cartão de crédito para o crédito de teste?

Não, você só precisa de um e-mail e senha para se cadastrar. Você recebe $0,50 em crédito de teste válido por 7 dias. Você pode adicionar mais crédito mais tarde usando criptomoedas (USDT ou USDC), a partir de $10.

O que acontece se eu exceder o limite de requisições?

Você receberá um erro 429. O limite é de 300 requisições por minuto por chave de API. Você pode regenerar sua chave se necessário, mas o limite de requisições aplica-se à própria chave.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de APILer a documentação