PT ▾
API compatível com OpenAI para Claude Codehttps://api.claudecodeapikey.com/v1
Obter chave de API

InícioDocumentação

Início rápido para usuários do Claude Code

Conecte o Claude Code ou qualquer agente compatível com OpenAI ao nosso proxy em menos de dois minutos. Este quickstart cobre a URL base, autenticação e os endpoints exatos necessários para tarefas de codificação.

Autenticação

Toda requisição ao nosso proxy requer uma chave de API válida. Você recebe essa chave imediatamente após entrar na página Obter chave de API. Inclua-a no cabeçalho Authorization como um token Bearer. Se a chave estiver ausente ou inválida, a API retornará um erro 401. Você pode regenerar sua chave a qualquer momento no seu painel, o que revoga instantaneamente a anterior. Isso garante que chaves perdidas ou comprometidas não permitam acesso contínuo aos seus créditos pré-pagos.

Endpoint de Conclusões de Chat

Envie seus prompts de codificação para o endpoint padrão de conclusões de chat. A URL base para todas as requisições é https://api.claudecodeapikey.com/v1. Use o ID do modelo uncensored para acessar nosso modelo de linguagem grande. Este modelo é ajustado para responder sem recusas de conteúdo para uso adulto lícito, tornando-o ideal para gerar código sem bloqueios desnecessários. O endpoint suporta respostas padrão e em streaming. Abaixo está um exemplo de uma requisição básica usando curl.

curl https://api.claudecodeapikey.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

O corpo da requisição deve permanecer abaixo de 8 MB. Se você exceder esse limite, o servidor rejeitará a carga útil. O modelo lida com uma janela de contexto de 100.000 tokens, combinando tokens de entrada e saída. Isso permite snippets de código substanciais e históricos longos de conversas sem truncamento imediato.

SDK Python

Para desenvolvedores que usam Python, você pode integrar nossa API usando o SDK oficial da OpenAI. Basta apontar o cliente para nossa URL base e fornecer sua chave de API. O ID do modelo uncensored funciona exatamente como outros modelos compatíveis com OpenAI no SDK. Você pode chamar o método de conclusão e tratar a resposta como um objeto de texto padrão. Esta abordagem é ideal para processamento em lote ou integração em scripts de automação maiores.

from openai import OpenAI

client = OpenAI(base_url="https://api.claudecodeapikey.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Lembre-se de que o SDK cuida da serialização JSON para você. Você só precisa garantir que sua variável base_url aponte para nosso proxy. O objeto de resposta contém o texto gerado, que você pode então gravar em seus arquivos ou alimentar de volta no contexto da conversa.

SDK Node.js

Desenvolvedores Node.js podem usar o pacote npm da OpenAI para interagir com nosso proxy. Configure o cliente com a URL base personalizada e sua chave de API. O padrão de uso espelha a implementação Python: crie um cliente, chame o endpoint de conclusões de chat e processe o resultado. Isso é útil para geração de código no lado do servidor ou assistentes de codificação em tempo real.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.claudecodeapikey.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

O SDK Node gerencia as conexões HTTP de forma eficiente. Certifique-se de estar usando uma versão do SDK que suporte URLs base personalizadas. A estrutura da resposta permanece consistente com o padrão OpenAI, facilitando a troca entre diferentes provedores compatíveis com OpenAI, se necessário.

Respostas em Streaming

Para assistência de codificação em tempo real, ative o streaming definindo stream: true em sua requisição. A API retorna um stream de Server-Sent Events (SSE). Cada chunk contém uma resposta parcial, permitindo que você exiba o código conforme ele é gerado. Isso melhora significativamente a experiência do usuário em agentes de codificação interativos.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Trate os eventos de stream em seu código para acumular a resposta final. O streaming não consome mais tokens do que uma requisição sem streaming; ele apenas altera a forma como os dados são entregues. Isso é particularmente útil para blocos longos de código onde você deseja mostrar o progresso imediatamente.

Limites de Taxa e Cotas

Nossa API impõe um limite de 300 requisições por minuto por chave de API. Se você exceder isso, receberá um erro 429. Você deve implementar lógica de nova tentativa com backoff exponencial em seus aplicativos. Além disso, cada conta é limitada a uma chave de API, que pode ser regenerada se necessário. O erro 402 indica que seu crédito pré-pago foi esgotado. Você pode recarregar a partir de $10 usando criptomoedas (USDT ou USDC). Créditos nunca expiram, então você pode pausar e retomar o uso no seu próprio ritmo sem perder seu saldo.

Especificações técnicas

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaçãoAuthorization: Bearer YOUR_KEY
ID do modelouncensored
Base URLhttps://api.claudecodeapikey.com/v1
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Janela de contexto100.000 tokens (entrada + saída)
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Modo JSONresponse_format: {"type": "json_object"}
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite de taxa300 requisições por minuto por chave
Concorrência8 requisições ao mesmo tempo por chave
Tamanhoaté 8 MB por requisição
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Bônus+5% a partir de $50, +10% a partir de $100
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Validadecrédito pago não expira, sem assinatura
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
Chavesuma chave ativa por conta; uma nova substitui a anterior
LoginGoogle ou e-mail e senha

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Esta é a API oficial da Anthropic?

Não, este é um serviço proxy independente. Hospedamos nosso próprio modelo de linguagem grande sem censura, compatível com o formato de conclusões de chat da OpenAI. Não é GPT, Claude ou qualquer outro modelo de fornecedor.

O que acontece se eu ficar sem créditos?

As requisições retornarão um erro <code>402</code>. Você pode recarregar sua conta a qualquer momento a partir de $10 usando criptomoedas (USDT ou USDC). Seus créditos não utilizados nunca expiram, então você pode adicionar fundos quando for conveniente.

O modelo recusa conteúdo?

O modelo é ajustado para responder sem recusas para tópicos adultos lícitos, fictícios ou controversos. A única restrição rígida é que o conteúdo sexual envolvendo menores é sempre bloqueado.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API