InícioDocumentação
Início rápido para usuários do Claude Code
Conecte o Claude Code ou qualquer agente compatível com OpenAI ao nosso proxy em menos de dois minutos. Este quickstart cobre a URL base, autenticação e os endpoints exatos necessários para tarefas de codificação.
Autenticação
Toda requisição ao nosso proxy requer uma chave de API válida. Você recebe essa chave imediatamente após entrar na página Obter chave de API. Inclua-a no cabeçalho Authorization como um token Bearer. Se a chave estiver ausente ou inválida, a API retornará um erro 401. Você pode regenerar sua chave a qualquer momento no seu painel, o que revoga instantaneamente a anterior. Isso garante que chaves perdidas ou comprometidas não permitam acesso contínuo aos seus créditos pré-pagos.
Endpoint de Conclusões de Chat
Envie seus prompts de codificação para o endpoint padrão de conclusões de chat. A URL base para todas as requisições é https://api.claudecodeapikey.com/v1. Use o ID do modelo uncensored para acessar nosso modelo de linguagem grande. Este modelo é ajustado para responder sem recusas de conteúdo para uso adulto lícito, tornando-o ideal para gerar código sem bloqueios desnecessários. O endpoint suporta respostas padrão e em streaming. Abaixo está um exemplo de uma requisição básica usando curl.
curl https://api.claudecodeapikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
O corpo da requisição deve permanecer abaixo de 8 MB. Se você exceder esse limite, o servidor rejeitará a carga útil. O modelo lida com uma janela de contexto de 100.000 tokens, combinando tokens de entrada e saída. Isso permite snippets de código substanciais e históricos longos de conversas sem truncamento imediato.
SDK Python
Para desenvolvedores que usam Python, você pode integrar nossa API usando o SDK oficial da OpenAI. Basta apontar o cliente para nossa URL base e fornecer sua chave de API. O ID do modelo uncensored funciona exatamente como outros modelos compatíveis com OpenAI no SDK. Você pode chamar o método de conclusão e tratar a resposta como um objeto de texto padrão. Esta abordagem é ideal para processamento em lote ou integração em scripts de automação maiores.
from openai import OpenAI
client = OpenAI(base_url="https://api.claudecodeapikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Lembre-se de que o SDK cuida da serialização JSON para você. Você só precisa garantir que sua variável base_url aponte para nosso proxy. O objeto de resposta contém o texto gerado, que você pode então gravar em seus arquivos ou alimentar de volta no contexto da conversa.
SDK Node.js
Desenvolvedores Node.js podem usar o pacote npm da OpenAI para interagir com nosso proxy. Configure o cliente com a URL base personalizada e sua chave de API. O padrão de uso espelha a implementação Python: crie um cliente, chame o endpoint de conclusões de chat e processe o resultado. Isso é útil para geração de código no lado do servidor ou assistentes de codificação em tempo real.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.claudecodeapikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
O SDK Node gerencia as conexões HTTP de forma eficiente. Certifique-se de estar usando uma versão do SDK que suporte URLs base personalizadas. A estrutura da resposta permanece consistente com o padrão OpenAI, facilitando a troca entre diferentes provedores compatíveis com OpenAI, se necessário.
Respostas em Streaming
Para assistência de codificação em tempo real, ative o streaming definindo stream: true em sua requisição. A API retorna um stream de Server-Sent Events (SSE). Cada chunk contém uma resposta parcial, permitindo que você exiba o código conforme ele é gerado. Isso melhora significativamente a experiência do usuário em agentes de codificação interativos.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Trate os eventos de stream em seu código para acumular a resposta final. O streaming não consome mais tokens do que uma requisição sem streaming; ele apenas altera a forma como os dados são entregues. Isso é particularmente útil para blocos longos de código onde você deseja mostrar o progresso imediatamente.
Limites de Taxa e Cotas
Nossa API impõe um limite de 300 requisições por minuto por chave de API. Se você exceder isso, receberá um erro 429. Você deve implementar lógica de nova tentativa com backoff exponencial em seus aplicativos. Além disso, cada conta é limitada a uma chave de API, que pode ser regenerada se necessário. O erro 402 indica que seu crédito pré-pago foi esgotado. Você pode recarregar a partir de $10 usando criptomoedas (USDT ou USDC). Créditos nunca expiram, então você pode pausar e retomar o uso no seu próprio ritmo sem perder seu saldo.
Especificações técnicas
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticação | Authorization: Bearer YOUR_KEY |
| ID do modelo | uncensored |
| Base URL | https://api.claudecodeapikey.com/v1 |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Modo JSON | response_format: {"type": "json_object"} |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de taxa | 300 requisições por minuto por chave |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Tamanho | até 8 MB por requisição |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Validade | crédito pago não expira, sem assinatura |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Login | Google ou e-mail e senha |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Esta é a API oficial da Anthropic?
Não, este é um serviço proxy independente. Hospedamos nosso próprio modelo de linguagem grande sem censura, compatível com o formato de conclusões de chat da OpenAI. Não é GPT, Claude ou qualquer outro modelo de fornecedor.
O que acontece se eu ficar sem créditos?
As requisições retornarão um erro <code>402</code>. Você pode recarregar sua conta a qualquer momento a partir de $10 usando criptomoedas (USDT ou USDC). Seus créditos não utilizados nunca expiram, então você pode adicionar fundos quando for conveniente.
O modelo recusa conteúdo?
O modelo é ajustado para responder sem recusas para tópicos adultos lícitos, fictícios ou controversos. A única restrição rígida é que o conteúdo sexual envolvendo menores é sempre bloqueado.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.