InicioDocumentación
Inicio rápido para usuarios de Claude Code
Conecta Claude Code o cualquier agente compatible con OpenAI a nuestro proxy en menos de dos minutos. Esta guía aborda la URL base, la autenticación y los endpoints exactos que necesitas para tareas de programación.
Autenticación
Toda petición a nuestro proxy requiere una clave de API válida. Recibes esta clave inmediatamente después de iniciar sesión en la página Obtener clave de API. Inclúyela en el encabezado Authorization como un token Bearer. Si falta la clave o no es válida, la API devuelve un error 401. Puedes regenerar tu clave en cualquier momento desde tu panel, lo que revoca instantáneamente la anterior. Esto asegura que las claves perdidas o comprometidas no permitan el acceso continuo a tus créditos prepago.
Endpoint de Chat Completions
Envía tus prompts de programación al endpoint de completado de chat estándar. La URL base para todas las peticiones es https://api.claudecodeapikey.com/v1. Usa el ID de modelo uncensored para acceder a nuestro modelo de lenguaje grande. Este modelo está ajustado para responder sin rechazos de contenido para uso adulto lícito, lo que lo hace ideal para generar código sin bloqueos innecesarios. El endpoint admite respuestas tanto estándar como en streaming. A continuación se muestra un ejemplo de una petición básica usando curl.
curl https://api.claudecodeapikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
El cuerpo de la petición debe ser inferior a 8 MB. Si superas este límite, el servidor rechazará la carga útil. El modelo admite una ventana de contexto de 100.000 tokens, combinando tokens de entrada y salida. Esto permite fragmentos de código extensos e historiales de conversación largos sin truncamiento inmediato.
SDK de Python
Para desarrolladores que usan Python, puedes integrar nuestra API usando el SDK oficial de OpenAI. Simplemente apunta el cliente a nuestra URL base y proporciona tu clave de API. El ID de modelo uncensored funciona exactamente igual que otros modelos compatibles con OpenAI en el SDK. Puedes llamar al método de completado de texto y manejar la respuesta como un objeto de texto estándar. Este enfoque es ideal para procesamiento por lotes o para integrar en scripts de automatización más grandes.
from openai import OpenAI
client = OpenAI(base_url="https://api.claudecodeapikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Recuerda que el SDK maneja la serialización JSON por ti. Solo necesitas asegurarte de que tu variable base_url apunte a nuestro proxy. El objeto de respuesta contiene el texto generado, que luego puedes escribir en tus archivos o reintroducir en el contexto de la conversación.
SDK de Node.js
Los desarrolladores de Node.js pueden usar el paquete npm de OpenAI para interactuar con nuestro proxy. Configura el cliente con la URL base personalizada y tu clave de API. El patrón de uso refleja la implementación de Python: crea un cliente, llama al endpoint de chat completions y procesa el resultado. Esto es útil para la generación de código en el lado del servidor o para asistentes de codificación en tiempo real.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.claudecodeapikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
El SDK de Node.js gestiona las conexiones HTTP de manera eficiente. Asegúrate de estar usando una versión del SDK que admita URL base personalizadas. La estructura de la respuesta sigue siendo consistente con el estándar de OpenAI, lo que facilita cambiar entre diferentes proveedores compatibles con OpenAI si es necesario.
Respuestas en streaming
Para asistencia de codificación en tiempo real, habilita el streaming estableciendo stream: true en tu petición. La API devuelve un flujo de Server-Sent Events (SSE). Cada fragmento contiene una respuesta parcial, lo que te permite mostrar el código a medida que se genera. Esto mejora significativamente la experiencia del usuario en agentes de codificación interactivos.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Maneja los eventos del flujo en tu código para acumular la respuesta final. El streaming no consume más tokens que una petición sin streaming; solo cambia cómo se entregan los datos. Esto es particularmente útil para bloques de código largos donde quieres mostrar el progreso inmediatamente.
Límites de velocidad y cuotas
Nuestra API impone un límite de 300 peticiones por minuto por clave de API. Si excedes este límite, recibirás un error 429. Deberías implementar lógica de reintento con retroceso exponencial en tus aplicaciones. Además, cada cuenta está limitada a una clave de API, que puede regenerarse si es necesario. El error 402 indica que tu crédito prepago se ha agotado. Puedes recargar desde $10 usando cripto (USDT o USDC). Los créditos no caducan, así que puedes pausar y reanudar el uso a tu propio ritmo sin perder tu saldo.
Especificaciones técnicas
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticación | Authorization: Bearer YOUR_KEY |
| ID del modelo | uncensored |
| Base URL | https://api.claudecodeapikey.com/v1 |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Modo JSON | response_format: {"type": "json_object"} |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Límite de peticiones | 300 por minuto por clave |
| Concurrencia | 8 peticiones a la vez por clave |
| Tamaño de petición | hasta 8 MB |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Bono | +5 % desde $50, +10 % desde $100 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Acceso | Google o correo y contraseña |
Errores y qué hacer
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Es esta la API oficial de Anthropic?
No, este es un servicio de proxy independiente. Alojamos nuestro propio modelo de lenguaje grande sin censura compatible con el formato de chat completions de OpenAI. No es GPT, Claude ni ningún otro modelo de proveedor.
¿Qué pasa si me quedo sin créditos?
Las peticiones devolverán un error <code>402</code>. Puedes recargar tu cuenta en cualquier momento desde $10 usando cripto (USDT o USDC). Tus créditos no utilizados no caducan, así que puedes añadir fondos cuando te convenga.
¿El modelo rechaza contenido?
El modelo está ajustado para responder sin rechazos para temas adultos lícitos, ficticios o controvertidos. La única limitación estricta es que el contenido sexual que involucra a menores siempre está bloqueado.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.