ES ▾
costo de la API de Claude.com

API de LLM sin censura a precios transparentes

https://api.claudeapicost.com/v1

claudeapicost.comObtener clave de API

Inicio rápido para usuarios de Claude

Comienza con nuestra API de LLM sin censura en minutos usando clientes compatibles con OpenAI. Esta guía cubre autenticación, patrones de integración y límites de peticiones para generación de texto sin procesar.

URL basehttps://api.claudeapicost.com/v1
Modelouncensored

Autenticación y URL base

Nuestra API sigue el estándar de compatibilidad con OpenAI, lo que significa que probablemente ya tengas las bibliotecas cliente necesarias para conectarte. Todas las peticiones requieren una clave de API válida pasada en el encabezado Authorization. La URL base para todos los endpoints es https://api.claudeapicost.com/v1. Puedes generar tu clave en la página "Obtener clave de API" usando solo un correo electrónico y una contraseña. No se requiere tarjeta de crédito para comenzar y recibes $0.50 en crédito de prueba válido por 7 días. Mantén tu clave segura, ya que se puede regenerar en cualquier momento para revocar el acceso.

Primera petición

Envía una petición estándar de finalización de chat para comenzar a generar texto. El ID del modelo es siempre uncensored. Este endpoint admite respuestas tanto en streaming como sin streaming. A continuación hay un ejemplo básico usando cURL para enviar un prompt simple y recibir una respuesta de texto.

Usa esta estructura para verificar la conectividad antes de integrarla en tu aplicación. La respuesta incluye el texto generado en la matriz choices.

  • Endpoint: POST /v1/chat/completions
  • Modelo: uncensored
  • Respuesta: Objeto JSON con contenido de texto
curl https://api.claudeapicost.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Integración con SDK de Python

Para desarrolladores de Python, el paquete oficial openai funciona directamente con nuestro servicio al sobrescribir la URL base. Este enfoque te permite usar métodos de SDK familiares como client.chat.completions.create(). Asegúrate de configurar el parámetro base_url a nuestro endpoint y proporciona tu clave de API. Este método es ideal para servicios backend o scripts donde necesitas salida de texto estructurada sin gestionar peticiones HTTP sin procesar.

from openai import OpenAI

client = OpenAI(base_url="https://api.claudeapicost.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integración con SDK de Node.js

Los desarrolladores de Node.js pueden lograr la misma compatibilidad ajustando el baseUrl en la configuración del SDK de OpenAI. Esto te permite integrar nuestro modelo sin censura en aplicaciones Node.js existentes con cambios mínimos de código. El SDK maneja la tokenización y el formato de peticiones, así que puedes centrarte en la ingeniería de prompts. Recuerda pasar el ID del modelo uncensored en tus peticiones de finalización.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.claudeapicost.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Respuestas en streaming vía SSE

Para aplicaciones que requieren generación de texto en tiempo real, admitimos Server-Sent Events (SSE). El streaming reduce la latencia percibida entregando tokens a medida que se generan. Configura el parámetro stream a true en tu petición. El cliente recibirá una serie de eventos de datos que contienen contenido parcial. Esto es particularmente útil para interfaces de chat o flujos de datos en vivo donde la retroalimentación inmediata es crítica para la experiencia del usuario.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Límites de peticiones y restricciones

Nuestro servicio aplica límites estrictos para garantizar la estabilidad. Tienes permitido 300 peticiones por minuto por clave de API. El tamaño máximo del cuerpo de la petición es 8 MB. Si tu clave no es válida o está expirada, recibirás un error 401. Si tu crédito prepago se agota, verás un error 402 que requiere una recarga. Un estado 429 indica que has excedido el límite de peticiones. La ventana de contexto admite 100.000 tokens para el prompt y la finalización combinados. Los créditos son prepago y no caducan, con bonos disponibles para recargas más grandes.

Preguntas y respuestas

¿Es lo mismo que la API oficial de Claude?

No. Ofrecemos nuestro propio modelo de pesos abiertos sin censura, no el modelo oficial de Claude de Anthropic. Sin embargo, nuestra API es compatible con OpenAI, por lo que funciona con clientes estándar que admiten el endpoint de chat-completions.

¿Usan mis prompts para el entrenamiento?

No. No utilizamos tus datos de prompt para entrenar nuestro modelo. Tu privacidad está preservada y tus datos no se usan para mejorar el modelo base a menos que optes explícitamente por características específicas.

¿Qué sucede si excedes el límite de peticiones?

Recibirás un error 429 Too Many Requests. La respuesta indicará que se alcanzó el límite. Puedes esperar a que se reinicie la ventana o actualizar tu nivel de crédito si está disponible. Regenerar tu clave no reinicia el contador del límite de peticiones para la misma IP o contexto de cuenta.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API

Especificaciones técnicas

Una tabla con cada límite, función y precio.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
AutenticaciónAuthorization: Bearer YOUR_KEY
ID del modelouncensored
Base URLhttps://api.claudeapicost.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Ventana de contexto100.000 tokens (entrada + salida)
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Modo JSONresponse_format: {"type": "json_object"}
Concurrencia8 peticiones a la vez por clave
Límite de peticiones300 por minuto por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamaño de peticiónhasta 8 MB
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Bono+5 % desde $50, +10 % desde $100
Caducidadel crédito pagado no caduca, sin suscripción
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
AccesoGoogle o correo y contraseña

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos