PT ▾
custo da API Claude.com

API LLM sem censura por preços transparentes

https://api.claudeapicost.com/v1

claudeapicost.comObter chave de API

Início rápido para usuários do Claude

Comece com nossa API LLM sem censura em minutos usando clientes padrão compatíveis com OpenAI. Este guia cobre autenticação, padrões de integração e limites de requisições para geração de texto bruto.

URL basehttps://api.claudeapicost.com/v1
Modelouncensored

Autenticação e URL base

Nossa API segue o padrão de compatibilidade com OpenAI, o que significa que você provavelmente já possui as bibliotecas de cliente necessárias para a conexão. Todas as requisições exigem uma chave de API válida passada no cabeçalho Authorization. A URL base para todos os endpoints é https://api.claudeapicost.com/v1. Você pode gerar sua chave na página "Obter chave de API" usando apenas um e-mail e senha. Não é necessário cartão de crédito para começar, e você recebe $0,50 em crédito de teste válido por 7 dias. Mantenha sua chave segura, pois ela pode ser regenerada a qualquer momento para revogar o acesso.

Primeira requisição

Envie uma requisição padrão de conclusão de chat para começar a gerar texto. O ID do modelo é sempre uncensored. Este endpoint suporta respostas em streaming e não-streaming. Abaixo está um exemplo básico usando cURL para enviar um prompt simples e receber uma resposta de texto.

Use esta estrutura para verificar a conectividade antes de integrar ao seu aplicativo. A resposta inclui o texto gerado no array choices.

  • Endpoint: POST /v1/chat/completions
  • Modelo: uncensored
  • Resposta: Objeto JSON com conteúdo de texto
curl https://api.claudeapicost.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Integração com SDK Python

Para desenvolvedores Python, o pacote oficial openai funciona diretamente com nosso serviço ao substituir a URL base. Essa abordagem permite que você use métodos de SDK familiares como client.chat.completions.create(). Certifique-se de definir o parâmetro base_url para nosso endpoint e fornecer sua chave de API. Este método é ideal para serviços de backend ou scripts onde você precisa de saída de texto estruturada sem gerenciar requisições HTTP brutas.

from openai import OpenAI

client = OpenAI(base_url="https://api.claudeapicost.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integração com SDK Node.js

Desenvolvedores Node.js podem alcançar a mesma compatibilidade ajustando o baseUrl na configuração do SDK OpenAI. Isso permite integrar nosso modelo sem censura em aplicativos Node.js existentes com mínimas alterações de código. O SDK cuida da tokenização e formatação de requisições, permitindo que você se concentre na engenharia de prompts. Lembre-se de passar o ID do modelo uncensored em suas requisições de conclusão.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.claudeapicost.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Respostas em streaming via SSE

Para aplicativos que exigem geração de texto em tempo real, oferecemos suporte a Server-Sent Events (SSE). O streaming reduz a latência percebida entregando tokens conforme são gerados. Defina o parâmetro stream como true em sua requisição. O cliente receberá uma série de eventos de dados contendo conteúdo parcial. Isso é particularmente útil para interfaces de chat ou feeds de dados ao vivo onde o feedback imediato é crítico para a experiência do usuário.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limites de requisições e restrições

Nosso serviço impõe limites rigorosos para garantir estabilidade. Você tem direito a 300 requisições por minuto por chave de API. O tamanho máximo do corpo da requisição é 8 MB. Se sua chave for inválida ou expirada, você receberá um erro 401. Se seu crédito pré-pago for esgotado, você verá um erro 402 exigindo uma recarga. Um status 429 indica que você excedeu o limite de requisições. A janela de contexto suporta 100.000 tokens para prompt e conclusão combinados. Os créditos são pré-pagos e nunca expiram, com bônus disponíveis para recargas maiores.

Perguntas e respostas

É igual à API oficial do Claude?

Não. Oferecemos nosso próprio modelo de pesos abertos sem censura, não o modelo oficial do Claude da Anthropic. No entanto, nossa API é compatível com OpenAI, funcionando com clientes padrão que suportam o endpoint de chat-completions.

Vocês usam meus prompts para treinamento?

Não. Não usamos seus dados de prompt para treinar nosso modelo. Sua privacidade é preservada e seus dados não são usados para melhorar o modelo base, a menos que você opte explicitamente por recursos específicos.

O que acontece se eu exceder o limite de requisições?

Você receberá um erro 429 Demasiadas Requisições. A resposta indicará que o limite foi atingido. Você pode aguardar a reinicialização da janela ou atualizar seu nível de crédito, se disponível. Regenerar sua chave não redefine o contador do limite de requisições para o mesmo IP ou contexto de conta.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API

Especificações técnicas

Uma tabela com cada limite, recurso e preço.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
AutenticaçãoAuthorization: Bearer YOUR_KEY
ID do modelouncensored
Base URLhttps://api.claudeapicost.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Janela de contexto100.000 tokens (entrada + saída)
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Modo JSONresponse_format: {"type": "json_object"}
Concorrência8 requisições ao mesmo tempo por chave
Limite de taxa300 requisições por minuto por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamanhoaté 8 MB por requisição
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Bônus+5% a partir de $50, +10% a partir de $100
Validadecrédito pago não expira, sem assinatura
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
Chavesuma chave ativa por conta; uma nova substitui a anterior
LoginGoogle ou e-mail e senha

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos