FR ▾
cout API Claude.com

API LLM sans censure à des prix transparents

https://api.claudeapicost.com/v1

claudeapicost.comObtenir une clé API

Guide de démarrage pour les utilisateurs de Claude

Commencez avec notre API LLM sans censure en quelques minutes à l'aide de clients compatibles OpenAI. Ce guide couvre l'authentification, les modèles d'intégration et les limites de débit pour la génération de texte brut.

URL de basehttps://api.claudeapicost.com/v1
Modèleuncensored

Authentification et URL de base

Notre API respecte la norme de compatibilité OpenAI, ce qui signifie que vous disposez probablement déjà des bibliothèques clientes nécessaires pour vous connecter. Toutes les requêtes nécessitent une clé API valide transmise dans l'en-tête Authorization. L'URL de base pour tous les endpoints est https://api.claudeapicost.com/v1. Vous pouvez générer votre clé sur la page « Obtenir la clé API » en utilisant simplement une adresse e-mail et un mot de passe. Aucune carte bancaire n'est requise pour commencer, et vous recevez 0,50 $ de crédit d'essai valable 7 jours. Gardez votre clé en sécurité, car elle peut être régénérée à tout moment pour révoquer l'accès.

Première requête

Envoyez une requête standard de complétion de chat pour commencer à générer du texte. L'ID du modèle est toujours uncensored. Cet endpoint prend en charge les réponses en streaming et hors streaming. Voici un exemple de base utilisant cURL pour envoyer un prompt simple et recevoir une réponse textuelle.

Utilisez cette structure pour vérifier la connectivité avant de l'intégrer à votre application. La réponse inclut le texte généré dans le tableau choices.

  • Endpoint : POST /v1/chat/completions
  • Modèle : uncensored
  • Réponse : Objet JSON avec le contenu textuel
curl https://api.claudeapicost.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Intégration SDK Python

Pour les développeurs Python, le package officiel openai fonctionne directement avec notre service en remplaçant l'URL de base. Cette approche vous permet d'utiliser les méthodes SDK familières comme client.chat.completions.create(). Assurez-vous de définir le paramètre base_url sur notre endpoint et de fournir votre clé API. Cette méthode est idéale pour les services backend ou les scripts où vous avez besoin d'une sortie textuelle structurée sans gérer les requêtes HTTP brutes.

from openai import OpenAI

client = OpenAI(base_url="https://api.claudeapicost.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Intégration SDK Node.js

Les développeurs Node.js peuvent obtenir la même compatibilité en ajustant le baseUrl dans la configuration du SDK OpenAI. Cela vous permet d'intégrer notre modèle sans censure dans des applications Node existantes avec des modifications de code minimales. Le SDK gère la tokenisation et le formatage des requêtes, vous permettant de vous concentrer sur l'ingénierie des prompts. N'oubliez pas de passer l'ID du modèle uncensored dans vos requêtes de complétion.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.claudeapicost.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Réponses en streaming via SSE

Pour les applications nécessitant une génération de texte en temps réel, nous supportons les Server-Sent Events (SSE). Le streaming réduit la latence perçue en délivrant les tokens au fur et à mesure de leur génération. Définissez le paramètre stream sur true dans votre requête. Le client recevra une série d'événements de données contenant du contenu partiel. Cela est particulièrement utile pour les interfaces de chat ou les flux de données en direct où un retour immédiat est critique pour l'expérience utilisateur.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limites de débit et contraintes

Notre service applique des limites strictes pour garantir la stabilité. Vous avez droit à 300 requêtes par minute par clé API. La taille maximale du corps de la requête est de 8 Mo. Si votre clé est invalide ou expirée, vous recevrez une erreur 401. Si votre crédit prépayé est épuisé, vous verrez une erreur 402 nécessitant une recharge. Un statut 429 indique que vous avez dépassé la limite de débit. La fenêtre de contexte prend en charge 100 000 tokens pour le prompt et la complétion combinés. Les crédits sont prépayés et n'expirent jamais, avec des bonus disponibles pour les recharges plus importantes.

Questions et réponses

S'agit-il de la même API que celle de Claude ?

Non. Nous proposons notre propre modèle à poids ouverts sans censure, et non le modèle officiel Claude d'Anthropic. Toutefois, notre API est compatible OpenAI et fonctionne avec les clients standards prenant en charge l'endpoint chat-completions.

Utilisez-vous mes prompts pour l'entraînement ?

Non. Nous n'utilisons pas vos données de prompt pour entraîner notre modèle. Votre confidentialité est préservée et vos données ne servent pas à améliorer le modèle de base, sauf si vous optez explicitement pour des fonctionnalités spécifiques.

Que se passe-t-il si je dépasse la limite de débit ?

Vous recevrez une erreur 429 Too Many Requests. La réponse indiquera que la limite a été atteinte. Vous pouvez attendre la réinitialisation de la fenêtre ou passer à un niveau de crédit supérieur si disponible. La régénération de votre clé ne réinitialise pas le compteur de limite de débit pour la même adresse IP ou le même contexte de compte.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API

Caractéristiques techniques

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
AuthentificationAuthorization: Bearer YOUR_KEY
ID du modèleuncensored
Base URLhttps://api.claudeapicost.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Fenêtre de contexte100 000 tokens (entrée + sortie)
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Mode JSONresponse_format: {"type": "json_object"}
Concurrence8 requêtes simultanées par clé
Limite de débit300 requêtes par minute et par clé
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Taillejusqu'à 8 Mo par requête
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Bonus+5 % dès 50 $, +10 % dès 100 $
Validitéle crédit payé n'expire jamais, sans abonnement
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé
Clésune clé active par compte ; une nouvelle remplace l'ancienne
ConnexionGoogle ou e-mail et mot de passe

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes