Guide de démarrage pour les utilisateurs de Claude
Commencez avec notre API LLM sans censure en quelques minutes à l'aide de clients compatibles OpenAI. Ce guide couvre l'authentification, les modèles d'intégration et les limites de débit pour la génération de texte brut.
Authentification et URL de base
Notre API respecte la norme de compatibilité OpenAI, ce qui signifie que vous disposez probablement déjà des bibliothèques clientes nécessaires pour vous connecter. Toutes les requêtes nécessitent une clé API valide transmise dans l'en-tête Authorization. L'URL de base pour tous les endpoints est https://api.claudeapicost.com/v1. Vous pouvez générer votre clé sur la page « Obtenir la clé API » en utilisant simplement une adresse e-mail et un mot de passe. Aucune carte bancaire n'est requise pour commencer, et vous recevez 0,50 $ de crédit d'essai valable 7 jours. Gardez votre clé en sécurité, car elle peut être régénérée à tout moment pour révoquer l'accès.
Première requête
Envoyez une requête standard de complétion de chat pour commencer à générer du texte. L'ID du modèle est toujours uncensored. Cet endpoint prend en charge les réponses en streaming et hors streaming. Voici un exemple de base utilisant cURL pour envoyer un prompt simple et recevoir une réponse textuelle.
Utilisez cette structure pour vérifier la connectivité avant de l'intégrer à votre application. La réponse inclut le texte généré dans le tableau choices.
- Endpoint :
POST /v1/chat/completions - Modèle :
uncensored - Réponse : Objet JSON avec le contenu textuel
curl https://api.claudeapicost.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Intégration SDK Python
Pour les développeurs Python, le package officiel openai fonctionne directement avec notre service en remplaçant l'URL de base. Cette approche vous permet d'utiliser les méthodes SDK familières comme client.chat.completions.create(). Assurez-vous de définir le paramètre base_url sur notre endpoint et de fournir votre clé API. Cette méthode est idéale pour les services backend ou les scripts où vous avez besoin d'une sortie textuelle structurée sans gérer les requêtes HTTP brutes.
from openai import OpenAI
client = OpenAI(base_url="https://api.claudeapicost.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Intégration SDK Node.js
Les développeurs Node.js peuvent obtenir la même compatibilité en ajustant le baseUrl dans la configuration du SDK OpenAI. Cela vous permet d'intégrer notre modèle sans censure dans des applications Node existantes avec des modifications de code minimales. Le SDK gère la tokenisation et le formatage des requêtes, vous permettant de vous concentrer sur l'ingénierie des prompts. N'oubliez pas de passer l'ID du modèle uncensored dans vos requêtes de complétion.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.claudeapicost.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Réponses en streaming via SSE
Pour les applications nécessitant une génération de texte en temps réel, nous supportons les Server-Sent Events (SSE). Le streaming réduit la latence perçue en délivrant les tokens au fur et à mesure de leur génération. Définissez le paramètre stream sur true dans votre requête. Le client recevra une série d'événements de données contenant du contenu partiel. Cela est particulièrement utile pour les interfaces de chat ou les flux de données en direct où un retour immédiat est critique pour l'expérience utilisateur.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites de débit et contraintes
Notre service applique des limites strictes pour garantir la stabilité. Vous avez droit à 300 requêtes par minute par clé API. La taille maximale du corps de la requête est de 8 Mo. Si votre clé est invalide ou expirée, vous recevrez une erreur 401. Si votre crédit prépayé est épuisé, vous verrez une erreur 402 nécessitant une recharge. Un statut 429 indique que vous avez dépassé la limite de débit. La fenêtre de contexte prend en charge 100 000 tokens pour le prompt et la complétion combinés. Les crédits sont prépayés et n'expirent jamais, avec des bonus disponibles pour les recharges plus importantes.
Questions et réponses
S'agit-il de la même API que celle de Claude ?
Non. Nous proposons notre propre modèle à poids ouverts sans censure, et non le modèle officiel Claude d'Anthropic. Toutefois, notre API est compatible OpenAI et fonctionne avec les clients standards prenant en charge l'endpoint chat-completions.
Utilisez-vous mes prompts pour l'entraînement ?
Non. Nous n'utilisons pas vos données de prompt pour entraîner notre modèle. Votre confidentialité est préservée et vos données ne servent pas à améliorer le modèle de base, sauf si vous optez explicitement pour des fonctionnalités spécifiques.
Que se passe-t-il si je dépasse la limite de débit ?
Vous recevrez une erreur 429 Too Many Requests. La réponse indiquera que la limite a été atteinte. Vous pouvez attendre la réinitialisation de la fenêtre ou passer à un niveau de crédit supérieur si disponible. La régénération de votre clé ne réinitialise pas le compteur de limite de débit pour la même adresse IP ou le même contexte de compte.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.
Caractéristiques techniques
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Base URL | https://api.claudeapicost.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Mode JSON | response_format: {"type": "json_object"} |
| Concurrence | 8 requêtes simultanées par clé |
| Limite de débit | 300 requêtes par minute et par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Taille | jusqu'à 8 Mo par requête |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Connexion | Google ou e-mail et mot de passe |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |