Snelstart voor Claude-gebruikers
Kom in actie met onze ongecensureerde LLM API in enkele minuten met standaard OpenAI-compatible clients. Deze gids behandelt authenticatie, integratiepatronen en rate limits voor ruwe tekstgeneratie.
Authenticatie & Base URL
Onze API volgt de OpenAI-compatibiliteitsstandaard, wat betekent dat je waarschijnlijk al de client libraries hebt die nodig zijn om verbinding te maken. Alle verzoeken vereisen een geldige API-sleutel die wordt doorgegeven in de Authorization header. De base URL voor alle endpoints is https://api.claudeapicost.com/v1. Je kunt je sleutel genereren op de pagina "API-sleutel ophalen" met alleen een e-mailadres en wachtwoord. Er is geen creditcard nodig om te beginnen en je ontvangt $0,50 aan trial credit die 7 dagen geldig is. Houd je sleutel veilig, omdat deze op elk moment kan worden geregenereerd om toegang te beëindigen.
Eerste verzoek
Stuur een standaard chat-completion verzoek om tekstgeneratie te starten. De model-ID is altijd uncensored. Dit endpoint ondersteunt zowel streaming als niet-streaming responsen. Hieronder volgt een basisvoorbeeld met cURL om een eenvoudige prompt te versturen en een tekstrespons te ontvangen.
Gebruik deze structuur om de connectiviteit te verifiëren voordat je integreert in je applicatie. De respons bevat de gegenereerde tekst in de choices array.
- Endpoint:
POST /v1/chat/completions - Model:
uncensored - Respons: JSON-object met tekstinhoud
curl https://api.claudeapicost.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK-integratie
Voor Python-ontwikkelaars werkt het officiële openai pakket direct met onze service door de base URL te overschrijven. Deze aanpak stelt je in staat bekende SDK-methoden zoals client.chat.completions.create() te gebruiken. Zorg dat je de base_url parameter instelt op ons endpoint en je API-sleutel verstrekt. Deze methode is ideaal voor backenddiensten of scripts waar je gestructureerde tekstuitvoer nodig hebt zonder ruwe HTTP-verzoeken te beheren.
from openai import OpenAI
client = OpenAI(base_url="https://api.claudeapicost.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js SDK-integratie
Node.js-ontwikkelaars kunnen dezelfde compatibiliteit bereiken door de baseUrl in de OpenAI SDK-configuratie aan te passen. Hiermee kun je ons ongecensureerde model in bestaande Node-applicaties integreren met minimale codeaanpassingen. De SDK handelt tokenisatie en verzoekopmaak af, zodat je je kunt concentreren op prompt engineering. Vergeet niet de model-ID uncensored mee te sturen in je completion-verzoeken.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.claudeapicost.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming responsen via SSE
Voor applicaties die realtime tekstgeneratie vereisen, ondersteunen we Server-Sent Events (SSE). Streaming vermindert de waargenomen latentie door tokens te leveren zodra ze worden gegenereerd. Stel de stream parameter in op true in je verzoek. De client ontvangt een reeks data-events met gedeeltelijke inhoud. Dit is vooral nuttig voor chatinterfaces of live datafeeds waar directe feedback cruciaal is voor de gebruikerservaring.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Rate limits & beperkingen
Onze service handhaaft strikte limieten om stabiliteit te garanderen. Je mag 300 verzoeken per minuut per API-sleutel uitvoeren. De maximale verzoekgrootte is 8 MB. Als je sleutel ongeldig of verlopen is, ontvang je een 401-fout. Als je prepaid tegoed opgebruikt is, zie je een 402-fout die een top-up vereist. Een 429-status geeft aan dat je de rate limit hebt overschreden. Het contextvenster ondersteunt 100.000 tokens voor zowel prompt als completion samen. Credits zijn prepaid en vervallen nooit, met bonussen beschikbaar voor grotere top-ups.
Vragen en antwoorden
Is dit hetzelfde als de officiële Claude API?
Nee. Wij serveren ons eigen open-weight ongecensureerde model, niet het officiële Claude model van Anthropic. Onze API is echter OpenAI-compatible, dus deze werkt met standaard clients die het chat-completions endpoint ondersteunen.
Gebruik je mijn prompts voor training?
Nee. We gebruiken je promptgegevens niet om ons model te trainen. Je privacy blijft behouden en je gegevens worden niet gebruikt om het basismodel te verbeteren, tenzij je expliciet instelt voor bepaalde functies.
Wat gebeurt er als ik de rate limit overschrijd?
Je ontvangt een 429 Too Many Requests fout. De respons geeft aan dat de limiet is bereikt. Je kunt wachten tot het venster reset of je credit tier upgraden als dat beschikbaar is. Je sleutel regenereren reset de rate limit teller niet voor hetzelfde IP-account of account context.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Model-ID | uncensored |
| Base URL | https://api.claudeapicost.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| JSON-modus | response_format: {"type": "json_object"} |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Verzoekgrootte | tot 8 MB |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inloggen | Google of e-mail en wachtwoord |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |