NL ▾
claudeapicost.com

Ongecensureerde LLM API tegen transparante prijzen

https://api.claudeapicost.com/v1

claudeapicost.comAPI-sleutel aanvragen

Snelstart voor Claude-gebruikers

Kom in actie met onze ongecensureerde LLM API in enkele minuten met standaard OpenAI-compatible clients. Deze gids behandelt authenticatie, integratiepatronen en rate limits voor ruwe tekstgeneratie.

Base URLhttps://api.claudeapicost.com/v1
Modeluncensored

Authenticatie & Base URL

Onze API volgt de OpenAI-compatibiliteitsstandaard, wat betekent dat je waarschijnlijk al de client libraries hebt die nodig zijn om verbinding te maken. Alle verzoeken vereisen een geldige API-sleutel die wordt doorgegeven in de Authorization header. De base URL voor alle endpoints is https://api.claudeapicost.com/v1. Je kunt je sleutel genereren op de pagina "API-sleutel ophalen" met alleen een e-mailadres en wachtwoord. Er is geen creditcard nodig om te beginnen en je ontvangt $0,50 aan trial credit die 7 dagen geldig is. Houd je sleutel veilig, omdat deze op elk moment kan worden geregenereerd om toegang te beëindigen.

Eerste verzoek

Stuur een standaard chat-completion verzoek om tekstgeneratie te starten. De model-ID is altijd uncensored. Dit endpoint ondersteunt zowel streaming als niet-streaming responsen. Hieronder volgt een basisvoorbeeld met cURL om een eenvoudige prompt te versturen en een tekstrespons te ontvangen.

Gebruik deze structuur om de connectiviteit te verifiëren voordat je integreert in je applicatie. De respons bevat de gegenereerde tekst in de choices array.

  • Endpoint: POST /v1/chat/completions
  • Model: uncensored
  • Respons: JSON-object met tekstinhoud
curl https://api.claudeapicost.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK-integratie

Voor Python-ontwikkelaars werkt het officiële openai pakket direct met onze service door de base URL te overschrijven. Deze aanpak stelt je in staat bekende SDK-methoden zoals client.chat.completions.create() te gebruiken. Zorg dat je de base_url parameter instelt op ons endpoint en je API-sleutel verstrekt. Deze methode is ideaal voor backenddiensten of scripts waar je gestructureerde tekstuitvoer nodig hebt zonder ruwe HTTP-verzoeken te beheren.

from openai import OpenAI

client = OpenAI(base_url="https://api.claudeapicost.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js SDK-integratie

Node.js-ontwikkelaars kunnen dezelfde compatibiliteit bereiken door de baseUrl in de OpenAI SDK-configuratie aan te passen. Hiermee kun je ons ongecensureerde model in bestaande Node-applicaties integreren met minimale codeaanpassingen. De SDK handelt tokenisatie en verzoekopmaak af, zodat je je kunt concentreren op prompt engineering. Vergeet niet de model-ID uncensored mee te sturen in je completion-verzoeken.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.claudeapicost.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming responsen via SSE

Voor applicaties die realtime tekstgeneratie vereisen, ondersteunen we Server-Sent Events (SSE). Streaming vermindert de waargenomen latentie door tokens te leveren zodra ze worden gegenereerd. Stel de stream parameter in op true in je verzoek. De client ontvangt een reeks data-events met gedeeltelijke inhoud. Dit is vooral nuttig voor chatinterfaces of live datafeeds waar directe feedback cruciaal is voor de gebruikerservaring.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Rate limits & beperkingen

Onze service handhaaft strikte limieten om stabiliteit te garanderen. Je mag 300 verzoeken per minuut per API-sleutel uitvoeren. De maximale verzoekgrootte is 8 MB. Als je sleutel ongeldig of verlopen is, ontvang je een 401-fout. Als je prepaid tegoed opgebruikt is, zie je een 402-fout die een top-up vereist. Een 429-status geeft aan dat je de rate limit hebt overschreden. Het contextvenster ondersteunt 100.000 tokens voor zowel prompt als completion samen. Credits zijn prepaid en vervallen nooit, met bonussen beschikbaar voor grotere top-ups.

Vragen en antwoorden

Is dit hetzelfde als de officiële Claude API?

Nee. Wij serveren ons eigen open-weight ongecensureerde model, niet het officiële Claude model van Anthropic. Onze API is echter OpenAI-compatible, dus deze werkt met standaard clients die het chat-completions endpoint ondersteunen.

Gebruik je mijn prompts voor training?

Nee. We gebruiken je promptgegevens niet om ons model te trainen. Je privacy blijft behouden en je gegevens worden niet gebruikt om het basismodel te verbeteren, tenzij je expliciet instelt voor bepaalde functies.

Wat gebeurt er als ik de rate limit overschrijd?

Je ontvangt een 429 Too Many Requests fout. De respons geeft aan dat de limiet is bereikt. Je kunt wachten tot het venster reset of je credit tier upgraden als dat beschikbaar is. Je sleutel regenereren reset de rate limit teller niet voor hetzelfde IP-account of account context.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.

API-sleutel aanvragen

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
AuthenticatieAuthorization: Bearer YOUR_KEY
Model-IDuncensored
Base URLhttps://api.claudeapicost.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Contextvenster100.000 tokens (invoer + uitvoer)
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
JSON-modusresponse_format: {"type": "json_object"}
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Rate limit300 verzoeken per minuut per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Verzoekgroottetot 8 MB
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Bonus+5% vanaf $50, +10% vanaf $100
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw