Schnellstart für Claude-Nutzer
Starte in wenigen Minuten mit unserer unzensierten LLM-API unter Verwendung standardisierter OpenAI-kompatibler Clients. Dieser Leitfaden behandelt Authentifizierung, Integrationsmuster und Ratenlimits für die Rohtextgenerierung.
Authentifizierung & Base URL
Unsere API folgt dem OpenAI-Kompatibilitätsstandard, was bedeutet, dass du wahrscheinlich bereits die benötigten Client-Bibliotheken zur Verbindung hast. Für alle Anfragen muss ein gültiger API-Schlüssel im Authorization-Header übergeben werden. Die Basis-URL für alle Endpunkte lautet https://api.claudeapicost.com/v1. Du kannst deinen Schlüssel auf der Seite „API-Schlüssel erhalten“ generieren, indem du nur eine E-Mail-Adresse und ein Passwort angibst. Es ist keine Kreditkarte erforderlich, um zu starten, und du erhältst 0,50 $ an Testguthaben, die 7 Tage lang gültig sind. Bewahre deinen Schlüssel sicher auf, da er jederzeit regeneriert werden kann, um den Zugriff zu widerrufen.
Erste Anfrage
Sende eine Standard-Chat-Vervollständigungsanfrage, um mit der Textgenerierung zu beginnen. Die Modell-ID ist immer uncensored. Dieser Endpunkt unterstützt sowohl Streaming- als auch Nicht-Streaming-Antworten. Unten findest du ein einfaches Beispiel mit cURL, um einen einfachen Prompt zu senden und eine Textantwort zu erhalten.
Verwende diese Struktur, um die Konnektivität zu überprüfen, bevor du sie in deine Anwendung integrierst. Die Antwort enthält den generierten Text im choices-Array.
- Endpunkt:
POST /v1/chat/completions - Modell:
uncensored - Antwort: JSON-Objekt mit Textinhalt
curl https://api.claudeapicost.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK Integration
Für Python-Entwickler funktioniert das offizielle openai-Paket direkt mit unserem Dienst, indem die Base URL überschrieben wird. Dieser Ansatz ermöglicht es dir, vertraute SDK-Methoden wie client.chat.completions.create() zu verwenden. Stelle sicher, dass du den Parameter base_url auf unseren Endpunkt setzt und deinen API-Schlüssel angibst. Diese Methode ist ideal für Backend-Dienste oder Skripte, bei denen du strukturierte Textausgaben benötigst, ohne rohe HTTP-Anfragen verwalten zu müssen.
from openai import OpenAI
client = OpenAI(base_url="https://api.claudeapicost.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js SDK Integration
Node.js-Entwickler können die gleiche Kompatibilität erreichen, indem sie die baseUrl in der OpenAI SDK-Konfiguration anpassen. So kannst du unser unzensiertes Modell mit minimalen Codeänderungen in bestehende Node-Anwendungen integrieren. Das SDK übernimmt die Tokenisierung und Formatierung der Anfragen, sodass du dich auf die Prompt-Engineering konzentrieren kannst. Vergiss nicht, die Modell-ID uncensored in deinen Anfragekörpern zu übergeben.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.claudeapicost.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-Antworten über SSE
Für Anwendungen, die Echtzeit-Textgenerierung erfordern, unterstützen wir Server-Sent Events (SSE). Streaming reduziert die wahrgenommene Latenz, indem Token bereitgestellt werden, sobald sie generiert werden. Setze den Parameter stream auf true in deiner Anfrage. Der Client erhält eine Reihe von Datenereignissen mit Teilinhalten. Dies ist besonders nützlich für Chat-Schnittstellen oder Live-Datenfeeds, bei denen sofortiges Feedback für die Benutzererfahrung entscheidend ist.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Rate Limits & Constraints
Unser Dienst erzwingt strenge Limits, um die Stabilität zu gewährleisten. Du darfst 300 Anfragen pro Minute pro API-Schlüssel stellen. Die maximale Größe des Anfragekörpers beträgt 8 MB. Wenn dein Schlüssel ungültig oder abgelaufen ist, erhältst du einen 401-Fehler. Wenn dein Prepaid-Guthaben aufgebraucht ist, siehst du einen 402-Fehler, der eine Aufladung erfordert. Ein 429-Status zeigt an, dass du das Ratenlimit überschritten hast. Das Kontextfenster unterstützt 100.000 Token für Prompt und Antwort zusammen. Guthaben sind prepaid und verfällt nie, mit Boni für größere Aufladungen verfügbar.
Fragen und Antworten
Ist das dasselbe wie die offizielle Claude-API?
Nein. Wir bieten unser eigenes Open-Weight-Modell ohne Zensur an, nicht das offizielle Claude-Modell von Anthropic. Unsere API ist jedoch OpenAI-kompatibel, sodass sie mit Standard-Clients funktioniert, die den chat-completions-Endpunkt unterstützen.
Nutzt ihr meine Prompts für das Training?
Nein. Wir verwenden deine Prompt-Daten nicht zum Training unseres Modells. Deine Privatsphäre bleibt gewahrt, und deine Daten werden nicht zur Verbesserung des Basismodells verwendet, es sei denn, du stimmst diesbezüglich explizit zu.
Was passiert, wenn ich das Ratenlimit überschreite?
Du erhältst einen 429 Too Many Requests-Fehler. Die Antwort gibt an, dass das Limit erreicht wurde. Du kannst entweder warten, bis sich das Zeitfenster zurücksetzt, oder dein Guthaben-Upgrade durchführen, falls verfügbar. Das Erneuern deines Schlüssels setzt den Ratenlimit-Zähler für dieselbe IP oder denselben Account-Kontext nicht zurück.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.
Technische Daten
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Base-URL | https://api.claudeapicost.com/v1 |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Anfragegröße | bis 8 MB |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |