Szybki start dla użytkowników Claude
Zacznij korzystać z naszego API LLM bez cenzury w kilka minut, używając standardowych klientów kompatybilnych z OpenAI. Przewodnik obejmuje uwierzytelnianie, wzorce integracji i limity zapytań dla generowania tekstu.
Uwierzytelnianie i Base URL
Nasze API jest zgodne ze standardem OpenAI, więc prawdopodobnie masz już potrzebne biblioteki klienckie. Każde zapytanie wymaga ważnego klucza API przekazanego w nagłówku Authorization. Podstawowy URL dla wszystkich endpointów to https://api.claudeapicost.com/v1. Możesz wygenerować klucz na stronie „Uzyskaj klucz API”, podając tylko e-mail i hasło. Nie jest wymagana karta kredytowa, a otrzymujesz $0.50 kredytu próbnego ważnego przez 7 dni. Chroń swój klucz, ponieważ można go wygenerować ponownie, aby unieważnić dostęp.
Pierwsze zapytanie
Wyślij standardowe zapytanie o uzupełnienie czatu, aby rozpocząć generowanie tekstu. ID modelu to zawsze uncensored. Ten endpoint obsługuje zarówno odpowiedzi strumieniowe, jak i niestrumieniowe. Poniżej znajduje się podstawowy przykład użycia cURL do wysłania prostego prompta i otrzymania odpowiedzi tekstowej.
Użyj tej struktury, aby zweryfikować łączność przed integracją z aplikacją. Odpowiedź zawiera wygenerowany tekst w tablicy choices.
- Endpoint:
POST /v1/chat/completions - Model:
uncensored - Odpowiedź: obiekt JSON z treścią tekstową
curl https://api.claudeapicost.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integracja z Python SDK
Dla programistów Python oficjalny pakiet openai działa bezpośrednio z naszą usługą po nadpisaniu podstawowego URL. Ta metoda pozwala używać znanych metod SDK, takich jak client.chat.completions.create(). Upewnij się, że ustawisz parametr base_url na nasz endpoint i podasz klucz API. Metoda ta jest idealna dla usług backendowych lub skryptów, gdzie potrzebujesz uporządkowanego tekstu bez zarządzania surowymi żądaniami HTTP.
from openai import OpenAI
client = OpenAI(base_url="https://api.claudeapicost.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integracja z Node.js SDK
Programiści Node.js mogą osiągnąć tę samą kompatybilność, dostosowując baseUrl w konfiguracji OpenAI SDK. Pozwala to na integrację naszego modelu bez cenzury w istniejących aplikacjach Node przy minimalnych zmianach kodu. SDK zajmuje się tokenizacją i formatowaniem zapytań, więc możesz skupić się na inżynierii promptów. Pamiętaj o przekazaniu ID modelu uncensored w swoich żądaniach uzupełnienia.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.claudeapicost.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Strumieniowanie odpowiedzi przez SSE
Dla aplikacji wymagających generowania tekstu w czasie rzeczywistym obsługujemy zdarzenia wysłane przez serwer (SSE). Strumieniowanie zmniejsza postrzeganą opóźnienie, dostarczając tokeny w miarę ich generowania. Ustaw parametr stream na true w swoim zapytaniu. Klient otrzyma serię zdarzeń danych zawierających częściową treść. Jest to przydatne w interfejsach czatu lub strumieniach danych, gdzie natychmiastowa informacja zwrotna jest kluczowa.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limity zapytań i ograniczenia
Nasza usługa narzuca ścisłe limity, aby zapewnić stabilność. Masz do dyspozycji 300 zapytań na minutę na klucz API. Maksymalny rozmiar ciała zapytania to 8 MB. Jeśli Twój klucz jest nieprawidłowy lub wygasł, otrzymasz błąd 401. Jeśli Twój przedpłacony kredyt zostanie wyczerpany, zobaczysz błąd 402 wymagający doładowania. Status 429 oznacza przekroczenie limitu zapytań. Okno kontekstu obsługuje 100 000 tokenów dla prompta i uzupełnienia łącznie. Kredyty są przedpłacone i nigdy nie wygasają, z bonusami dostępnymi przy większych doładowaniach.
Pytania i odpowiedzi
Czy to to samo co oficjalny API Claude?
Nie. Udostępniamy nasz własny model o otwartych wagach bez cenzury, a nie oficjalny model Claude od Anthropic. Nasze API jest jednak kompatybilne z OpenAI, więc działa ze standardowymi klientami obsługującymi endpoint chat-completions.
Czy używacie moich promptów do trenowania?
Nie. Nie używamy danych z Twoich promptów do trenowania naszego modelu. Twoja prywatność jest zachowana, a Twoje dane nie są wykorzystywane do ulepszania modelu bazowego, chyba że wyraźnie wyrazisz zgodę na konkretne funkcje.
Co się stanie, gdy przekroczę limit zapytań?
Otrzymasz błąd 429 Too Many Requests. Odpowiedź wskaże, że limit został osiągnięty. Możesz poczekać na reset okna lub zwiększyć poziom kredytu, jeśli jest dostępny. Wygenerowanie klucza ponownie nie resetuje licznika limitu zapytań dla tego samego IP lub kontekstu konta.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień bazowy URL. To cały proces konfiguracji.
Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| ID modelu | uncensored |
| Base URL | https://api.claudeapicost.com/v1 |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Tryb JSON | response_format: {"type": "json_object"} |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozmiar zapytania | do 8 MB |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Bonus | +5% od $50, +10% od $100 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |