PL ▾
Koszt Claude API.com

API LLM bez cenzury w przejrzystych cenach

https://api.claudeapicost.com/v1

claudeapicost.comPobierz klucz API

Szybki start dla użytkowników Claude

Zacznij korzystać z naszego API LLM bez cenzury w kilka minut, używając standardowych klientów kompatybilnych z OpenAI. Przewodnik obejmuje uwierzytelnianie, wzorce integracji i limity zapytań dla generowania tekstu.

Base URLhttps://api.claudeapicost.com/v1
Modeluncensored

Uwierzytelnianie i Base URL

Nasze API jest zgodne ze standardem OpenAI, więc prawdopodobnie masz już potrzebne biblioteki klienckie. Każde zapytanie wymaga ważnego klucza API przekazanego w nagłówku Authorization. Podstawowy URL dla wszystkich endpointów to https://api.claudeapicost.com/v1. Możesz wygenerować klucz na stronie „Uzyskaj klucz API”, podając tylko e-mail i hasło. Nie jest wymagana karta kredytowa, a otrzymujesz $0.50 kredytu próbnego ważnego przez 7 dni. Chroń swój klucz, ponieważ można go wygenerować ponownie, aby unieważnić dostęp.

Pierwsze zapytanie

Wyślij standardowe zapytanie o uzupełnienie czatu, aby rozpocząć generowanie tekstu. ID modelu to zawsze uncensored. Ten endpoint obsługuje zarówno odpowiedzi strumieniowe, jak i niestrumieniowe. Poniżej znajduje się podstawowy przykład użycia cURL do wysłania prostego prompta i otrzymania odpowiedzi tekstowej.

Użyj tej struktury, aby zweryfikować łączność przed integracją z aplikacją. Odpowiedź zawiera wygenerowany tekst w tablicy choices.

  • Endpoint: POST /v1/chat/completions
  • Model: uncensored
  • Odpowiedź: obiekt JSON z treścią tekstową
curl https://api.claudeapicost.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Integracja z Python SDK

Dla programistów Python oficjalny pakiet openai działa bezpośrednio z naszą usługą po nadpisaniu podstawowego URL. Ta metoda pozwala używać znanych metod SDK, takich jak client.chat.completions.create(). Upewnij się, że ustawisz parametr base_url na nasz endpoint i podasz klucz API. Metoda ta jest idealna dla usług backendowych lub skryptów, gdzie potrzebujesz uporządkowanego tekstu bez zarządzania surowymi żądaniami HTTP.

from openai import OpenAI

client = OpenAI(base_url="https://api.claudeapicost.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integracja z Node.js SDK

Programiści Node.js mogą osiągnąć tę samą kompatybilność, dostosowując baseUrl w konfiguracji OpenAI SDK. Pozwala to na integrację naszego modelu bez cenzury w istniejących aplikacjach Node przy minimalnych zmianach kodu. SDK zajmuje się tokenizacją i formatowaniem zapytań, więc możesz skupić się na inżynierii promptów. Pamiętaj o przekazaniu ID modelu uncensored w swoich żądaniach uzupełnienia.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.claudeapicost.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Strumieniowanie odpowiedzi przez SSE

Dla aplikacji wymagających generowania tekstu w czasie rzeczywistym obsługujemy zdarzenia wysłane przez serwer (SSE). Strumieniowanie zmniejsza postrzeganą opóźnienie, dostarczając tokeny w miarę ich generowania. Ustaw parametr stream na true w swoim zapytaniu. Klient otrzyma serię zdarzeń danych zawierających częściową treść. Jest to przydatne w interfejsach czatu lub strumieniach danych, gdzie natychmiastowa informacja zwrotna jest kluczowa.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limity zapytań i ograniczenia

Nasza usługa narzuca ścisłe limity, aby zapewnić stabilność. Masz do dyspozycji 300 zapytań na minutę na klucz API. Maksymalny rozmiar ciała zapytania to 8 MB. Jeśli Twój klucz jest nieprawidłowy lub wygasł, otrzymasz błąd 401. Jeśli Twój przedpłacony kredyt zostanie wyczerpany, zobaczysz błąd 402 wymagający doładowania. Status 429 oznacza przekroczenie limitu zapytań. Okno kontekstu obsługuje 100 000 tokenów dla prompta i uzupełnienia łącznie. Kredyty są przedpłacone i nigdy nie wygasają, z bonusami dostępnymi przy większych doładowaniach.

Pytania i odpowiedzi

Czy to to samo co oficjalny API Claude?

Nie. Udostępniamy nasz własny model o otwartych wagach bez cenzury, a nie oficjalny model Claude od Anthropic. Nasze API jest jednak kompatybilne z OpenAI, więc działa ze standardowymi klientami obsługującymi endpoint chat-completions.

Czy używacie moich promptów do trenowania?

Nie. Nie używamy danych z Twoich promptów do trenowania naszego modelu. Twoja prywatność jest zachowana, a Twoje dane nie są wykorzystywane do ulepszania modelu bazowego, chyba że wyraźnie wyrazisz zgodę na konkretne funkcje.

Co się stanie, gdy przekroczę limit zapytań?

Otrzymasz błąd 429 Too Many Requests. Odpowiedź wskaże, że limit został osiągnięty. Możesz poczekać na reset okna lub zwiększyć poziom kredytu, jeśli jest dostępny. Wygenerowanie klucza ponownie nie resetuje licznika limitu zapytań dla tego samego IP lub kontekstu konta.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień bazowy URL. To cały proces konfiguracji.

Pobierz klucz API

Specyfikacja techniczna

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
UwierzytelnianieAuthorization: Bearer YOUR_KEY
ID modeluuncensored
Base URLhttps://api.claudeapicost.com/v1
EndpointyPOST /v1/chat/completions · GET /v1/models
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Tryb JSONresponse_format: {"type": "json_object"}
Równoległe zapytaniado 8 jednocześnie na klucz
Limit zapytań300 zapytań na minutę na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rozmiar zapytaniado 8 MB
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Bonus+5% od $50, +10% od $100
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
LogowanieGoogle albo e-mail i hasło

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund