Guida rapida per gli utenti di Claude
Inizia con la nostra API LLM senza censura in pochi minuti utilizzando client standard compatibili con OpenAI. Questa guida copre l'autenticazione, i pattern di integrazione e i limiti di richieste per la generazione di testo grezzo.
Autenticazione e URL di base
La nostra API segue lo standard di compatibilità OpenAI, quindi probabilmente hai già le librerie client necessarie per connetterti. Tutte le richieste richiedono una chiave API valida nell'intestazione Authorization. L'URL base per tutti gli endpoint è https://api.claudeapicost.com/v1. Genera la tua chiave nella pagina "Ottieni chiave API" con solo email e password. Non serve carta di credito per iniziare e ricevi $0,50 di credito di prova valido per 7 giorni. Conserva la chiave in modo sicuro, può essere rigenerata in qualsiasi momento per revocare l'accesso.
Prima richiesta
Invia una richiesta standard di completamento chat per iniziare a generare testo. L'ID del modello è sempre uncensored. Questo endpoint supporta sia risposte in streaming che non in streaming. Di seguito è riportato un esempio di base utilizzando cURL per inviare un prompt semplice e ricevere una risposta in testo.
Usa questa struttura per verificare la connettività prima di integrare nella tua applicazione. La risposta include il testo generato nell'array choices.
- Endpoint:
POST /v1/chat/completions - Modello:
uncensored - Risposta: Oggetto JSON con contenuto testuale
curl https://api.claudeapicost.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integrazione SDK Python
Per gli sviluppatori Python, il pacchetto ufficiale openai funziona direttamente con il nostro servizio sovrascrivendo l'URL di base. Questo approccio ti permette di utilizzare metodi SDK familiari come client.chat.completions.create(). Assicurati di impostare il parametro base_url sul nostro endpoint e di fornire la tua chiave API. Questo metodo è ideale per servizi backend o script dove hai bisogno di un output di testo strutturato senza gestire le richieste HTTP grezze.
from openai import OpenAI
client = OpenAI(base_url="https://api.claudeapicost.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integrazione SDK Node.js
Gli sviluppatori Node.js possono ottenere la stessa compatibilità modificando il baseUrl nella configurazione dell'SDK OpenAI. Questo ti permette di integrare il nostro modello senza censura nelle applicazioni Node esistenti con modifiche minime al codice. L'SDK gestisce la tokenizzazione e la formattazione della richiesta, così puoi concentrarti sull'ingegneria del prompt. Ricorda di passare l'ID del modello uncensored nelle tue richieste di completamento.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.claudeapicost.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Risposte in streaming tramite SSE
Per le applicazioni che richiedono generazione di testo in tempo reale, supportiamo gli eventi inviati dal server (SSE). Lo streaming riduce la latenza percepita consegnando i token man mano che vengono generati. Imposta il parametro stream su true nella tua richiesta. Il client riceverà una serie di eventi dati contenenti contenuto parziale. Questo è particolarmente utile per interfacce chat o feed di dati live dove il feedback immediato è critico per l'esperienza utente.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limiti di richiesta e vincoli
Il nostro servizio applica limiti rigorosi per garantire la stabilità. Hai a disposizione 300 richieste al minuto per chiave API. La dimensione massima del corpo della richiesta è 8 MB. Se la tua chiave non è valida o è scaduta, riceverai un errore 401. Se il tuo credito prepagato è esaurito, vedrai un errore 402 che richiede una ricarica. Uno stato 429 indica che hai superato il limite di richieste. La finestra di contesto supporta 100.000 token per prompt e completamento combinati. I crediti sono prepagati e non scadono mai, con bonus disponibili per ricariche più grandi.
Domande e risposte
È uguale all'API ufficiale di Claude?
No. Serviamo il nostro modello open-weight senza censura, non il modello ufficiale Claude di Anthropic. Tuttavia, la nostra API è compatibile con OpenAI, quindi funziona con i client standard che supportano l'endpoint chat-completions.
Utilizzate i miei prompt per l'addestramento?
No. Non utilizziamo i dati del tuo prompt per addestrare il nostro modello. La tua privacy è preservata e i tuoi dati non vengono utilizzati per migliorare il modello di base a meno che tu non acconsenta esplicitamente per funzionalità specifiche.
Cosa succede se supero il limite di richieste?
Riceverai un errore 429 Too Many Requests. La risposta indicherà che il limite è stato raggiunto. Puoi attendere il reset della finestra o aggiornare il tuo livello di credito se disponibile. Rigenerare la chiave non resetta il contatore del limite di richieste per lo stesso IP o contesto account.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| ID modello | uncensored |
| Base URL | https://api.claudeapicost.com/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Finestra di contesto | 100.000 token (input + output) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Modalità JSON | response_format: {"type": "json_object"} |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Dimensione | fino a 8 MB per richiesta |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Bonus | +5% da $50, +10% da $100 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |