API compatibile con OpenAI: cambia il tuo client in tre righe
Cambia il tuo client in tre righe: modifica l'URL di base e la chiave API, quindi mantieni il tuo codice esistente. Questa API compatibile con OpenAI pronta all'uso offre un'esperienza API LLM senza censura con prezzi trasparenti per token.
- URL di base
- https://api.openaicompatibleapi.com/v1
- Modello
- senza censura
Prerequisiti: Installa SDK OpenAI
Prima di inviare richieste, assicurati che il tuo ambiente di sviluppo abbia installato l'SDK ufficiale OpenAI per il linguaggio preferito. Questo è il modo standard in cui gli sviluppatori interagiscono con un'API compatibile con OpenAI, garantendo tipizzazione coerente e gestione degli errori. Per Python, usa pip install openai. Per Node.js, esegui npm install openai. Queste librerie gestiscono i dettagli HTTP sottostanti, così puoi concentrarti sul passaggio di prompt e sulla ricezione di output testuali.
Configura URL di base e chiave API
Il vantaggio principale del nostro servizio è che devi aggiornare solo due valori di configurazione. Indirizza il tuo client al nostro URL di base: https://api.openaicompatibleapi.com/v1. Poi, genera la tua chiave API nella pagina di registrazione; viene mostrata immediatamente dopo la registrazione senza bisogno di carta di credito. Imposta base_url e api_key nell'inizializzazione del tuo client. Questo ci rende un'alternativa diretta all'API GPT per i tuoi progetti esistenti senza riscrivere la logica.
Esegui la tua prima richiesta
Invia una richiesta standard di completamento chat usando l'ID del modello uncensored. Questo modello è un modello linguistico grande a pesi aperti ottimizzato per rispondere senza rifiuti di contenuti per uso adulto legale. Non è GPT, Claude o qualsiasi altro modello di un fornitore. Puoi testare la connettività immediatamente con un semplice prompt di testo. La risposta restituirà il testo generato nel campo content.
curl https://api.openaicompatibleapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Abilita le risposte in streaming
Per una migliore esperienza utente, abilita lo streaming per ricevere i token man mano che vengono generati. Imposta stream=True nella tua richiesta. L'SDK restituirà chunk man mano che arrivano, permettendoti di visualizzare i risultati parziali istantaneamente. Questo è particolarmente utile per finestre di contesto lunghe fino a 100.000 token. Lo streaming funziona identicamente ai client OpenAI standard, mantenendo la compatibilità con la tua logica esistente di gestione degli errori.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Usa la chiamata di funzioni (Function Calling)
La nostra API supporta la chiamata strutturata di funzioni. Definisci le tue funzioni nel parametro tools, e il modello restituirà chiamate di funzioni nella risposta. Puoi poi eseguire quegli strumenti e inviare i risultati di nuovo al modello per ulteriore ragionamento. Questa funzione funziona con qualsiasi client compatibile con OpenAI che supporta il formato standard di chiamata di funzioni. È ideale per costruire agenti o automatizzare flussi di lavoro senza gestire un proxy LLM complesso.
from openai import OpenAI
client = OpenAI(base_url="https://api.openaicompatibleapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Verifica i modelli disponibili
Interroga l'endpoint GET /v1/models per verificare i modelli disponibili. Vedrai il modello uncensored elencato. Questo conferma che la tua chiave API e l'URL di base sono configurati correttamente. Puoi anche usare questo endpoint per risolvere i problemi di autenticazione. Se l'endpoint restituisce un elenco, la tua connessione all'API AI per sviluppatori è attiva. Non sono offerti altri modelli, mantenendo la configurazione semplice.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openaicompatibleapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID modello | uncensored |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.openaicompatibleapi.com/v1 |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Modalità JSON | response_format: {"type": "json_object"} |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Finestra di contesto | 100.000 token (input + output) |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Concorrenza | 8 richieste contemporanee per chiave |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Bonus | +5% da $50, +10% da $100 |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Quali sono i limiti di richiesta?
Hai un limite di 300 richieste al minuto per chiave API. La dimensione del corpo della richiesta è limitata a 8 MB. Se superi il limite, riceverai un errore 429. Puoi rigenerare la chiave in qualsiasi momento per resettare l'associazione, anche se il limite di richieste si applica alla chiave stessa.
Perché ricevo un errore 401 o 402?
Un errore 401 indica una chiave API non valida o scaduta. Un errore 402 significa che il tuo credito prepagato è esaurito. Non offriamo un piano gratuito illimitato; devi ricaricare per continuare a utilizzare l'API LLM senza censura. Il credito non scade mai, quindi puoi ricaricare a partire da $10 con criptovalute (USDT o USDC).
La finestra di contesto è davvero di 100k?
Sì, il modello supporta una finestra di contesto rigorosa di 100.000 token per prompt e completamento combinati. Questo consente l'elaborazione estesa di documenti o conversazioni lunghe. Assicurati che i tuoi input rientrino in questo limite per evitare troncamenti o errori.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.