OpenAI-kompatible API: Wechsle deinen Client in drei Zeilen
Wechsle deinen Client in drei Zeilen: Ändere die Basis-URL und den API-Schlüssel und behalte deinen bestehenden Code. Diese sofort einsetzbare OpenAI-kompatible API bietet ein unzensiertes LLM-Erlebnis mit transparenter Token-Preiskalkulation.
- Base-URL
- https://api.openaicompatibleapi.com/v1
- Modell
- unzensiert
Voraussetzungen: OpenAI SDK installieren
Stelle vor dem Senden von Anfragen sicher, dass deine Entwicklungsumgebung das offizielle OpenAI SDK für deine bevorzugte Sprache installiert hat. Dies ist der Standardweg, wie Entwickler mit einer OpenAI-kompatiblen API interagieren, und gewährleistet konsistente Typisierung und Fehlerbehandlung. Für Python verwende pip install openai. Für Node.js führe npm install openai aus. Diese Bibliotheken übernehmen die zugrunde liegenden HTTP-Details, sodass du dich auf das Übergeben von Prompts und das Empfangen von Textausgaben konzentrieren kannst.
Basis-URL und API-Schlüssel konfigurieren
Der Hauptvorteil unseres Dienstes ist, dass du nur zwei Konfigurationswerte aktualisieren musst. Leite deinen Client auf unsere Basis-URL: https://api.openaicompatibleapi.com/v1. Generiere dann deinen API-Schlüssel auf der Anmeldeseite; er wird sofort nach der Registrierung angezeigt, ohne dass eine Kreditkarte erforderlich ist. Lege base_url und api_key in deiner Client-Initialisierung fest. Dies macht uns zu einer direkten GPT-API-Alternative für deine bestehenden Projekte, ohne dass Logik neu geschrieben werden muss.
Erste Anfrage senden
Sende eine Standard-Chat-Vervollständigungsanfrage mit der Modell-ID uncensored. Dieses Modell ist ein Open-Weight-Modell, das darauf trainiert wurde, ohne Inhaltsablehnungen für die legale erwachsene Nutzung zu antworten. Es ist kein GPT, Claude oder ein anderes Modell eines anderen Anbieters. Du kannst die Konnektivität sofort mit einem einfachen Textprompt testen. Die Antwort gibt den generierten Text im Feld content zurück.
curl https://api.openaicompatibleapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Streaming-Antworten aktivieren
Für eine bessere Benutzererfahrung aktiviere Streaming, um Token zu erhalten, sobald sie generiert werden. Setze stream=True in deiner Anfrage. Das SDK liefert Chunks, sobald sie eintreffen, sodass du teilweise Ergebnisse sofort anzeigen kannst. Dies ist besonders nützlich für lange Kontextfenster mit bis zu 100.000 Token. Das Streaming funktioniert identisch wie bei Standard-OpenAI-Clients und erhält die Kompatibilität mit deiner bestehenden Fehlerbehandlungslogik.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Function Calling (Tool Calling) verwenden
Unsere API unterstützt strukturiertes Tool Calling. Definiere deine Funktionen im Parameter tools, und das Modell gibt Tool-Aufrufe in der Antwort zurück. Du kannst diese Tools dann ausführen und die Ergebnisse an das Modell zurücksenden, um weitere Schlussfolgerungen zu ziehen. Diese Funktion funktioniert mit jedem OpenAI-kompatiblen Client, der das Standard-Tool-Calling-Format unterstützt. Sie ist ideal für den Aufbau von Agenten oder die Automatisierung von Workflows, ohne einen komplexen LLM-Proxy verwalten zu müssen.
from openai import OpenAI
client = OpenAI(base_url="https://api.openaicompatibleapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Verfügbare Modelle prüfen
Rufe den Endpunkt GET /v1/models auf, um verfügbare Modelle zu überprüfen. Du siehst das Modell uncensored aufgelistet. Dies bestätigt, dass dein API-Schlüssel und die Basis-URL korrekt konfiguriert sind. Du kannst diesen Endpunkt auch zur Debugging von Authentifizierungsproblemen verwenden. Wenn der Endpunkt eine Liste zurückgibt, ist deine Verbindung zur KI-API für Entwickler aktiv. Es werden keine anderen Modelle angeboten, was die Konfiguration einfach hält.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openaicompatibleapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Technische Daten
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Modell-ID | uncensored |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.openaicompatibleapi.com/v1 |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| JSON-Modus | response_format: {"type": "json_object"} |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Anfragegröße | bis 8 MB |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Wie hoch sind die Ratenlimits?
Du bist auf 300 Anfragen pro Minute pro API-Schlüssel begrenzt. Die Größe des Anfragekörpers ist auf 8 MB begrenzt. Wenn du das Limit überschreitest, erhältst du einen 429-Fehler. Du kannst deinen Schlüssel jederzeit neu generieren, um die Zuordnung zurückzusetzen, obwohl das Ratenlimit für den Schlüssel selbst gilt.
Warum erhalte ich einen 401- oder 402-Fehler?
Ein 401-Fehler bedeutet, dass der API-Schlüssel ungültig oder abgelaufen ist. Ein 402-Fehler bedeutet, dass dein Prepaid-Guthaben aufgebraucht ist. Wir bieten keine unbegrenzte kostenlose Ebene; du musst aufladen, um die unzensierte LLM-API weiter zu nutzen. Guthaben verfällt nie, also kannst du ab 10 $ per Krypto (USDT oder USDC) aufladen.
Ist das Kontextfenster wirklich 100k?
Ja, das Modell unterstützt ein striktes Kontextfenster mit 100.000 Token für Prompt und Completion zusammen. Dies ermöglicht die umfangreiche Verarbeitung von Dokumenten oder lange Gespräche. Stelle sicher, dass deine Eingaben in dieses Limit passen, um Abschneidungen oder Fehler zu vermeiden.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.