DE ▾
API-Schlüssel erhalten

OpenAI-kompatible API: Wechsle deinen Client in drei Zeilen

Wechsle deinen Client in drei Zeilen: Ändere die Basis-URL und den API-Schlüssel und behalte deinen bestehenden Code. Diese sofort einsetzbare OpenAI-kompatible API bietet ein unzensiertes LLM-Erlebnis mit transparenter Token-Preiskalkulation.

Base-URL
https://api.openaicompatibleapi.com/v1
Modell
unzensiert

Voraussetzungen: OpenAI SDK installieren

Stelle vor dem Senden von Anfragen sicher, dass deine Entwicklungsumgebung das offizielle OpenAI SDK für deine bevorzugte Sprache installiert hat. Dies ist der Standardweg, wie Entwickler mit einer OpenAI-kompatiblen API interagieren, und gewährleistet konsistente Typisierung und Fehlerbehandlung. Für Python verwende pip install openai. Für Node.js führe npm install openai aus. Diese Bibliotheken übernehmen die zugrunde liegenden HTTP-Details, sodass du dich auf das Übergeben von Prompts und das Empfangen von Textausgaben konzentrieren kannst.

Basis-URL und API-Schlüssel konfigurieren

Der Hauptvorteil unseres Dienstes ist, dass du nur zwei Konfigurationswerte aktualisieren musst. Leite deinen Client auf unsere Basis-URL: https://api.openaicompatibleapi.com/v1. Generiere dann deinen API-Schlüssel auf der Anmeldeseite; er wird sofort nach der Registrierung angezeigt, ohne dass eine Kreditkarte erforderlich ist. Lege base_url und api_key in deiner Client-Initialisierung fest. Dies macht uns zu einer direkten GPT-API-Alternative für deine bestehenden Projekte, ohne dass Logik neu geschrieben werden muss.

Erste Anfrage senden

Sende eine Standard-Chat-Vervollständigungsanfrage mit der Modell-ID uncensored. Dieses Modell ist ein Open-Weight-Modell, das darauf trainiert wurde, ohne Inhaltsablehnungen für die legale erwachsene Nutzung zu antworten. Es ist kein GPT, Claude oder ein anderes Modell eines anderen Anbieters. Du kannst die Konnektivität sofort mit einem einfachen Textprompt testen. Die Antwort gibt den generierten Text im Feld content zurück.

curl https://api.openaicompatibleapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Streaming-Antworten aktivieren

Für eine bessere Benutzererfahrung aktiviere Streaming, um Token zu erhalten, sobald sie generiert werden. Setze stream=True in deiner Anfrage. Das SDK liefert Chunks, sobald sie eintreffen, sodass du teilweise Ergebnisse sofort anzeigen kannst. Dies ist besonders nützlich für lange Kontextfenster mit bis zu 100.000 Token. Das Streaming funktioniert identisch wie bei Standard-OpenAI-Clients und erhält die Kompatibilität mit deiner bestehenden Fehlerbehandlungslogik.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Function Calling (Tool Calling) verwenden

Unsere API unterstützt strukturiertes Tool Calling. Definiere deine Funktionen im Parameter tools, und das Modell gibt Tool-Aufrufe in der Antwort zurück. Du kannst diese Tools dann ausführen und die Ergebnisse an das Modell zurücksenden, um weitere Schlussfolgerungen zu ziehen. Diese Funktion funktioniert mit jedem OpenAI-kompatiblen Client, der das Standard-Tool-Calling-Format unterstützt. Sie ist ideal für den Aufbau von Agenten oder die Automatisierung von Workflows, ohne einen komplexen LLM-Proxy verwalten zu müssen.

from openai import OpenAI

client = OpenAI(base_url="https://api.openaicompatibleapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Verfügbare Modelle prüfen

Rufe den Endpunkt GET /v1/models auf, um verfügbare Modelle zu überprüfen. Du siehst das Modell uncensored aufgelistet. Dies bestätigt, dass dein API-Schlüssel und die Basis-URL korrekt konfiguriert sind. Du kannst diesen Endpunkt auch zur Debugging von Authentifizierungsproblemen verwenden. Wenn der Endpunkt eine Liste zurückgibt, ist deine Verbindung zur KI-API für Entwickler aktiv. Es werden keine anderen Modelle angeboten, was die Konfiguration einfach hält.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.openaicompatibleapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Technische Daten

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
EndpunktePOST /v1/chat/completions · GET /v1/models
Modell-IDuncensored
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.openaicompatibleapi.com/v1
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
JSON-Modusresponse_format: {"type": "json_object"}
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Ratenlimit300 Anfragen pro Minute und Schlüssel
Anfragegrößebis 8 MB
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Bonus+5 % ab $50, +10 % ab $100
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
AnmeldungGoogle oder E-Mail und Passwort

Fehler und Lösungen

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Wie hoch sind die Ratenlimits?

Du bist auf 300 Anfragen pro Minute pro API-Schlüssel begrenzt. Die Größe des Anfragekörpers ist auf 8 MB begrenzt. Wenn du das Limit überschreitest, erhältst du einen 429-Fehler. Du kannst deinen Schlüssel jederzeit neu generieren, um die Zuordnung zurückzusetzen, obwohl das Ratenlimit für den Schlüssel selbst gilt.

Warum erhalte ich einen 401- oder 402-Fehler?

Ein 401-Fehler bedeutet, dass der API-Schlüssel ungültig oder abgelaufen ist. Ein 402-Fehler bedeutet, dass dein Prepaid-Guthaben aufgebraucht ist. Wir bieten keine unbegrenzte kostenlose Ebene; du musst aufladen, um die unzensierte LLM-API weiter zu nutzen. Guthaben verfällt nie, also kannst du ab 10 $ per Krypto (USDT oder USDC) aufladen.

Ist das Kontextfenster wirklich 100k?

Ja, das Modell unterstützt ein striktes Kontextfenster mit 100.000 Token für Prompt und Completion zusammen. Dies ermöglicht die umfangreiche Verarbeitung von Dokumenten oder lange Gespräche. Stelle sicher, dass deine Eingaben in dieses Limit passen, um Abschneidungen oder Fehler zu vermeiden.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhaltenDokumentation lesen

$0,25pro 1M Input-Token

API-Schlüssel erhalten