Basis-URL und Authentifizierung
Unsere API ist vollständig OpenAI-kompatibel, sodass du jedes Standard-SDK mit minimalen Änderungen nutzen kannst. Die Basis-URL für alle Anfragen ist https://api.openrouterapi.top/v1. Die Authentifizierung erfolgt über einen Bearer-Token, der im Authorization-Header übergeben wird. Du kannst diesen Schlüssel sofort generieren, indem du dich über Google oder eine E-Mail-Adresse in unserem Dashboard anmeldest. Bewahre deinen Schlüssel sicher auf, da er direkten Zugriff auf dein Prepaid-Guthaben gewährt.
Erste Anfrage
Teste den Endpunkt mit einem einfachen curl-Befehl. Ersetze YOUR_API_KEY durch deinen tatsächlichen Schlüssel. Die Modell-ID ist auf uncensored eingestellt, um Standard-Inhaltsfilter zu umgehen. Diese Anfrage sendet einen Prompt und wartet auf die vollständige Antwort.
curl https://api.openrouterapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Wenn der Schlüssel ungültig ist, erhältst du einen 401-Fehler. Wenn dein Prepaid-Guthaben aufgebraucht ist, erhältst du einen 402-Fehler. Diese Fehler verbrauchen nicht dein Token-Guthaben, zählen aber zu deinem Ratenlimit.
Python-SDK-Integration
Die Verwendung des offiziellen openai Python-Pakets ist unkompliziert. Initialisiere den Client mit deiner Basis-URL und deinem Schlüssel. Das SDK übernimmt die JSON-Serialisierung automatisch. Dieses Beispiel zeigt eine grundlegende Chat-Vervollständigungsanfrage.
from openai import OpenAI
client = OpenAI(base_url="https://api.openrouterapi.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Stelle sicher, dass du die neueste Version des SDK installiert hast. Das Client-Objekt verwaltet den Verbindungs-Pool, sodass du es für mehrere Anfragen wiederverwenden kannst, ohne es neu zu initialisieren.
Node-SDK-Integration
Für JavaScript-Umgebungen funktioniert das Node-SDK identisch. Übergebe die benutzerdefinierte Basis-URL während der Initialisierung. Dieser Ansatz ermöglicht es dir, unzensierte Generierung nahtlos in bestehende Web-Apps oder Backend-Dienste zu integrieren.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openrouterapi.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Das Node-SDK unterstützt sowohl promise-basierte als auch async/await-Muster. Die Fehlerbehandlung ist konsistent mit anderen OpenAI-kompatiblen Diensten.
Streaming-Antworten
Aktiviere das Streaming, indem du stream: true in deiner Anfrage setzt. Die API gibt Server-Sent Events (SSE) zurück. Jeder Chunk enthält Teiltext. Der letzte Chunk enthält die Token-Nutzungsstatistiken für die Abrechnung.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Prepaid-Guthaben wird basierend auf den tatsächlich im Endoutput generierten Tokens berechnet. Streaming ändert das Preismodell nicht; du zahlst für die erfolgreich zugestellten Tokens.
Ratenlimits und Kontextfenster
Jeder API-Schlüssel ist auf 300 Anfragen pro Minute und 8 parallele Anfragen begrenzt. Die maximale Größe des Anfragekörpers beträgt 8 MB. Das Kontextfenster unterstützt insgesamt bis zu 100.000 Token (Input plus Output). Die maximale Ausgabe pro Anfrage beträgt 32.000 Token, bzw. 2.048, wenn max_tokens nicht festgelegt ist. Fehler wie 401 oder 402 verbrauchen kein Guthaben, zählen aber zum Ratenlimit. Content Refusals für bestimmte Inhaltstypen sind ebenfalls kostenlos.