Integrationsanleitung: Standard OpenAI SDKs
Verbinde deine Anwendung mit der Abliterated LLM API über Standard OpenAI SDKs. Diese Anleitung behandelt Authentifizierung, Basisanfragen, Streaming, Function Calling und Schlüsselgrenzen.
https://api.abliteratedapi.com/v1ModelluncensoredVoraussetzungen
Du benötigst einen API-Schlüssel vom abliterated LLM-API-Dashboard. Erstelle ein Konto mit E-Mail und Passwort, um deinen Schlüssel sofort zu erhalten. Für das Testguthaben ist keine Kreditkarte erforderlich. Die Basis-URL für alle Anfragen ist https://api.abliteratedapi.com/v1.. Diese URL funktioniert mit den offiziellen OpenAI-SDKs und jedem OpenAI-kompatiblen Client durch Festlegung von base_url und Bereitstellung deines API-Schlüssels.
Authentifizierung
Übergebe deinen API-Schlüssel im Authorization-Header. Der Wert muss Bearer YOUR_API_KEY lauten. Bei einem ungültigen Schlüssel erhältst du einen 401-Fehler. Wenn der Schlüssel nach der Neugenerierung widerrufen wird, erhältst du ebenfalls 401. Bei unzureichendem Guthaben erhältst du einen 402-Fehler. Schlüssel verfallen nicht; sie werden nur bei der Neugenerierung ungültig.
curl https://api.abliteratedapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Basis-Vervollständigung
Sende eine POST-Anfrage an /v1/chat/completions. Die Modell-ID ist "uncensored". Die API akzeptiert Standard-Nachrichtenstrukturen. Prompts werden nicht zum Training verwendet. Das Modell antwortet mit Textausgabe. Du kannst bis zu 8 MB pro Anfrage-Body senden.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliteratedapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Streaming-Antworten
Aktiviere Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt Server-Sent Events (SSE) zurück. Dies ermöglicht dir, Token zu verarbeiten, während sie generiert werden. Streaming funktioniert mit allen Standard-SDKs. Nutze dies für eine bessere Benutzererfahrung in Chat-Schnittstellen.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Function Calling
Die Abliterated LLM API unterstützt Function Calling. Definiere Tools in deinem Anfrage-Body. Das Modell kann diese Tools auswählen und aufrufen. Dies funktioniert im Standard OpenAI-Format. Stelle sicher, dass deine Tool-Definitionen den SDK-Erwartungen entsprechen. Dies ist nützlich für den Aufbau von Agenten oder automatisierten Workflows.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliteratedapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Ratenlimits & Grenzen
Du bist auf 300 Anfragen pro Minute pro Schlüssel begrenzt. Das Kontextfenster umfasst 100.000 Token für Prompt und Vervollständigung zusammen. Wenn du das Ratenlimit überschreitest, erhältst du einen 429-Fehler. Es gibt kein Abonnement; das Guthaben ist Prepaid und verfällt nicht. Aufladungen beginnen ab 10 $. Eine harte Inhaltsbeschränkung blockiert sexuelle Inhalte mit Minderjährigen.
Funktionen und Limits
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.abliteratedapi.com/v1 |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Anfragegröße | bis 8 MB |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Verfallen API-Schlüssel?
Nein, API-Schlüssel verfallen nicht. Sie werden nur ungültig, wenn du in deinem Dashboard einen neuen Schlüssel generierst. Du kannst deinen Schlüssel jederzeit neu generieren, wodurch der alte sofort widerrufen wird.
Wie groß ist das Kontextfenster?
Das Kontextfenster umfasst 100.000 Token. Dies umfasst sowohl den Eingabe-Prompt als auch die Ausgabe-Vervollständigung. Du kannst bis zu 8 MB pro Anfrage-Body senden.
Welcher Inhalt wird blockiert?
Das Modell lehnt rechtliche erwachsene, fiktive oder kontroverse Themen nicht ab. Es gilt jedoch immer eine harte Inhaltsbeschränkung: Sexueller Inhalt mit Minderjährigen wird blockiert. Anfragen dieser Art werden abgelehnt.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.
API-Schlüssel erhalten