Guide d'intégration : SDK OpenAI standards
Connectez votre application à l'API LLM abliterated en utilisant les SDK OpenAI standards. Ce guide couvre l'authentification, les requêtes de base, le streaming, l'appel de fonctions et les limites de clé.
https://api.abliteratedapi.com/v1ModèleuncensoredPrérequis
Vous avez besoin d'une clé API depuis le tableau de bord de l'API LLM abliterated. Créez un compte avec un e-mail et un mot de passe pour recevoir votre clé immédiatement. Aucune carte bancaire n'est requise pour l'essai. L'URL de base pour toutes les requêtes est https://api.abliteratedapi.com/v1.. Cette URL fonctionne avec les SDK OpenAI officiels et tout client compatible OpenAI en définissant le base_url et en fournissant votre clé API.
Authentification
Transmettez votre clé API dans l'en-tête Authorization. La valeur doit être Bearer YOUR_API_KEY. Si la clé est invalide, vous recevrez une erreur 401. Si la clé est révoquée après régénération, elle retournera également 401. Si vous avez un crédit insuffisant, vous recevrez une erreur 402. Les clés n'expirent pas ; elles sont uniquement invalidées lorsque vous les régénérez.
curl https://api.abliteratedapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Complétion de base
Envoyez une requête POST à /v1/chat/completions. L'ID du modèle est « uncensored ». L'API accepte les structures de messages standard. Les prompts ne sont pas utilisés pour l'entraînement. Le modèle répond par une sortie textuelle. Vous pouvez envoyer jusqu'à 8 MB par corps de requête.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliteratedapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Réponses en streaming
Activez le streaming en définissant stream: true dans votre requête. L'API retourne des Server-Sent Events (SSE). Cela vous permet de traiter les tokens au fur et à mesure de leur génération. Le streaming fonctionne avec tous les SDK standards. Utilisez-le pour une meilleure expérience utilisateur dans les interfaces de chat.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Appel de fonctions
L'API LLM abliterated prend en charge l'appel de fonctions. Définissez des outils dans le corps de votre requête. Le modèle peut sélectionner et appeler ces outils. Cela fonctionne avec le format OpenAI standard. Assurez-vous que vos définitions d'outils correspondent aux attentes du SDK. C'est utile pour créer des agents ou des workflows automatisés.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliteratedapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Limites de débit et limites
Vous êtes limité à 300 requêtes par minute par clé. La fenêtre de contexte est de 100 000 tokens pour le prompt et la complétion combinés. Si vous dépassez la limite de débit, vous recevez une erreur 429. Il n'y a pas d'abonnement ; le crédit est prépayé et n'expire pas. Les recharges débutent à 10 $. Une limite de contenu stricte bloque le contenu sexuel impliquant des mineurs.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.abliteratedapi.com/v1 |
| ID du modèle | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Mode JSON | response_format: {"type": "json_object"} |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Limite de débit | 300 requêtes par minute et par clé |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Taille | jusqu'à 8 Mo par requête |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Les clés API expirent-elles ?
Non, les clés API n'expirent pas. Elles sont uniquement invalidées si vous en régénérez une nouvelle dans votre tableau de bord. Vous pouvez régénérer votre clé à tout moment, ce qui révoque immédiatement l'ancienne.
Quelle est la taille de la fenêtre de contexte ?
La fenêtre de contexte est de 100 000 tokens. Cela inclut à la fois le prompt d'entrée et la complétion de sortie. Vous pouvez envoyer jusqu'à 8 MB par corps de requête.
Quel contenu est bloqué ?
Le modèle ne refuse pas les sujets adultes, fictifs ou controversés s'ils sont licites. Cependant, une limite de contenu stricte s'applique toujours : le contenu sexuel impliquant des mineurs est bloqué. Les requêtes de ce type sont refusées.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.
Obtenir une clé API