Przewodnik integracji: Standardowe SDK OpenAI
Połącz swoją aplikację z API LLM abliterated za pomocą standardowych SDK OpenAI. Przewodnik obejmuje uwierzytelnianie, podstawowe zapytania, strumieniowanie, wywoływanie funkcji i limity kluczy.
https://api.abliteratedapi.com/v1ModeluncensoredWymagania wstępne
Potrzebujesz klucza API z panelu abliterated llm api. Załóż konto za pomocą adresu e-mail i hasła, aby natychmiast otrzymać klucz. Nie jest wymagana karta kredytowa do próby. Podstawowy adres URL dla wszystkich zapytań to https://api.abliteratedapi.com/v1. Ten adres URL działa z oficjalnymi SDK OpenAI oraz dowolnym klientem kompatybilnym z OpenAI poprzez ustawienie base_url i podanie klucza API.
Uwierzytelnianie
Przekaż swój klucz API w nagłówku Authorization. Wartość musi brzmieć Bearer YOUR_API_KEY. Jeśli klucz jest nieprawidłowy, otrzymasz błąd 401. Jeśli klucz zostanie unieważniony po regeneracji, również zwróci 401. Jeśli masz niewystarczający kredyt, otrzymasz błąd 402. Klucze nie wygasają; są unieważniane tylko wtedy, gdy je wygenerujesz ponownie.
curl https://api.abliteratedapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Podstawowe uzupełnienie
Wyślij żądanie POST do /v1/chat/completions. ID modelu to "uncensored". API akceptuje standardowe struktury wiadomości. Prompty nie są używane do szkolenia. Model odpowiada tekstem. Możesz wysłać do 8 MB na ciało zapytania.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliteratedapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Odpowiedzi strumieniowe
Włącz strumieniowanie, ustawiając stream: true w żądaniu. API zwraca zdarzenia wysyłane przez serwer (SSE). Pozwala to przetwarzać tokeny w miarę ich generowania. Strumieniowanie działa ze wszystkimi standardowymi SDK. Użyj tego dla lepszego doświadczenia użytkownika w interfejsach czatu.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Wywoływanie funkcji
API LLM abliterated obsługuje wywoływanie funkcji. Zdefiniuj narzędzia w ciele żądania. Model może wybierać i wywoływać te narzędzia. Działa to w standardowym formacie OpenAI. Upewnij się, że definicje narzędzi odpowiadają oczekiwaniom SDK. Jest to przydatne przy budowaniu agentów lub zautomatyzowanych przepływów pracy.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliteratedapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Limity zapytań i limity
Limit to 300 zapytań na minutę na klucz. Okno kontekstu wynosi 100 000 tokenów dla promptu i uzupełnienia łącznie. Jeśli przekroczysz limit zapytań, otrzymasz błąd 429. Nie ma subskrypcji; kredyt jest przedpłacony i nie wygasa. Doładowania zaczynają się od 10 USD. Twardy limit treści blokuje treści seksualne z udziałem małoletnich.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.abliteratedapi.com/v1 |
| ID modelu | uncensored |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Tryb JSON | response_format: {"type": "json_object"} |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozmiar zapytania | do 8 MB |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Bonus | +5% od $50, +10% od $100 |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy klucze API wygasają?
Nie, klucze API nie wygasają. Są unieważniane tylko wtedy, gdy wygenerujesz nowy klucz w panelu. Możesz wygenerować klucz ponownie w dowolnym momencie, co natychmiast unieważnia stary.
Jaki jest rozmiar okna kontekstu?
Okno kontekstu wynosi 100 000 tokenów. Obejmuje ono zarówno prompt wejściowy, jak i output. Możesz wysłać do 8 MB na ciało zapytania.
Jaka treść jest blokowana?
Model nie odrzuca legalnych tematów dla dorosłych, fikcyjnych lub kontrowersyjnych. Zawsze jednak obowiązuje twardy limit treści: treści seksualne z udziałem małoletnich są blokowane. Zapytania tego typu są odrzucane.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień URL bazowy. To cały proces konfiguracji.
Pobierz klucz API