PT ▾

Guia de integração: SDKs padrão OpenAI

Conecte seu aplicativo à API LLM abliterada usando SDKs padrão OpenAI. Este guia cobre autenticação, requisições básicas, streaming, chamada de funções e limites de chave.

Base URLhttps://api.abliteratedapi.com/v1Modelouncensored

Pré-requisitos

Você precisa de uma chave de API no painel da API LLM ablated. Crie uma conta com e-mail e senha para receber sua chave imediatamente. Nenhum cartão de crédito é necessário para o teste. A URL base para todas as requisições é https://api.abliteratedapi.com/v1.. Esta URL funciona com os SDKs oficiais da OpenAI e qualquer cliente compatível com OpenAI configurando o base_url e fornecendo sua chave de API.

Autenticação

Passe sua chave de API no cabeçalho Authorization. O valor deve ser Bearer YOUR_API_KEY. Se a chave for inválida, você receberá um erro 401. Se a chave for revogada após regeneração, ela também retornará 401. Se você tiver crédito insuficiente, receberá um erro 402. As chaves não expiram; elas só são invalidadas quando você as regenera.

curl https://api.abliteratedapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Conclusão básica

Envie uma requisição POST para /v1/chat/completions. O ID do modelo é "uncensored". A API aceita estruturas de mensagem padrão. Os prompts não são usados para treinamento. O modelo responde com saída de texto. Você pode enviar até 8 MB por corpo de requisição.

from openai import OpenAI

client = OpenAI(base_url="https://api.abliteratedapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Respostas em streaming

Ative o streaming definindo stream: true na sua requisição. A API retorna Server-Sent Events (SSE). Isso permite processar tokens conforme são gerados. O streaming funciona com todos os SDKs padrão. Use isso para melhor experiência do usuário em interfaces de chat.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Chamada de funções

A API LLM abliterada suporta chamada de funções. Defina ferramentas no corpo da sua requisição. O modelo pode selecionar e chamar essas ferramentas. Isso funciona com o formato padrão OpenAI. Certifique-se de que as definições das ferramentas correspondam às expectativas do SDK. Isso é útil para construir agentes ou fluxos de trabalho automatizados.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.abliteratedapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Limites de taxa e limites

Você está limitado a 300 requisições por minuto por chave. A janela de contexto é de 100.000 tokens para prompt e conclusão combinados. Se você exceder o limite de requisições, receberá um erro 429. Não há assinatura; o crédito é pré-pago e não expira. Recargas começam em $10. Um limite rígido de conteúdo bloqueia conteúdo sexual envolvendo menores.

Recursos e limites

Uma tabela com cada limite, recurso e preço.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
AutenticaçãoAuthorization: Bearer YOUR_KEY
Base URLhttps://api.abliteratedapi.com/v1
ID do modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Modo JSONresponse_format: {"type": "json_object"}
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Janela de contexto100.000 tokens (entrada + saída)
Limite de taxa300 requisições por minuto por chave
Concorrência8 requisições ao mesmo tempo por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamanhoaté 8 MB por requisição
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Validadecrédito pago não expira, sem assinatura
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Bônus+5% a partir de $50, +10% a partir de $100
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Chavesuma chave ativa por conta; uma nova substitui a anterior
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
LoginGoogle ou e-mail e senha

Códigos de erro

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

As chaves de API expiram?

Não, as chaves de API não expiram. Elas só são invalidadas se você regenerar uma nova chave no painel. Você pode regenerar sua chave a qualquer momento, o que revoga imediatamente a antiga.

Qual é o tamanho da janela de contexto?

A janela de contexto é de 100.000 tokens. Isso inclui tanto o prompt de entrada quanto a conclusão de saída. Você pode enviar até 8 MB por corpo de requisição.

Qual conteúdo é bloqueado?

O modelo não recusa tópicos adultos, fictícios ou controversos lícitos. No entanto, um limite rígido de conteúdo sempre se aplica: conteúdo sexual envolvendo menores é bloqueado. Requisições desse tipo são negadas.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API