Início rápido da API LLM sem censura | Uncensored LLM Hub
Integre nosso LLM sem censura ao seu aplicativo usando a interface padrão compatível com OpenAI. Este guia cobre autenticação, formatos de requisição, streaming e chamada de funções para implantação imediata.
URL base e autenticação
Use a URL base https://api.uncensoredllmhub.com/v1 para todas as requisições. A autenticação requer uma chave de API passada no cabeçalho Authorization como token Bearer. Você recebe essa chave imediatamente após o cadastro pela página Obter chave de API. A chave está vinculada a uma única conta; você pode regenerá-la a qualquer momento, o que invalida a chave anterior. Não é necessário número de telefone ou cartão de crédito para começar.
POST /v1/chat/completions
Envie seu prompt para o endpoint de chat. O ID do modelo é sempre uncensored. A API aceita mensagens de chat padrão e retorna texto. Não suporta imagens, áudio ou embeddings. Certifique-se de que o corpo da sua requisição fique abaixo de 8 MB. O exemplo a seguir demonstra uma solicitação de texto básica usando cURL:
curl https://api.uncensoredllmhub.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Isso retorna uma conclusão para o seu prompt. Você pode analisar a resposta para extrair o texto gerado para a lógica do seu aplicativo.
Integração com SDK Python
Use o pacote Python oficial openai para uma integração mais fácil. Configure o cliente com sua URL base e chave de API. Essa abordagem simplifica o tratamento de JSON e a inferência de tipos. O exemplo a seguir mostra como inicializar o cliente e enviar uma mensagem:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmhub.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Substitua YOUR_API_KEY pela sua chave real. O objeto de resposta fornece acesso direto ao conteúdo, facilitando a integração em fluxos de trabalho Python.
Integração com SDK Node
Para ambientes JavaScript, use o SDK Node.js da OpenAI. Defina a URL base e a chave de API no objeto de configuração. Isso permite que você use a sintaxe padrão baseada em promessas. O exemplo a seguir demonstra uma conclusão de chat simples:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmhub.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Certifique-se de lidar com a resposta assíncrona adequadamente. Este método funciona bem para aplicativos do lado do servidor ou ambientes Node.js onde você precisa processar a saída imediatamente.
Respostas em streaming (SSE)
Ative o streaming definindo stream: true na sua requisição. A API retorna Eventos Enviados pelo Servidor (SSE) em vez de um único objeto JSON. Isso permite que você exiba tokens conforme são gerados, melhorando a latência percebida. O exemplo a seguir mostra como lidar com o stream em Python:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Analise cada chunk para extrair o conteúdo delta. Isso é útil para interfaces de chat onde os usuários esperam indicadores de digitação em tempo real. O stream termina quando o último chunk é recebido.
Limites de taxa, erros e contexto
Você está limitado a 300 requisições por minuto por chave. Se você exceder isso, receberá um erro 429. Outros erros comuns incluem 401 (chave inválida) e 402 (crédito insuficiente). A janela de contexto é de 100.000 tokens para prompt mais conclusão combinados. Se sua entrada for muito grande, o modelo pode truncar ou rejeitar a requisição. Monitore sempre seu uso pelo painel para evitar interrupções no serviço.
Especificações técnicas
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID do modelo | uncensored |
| Base URL | https://api.uncensoredllmhub.com/v1 |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Limite de taxa | 300 requisições por minuto por chave |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamanho | até 8 MB por requisição |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Validade | crédito pago não expira, sem assinatura |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Este é um LLM de código sem censura?
Sim, o modelo é ajustado para responder sem recusas de conteúdo, incluindo tópicos controversos ou adultos, enquanto ainda bloqueia conteúdo sexual envolvendo menores. Ele lida com geração de código e consultas técnicas de forma eficaz, sem os filtros corporativos padrão.
O que acontece se minha chave de API for comprometida?
Você pode regenerar sua chave imediatamente no painel. Essa ação revoga a chave antiga, então qualquer aplicativo que a use deixará de funcionar até ser atualizado. Cada conta permite apenas uma chave ativa por vez.
Vocês suportam chamada de funções/ferramentas?
Sim, o endpoint suporta definições de ferramentas e chamada de funções. Você pode definir ferramentas na sua requisição, e o modelo retornará uma saída JSON estruturada que você pode analisar para executar funções específicas no seu aplicativo.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.
Obter chave de APIhttps://api.uncensoredllmhub.com/v1