Inicio rápido de API LLM sin censura | Uncensored LLM Hub
Integra nuestro LLM sin censura en tu aplicación usando la interfaz compatible con OpenAI. Esta guía cubre autenticación, formatos de petición, streaming y llamadas a funciones para un despliegue inmediato.
URL base y autenticación
Usa la URL base https://api.uncensoredllmhub.com/v1 para todas las peticiones. La autenticación requiere una clave de API pasada en el encabezado Authorization como token Bearer. Recibes esta clave inmediatamente al registrarte a través de la página Obtener clave de API. La clave está vinculada a una sola cuenta; puedes regenerarla en cualquier momento, lo que invalida la clave anterior. No se requiere número de teléfono ni tarjeta de crédito para comenzar.
POST /v1/chat/completions
Envía tu prompt al endpoint de chat. El id del modelo es siempre uncensored. La API acepta mensajes de chat estándar y devuelve texto. No soporta imágenes, audio ni embeddings. Asegúrate de que el cuerpo de tu petición no supere los 8 MB. El siguiente ejemplo demuestra una petición de texto básica usando cURL:
curl https://api.uncensoredllmhub.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Esto devuelve una finalización para tu prompt. Puedes analizar la respuesta para extraer el texto generado para la lógica de tu aplicación.
Integración con SDK de Python
Usa el paquete de Python oficial openai para una integración más fácil. Configura el cliente con tu URL base y clave de API. Este enfoque simplifica el manejo de JSON y la inferencia de tipos. El siguiente ejemplo muestra cómo inicializar el cliente y enviar un mensaje:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmhub.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Reemplaza YOUR_API_KEY con tu clave real. El objeto de respuesta proporciona acceso directo al contenido, facilitando la integración en flujos de trabajo de Python.
Integración con SDK de Node
Para entornos JavaScript, usa el SDK de Node.js de OpenAI. Establece la URL base y la clave de API en el objeto de configuración. Esto te permite usar sintaxis basada en promesas estándar. El siguiente ejemplo demuestra una finalización de chat simple:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmhub.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Asegúrate de manejar la respuesta asíncrona apropiadamente. Este método funciona bien para aplicaciones del lado del servidor o entornos Node.js donde necesitas procesar la salida inmediatamente.
Respuestas en streaming (SSE)
Habilita el streaming estableciendo stream: true en tu petición. La API devuelve Eventos Enviados por Servidor (SSE) en lugar de un único objeto JSON. Esto te permite mostrar tokens a medida que se generan, mejorando la latencia percibida. El siguiente ejemplo muestra cómo manejar el stream en Python:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Analiza cada fragmento para extraer el contenido delta. Esto es útil para interfaces de chat donde los usuarios esperan indicadores de escritura en tiempo real. El stream termina cuando se recibe el fragmento final.
Límites de velocidad, errores y contexto
Estás limitado a 300 peticiones por minuto por clave. Si excedes esto, recibes un error 429. Otros errores comunes incluyen 401 (clave inválida) y 402 (crédito insuficiente). La ventana de contexto es de 100.000 tokens para prompt más finalización combinados. Si tu entrada es demasiado grande, el modelo puede truncar o rechazar la petición. Monitorea siempre tu uso a través del panel para evitar interrupciones del servicio.
Especificaciones técnicas
Una tabla con cada límite, función y precio.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID del modelo | uncensored |
| Base URL | https://api.uncensoredllmhub.com/v1 |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Límite de peticiones | 300 por minuto por clave |
| Concurrencia | 8 peticiones a la vez por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamaño de petición | hasta 8 MB |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Bono | +5 % desde $50, +10 % desde $100 |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Es este un LLM de código sin censura?
Sí, el modelo está ajustado para responder sin rechazos de contenido, incluso para temas controversiales o para adultos, mientras sigue bloqueando el contenido sexual que involucra a menores. Maneja la generación de código y las consultas técnicas de manera efectiva sin los filtros corporativos estándar.
¿Qué sucede si se compromete mi clave de API?
Puedes regenerar tu clave inmediatamente desde el panel de control. Esta acción revoca la clave antigua, por lo que cualquier aplicación que la use dejará de funcionar hasta que se actualice. Cada cuenta permite solo una clave activa a la vez.
¿Soportan llamadas a herramientas/funciones?
Sí, el endpoint soporta definiciones de herramientas y llamadas a funciones. Puedes definir herramientas en tu petición y el modelo devolverá una salida JSON estructurada que puedes analizar para ejecutar funciones específicas en tu aplicación.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.
Obtener clave de APIhttps://api.uncensoredllmhub.com/v1