Guide de démarrage rapide de l'API LLM sans censure | Uncensored LLM Hub
Intégrez notre LLM sans censure dans votre application en utilisant l'interface compatible OpenAI standard. Ce guide couvre l'authentification, les formats de requête, le streaming et l'appel de fonctions pour un déploiement immédiat.
URL de base et authentification
Utilisez l'URL de base https://api.uncensoredllmhub.com/v1 pour toutes les requêtes. L'authentification nécessite une clé API passée dans l'en-tête Authorization sous forme de jeton Bearer. Vous recevez cette clé immédiatement lors de l'inscription via la page Obtenir une clé API. La clé est liée à un seul compte ; vous pouvez la régénérer à tout moment, ce qui invalide la clé précédente. Aucun numéro de téléphone ni carte bancaire n'est requis pour commencer.
POST /v1/chat/completions
Envoyez votre prompt à l'endpoint de chat. L'identifiant du modèle est toujours uncensored. L'API accepte les messages de chat standards et renvoie du texte. Elle ne prend pas en charge les images, l'audio ou les embeddings. Assurez-vous que le corps de votre requête reste inférieur à 8 Mo. L'exemple suivant montre une requête textuelle de base utilisant cURL :
curl https://api.uncensoredllmhub.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Cela renvoie une complétion pour votre prompt. Vous pouvez analyser la réponse pour extraire le texte généré pour la logique de votre application.
Intégration du SDK Python
Utilisez le package Python officiel openai pour une intégration plus facile. Configurez le client avec votre URL de base et votre clé API. Cette approche simplifie la gestion du JSON et l'inférence de type. L'exemple suivant montre comment initialiser le client et envoyer un message :
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmhub.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Remplacez YOUR_API_KEY par votre clé réelle. L'objet de réponse donne un accès direct au contenu, ce qui facilite l'intégration dans les flux de travail Python.
Intégration du SDK Node
Pour les environnements JavaScript, utilisez le SDK Node.js OpenAI. Définissez l'URL de base et la clé API dans l'objet de configuration. Cela vous permet d'utiliser une syntaxe basée sur les promesses standard. L'exemple suivant montre une complétion de chat simple :
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmhub.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Assurez-vous de gérer la réponse asynchrone de manière appropriée. Cette méthode fonctionne bien pour les applications côté serveur ou les environnements Node.js où vous devez traiter la sortie immédiatement.
Réponses en streaming (SSE)
Activez le streaming en définissant stream: true dans votre requête. L'API renvoie des événements envoyés par le serveur (SSE) au lieu d'un seul objet JSON. Cela vous permet d'afficher les tokens au fur et à mesure de leur génération, améliorant la latence perçue. L'exemple suivant montre comment gérer le flux en Python :
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Analysez chaque chunk pour extraire le contenu du delta. Cela est utile pour les interfaces de chat où les utilisateurs s'attendent à des indicateurs de frappe en temps réel. Le flux se termine lorsque le dernier chunk est reçu.
Limites de débit, erreurs et contexte
Vous êtes limité à 300 requêtes par minute par clé. Si vous dépassez cette limite, vous recevez une erreur 429. Les erreurs courantes incluent également 401 (clé invalide) et 402 (crédit insuffisant). La fenêtre de contexte est de 100 000 tokens pour le prompt et la complétion combinés. Si votre entrée est trop volumineuse, le modèle peut tronquer ou rejeter la requête. Surveillez toujours votre utilisation via le tableau de bord pour éviter les interruptions de service.
Caractéristiques techniques
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Base URL | https://api.uncensoredllmhub.com/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Mode JSON | response_format: {"type": "json_object"} |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Limite de débit | 300 requêtes par minute et par clé |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Taille | jusqu'à 8 Mo par requête |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
S'agit-il d'un LLM de codage sans censure ?
Oui, le modèle est ajusté pour répondre sans refus de contenu, y compris pour les sujets controversés ou pour adultes, tout en bloquant toujours le contenu sexuel impliquant des mineurs. Il gère efficacement la génération de code et les requêtes techniques sans les filtres corporatifs standards.
Que se passe-t-il si ma clé API est compromise ?
Vous pouvez régénérer votre clé immédiatement depuis le tableau de bord. Cette action révoque l'ancienne clé, donc toute application qui l'utilise cessera de fonctionner jusqu'à ce qu'elle soit mise à jour. Chaque compte ne permet qu'une seule clé active à la fois.
Prenez-vous en charge l'appel de fonctions ?
Oui, l'endpoint prend en charge les définitions d'outils et l'appel de fonctions. Vous pouvez définir des outils dans votre requête, et le modèle renverra une sortie JSON structurée que vous pourrez analyser pour exécuter des fonctions spécifiques dans votre application.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.
Obtenir une clé APIhttps://api.uncensoredllmhub.com/v1