Unrestricted AI Chatbot : Démarrage rapide : Intégrer l'API LLM sans censure
Intégrez notre API de chatbot IA sans censure dans votre application via des endpoints compatibles OpenAI. Ce guide couvre l'authentification, les requêtes de base, le streaming et l'appel de fonctions avec notre modèle unique sans censure.
Authentification et URL de base
Notre API utilise une authentification standard compatible OpenAI. Vous avez besoin d'une clé API valide, que vous pouvez générer immédiatement sur la page Obtenir la clé API. L'URL de base pour toutes les requêtes esthttps://api.unrestrictedaichatbot.cc/v1. Configurez votre client en définissant cette URL de base et votre clé API. Nous proposons la connexion Google ou l'inscription par e-mail/mot de passe. Aucun numéro de téléphone n'est requis. Votre clé API n'est affichée qu'une seule fois après sa création. Conservez-la en toute sécurité. Chaque compte permet une seule clé active ; la génération d'une nouvelle clé remplace l'ancienne. Les requêtes sont authentifiées via l'en-tête Authorization: Bearer <API_KEY>. Si vous envoyez une clé invalide, vous recevrez une erreur 401. Si votre crédit prépayé est épuisé, vous recevrez une erreur 402. Cela garantit une utilisation transparente sans frais cachés.
Requête de complétion basique
Envoyez une requête standardPOST /v1/chat/completions pour générer du texte. Notre API IA sans censure répond par des complétions de texte basées sur votre prompt. L'ID du modèle est toujours uncensored. Vous pouvez spécifier des paramètres comme temperature et top_p pour contrôler l'aléatoire. L'API accepte une entrée texte et renvoie une sortie texte. Elle ne supporte pas les images, l'audio ou les embeddings. Concentrez-vous sur la génération de texte. Vous pouvez définir une limite max_tokens, avec une valeur par défaut de 2 048 si non spécifiée. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens au total (prompt + complétion). Utilisez cet endpoint pour des tâches de génération de texte simples.
Réponses en streaming
Activez le streaming en définissantstream: true dans votre requête. L'API renvoie des chunks d'événements envoyés par le serveur (SSE). Chaque chunk contient du texte partiel. Le dernier chunk inclut les statistiques d'utilisation des tokens. Le streaming est idéal pour les expériences utilisateur en temps réel. Il réduit la latence perçue. Notre API de modèles d'IA sans censure gère le streaming efficacement. Vous pouvez analyser les chunks à mesure qu'ils arrivent. Cela permet l'affichage instantané du texte généré. Utilisez le streaming pour les interfaces de chat ou la génération de contenu long. Il offre une expérience utilisateur plus fluide par rapport à l'attente de la réponse complète. Les nombres de tokens sont uniquement disponibles dans le dernier chunk.
Appel de fonctions (Outils)
Supportez l'appel de fonctions pour des interactions structurées. Définissez des outils dans votre requête avec des noms, des descriptions et des schémas de paramètres. Le modèle peut choisir d'appeler une fonction. Définisseztool_choice sur auto ou spécifiez un outil. Cela permet l'intégration avec des systèmes externes. Utilisez ceci pour l'extraction de données ou les déclencheurs d'actions. L'API supporte les formats standard d'outils OpenAI. Elle fonctionne avec notre modèle sans censure pour une sélection fiable des fonctions. Définissez clairement vos outils. Le modèle renvoie une liste d'appels de fonctions. Analysez ces appels pour exécuter des fonctions dans votre application. Cela ajoute des capacités au-delà de la simple génération de texte.
Mode JSON
Forcez le modèle à produire du JSON valide. Définissezresponse_format: { "type": "json_object" } dans votre requête. Cela garantit que la sortie est du JSON analysable. Utile pour l'extraction de données structurées ou les réponses API. Le modèle respecte la syntaxe JSON. Cela réduit les erreurs d'analyse dans votre code. Combinez avec l'appel de fonctions pour des sorties structurées robustes. Notre API IA sans censure maintient ce format de manière fiable. Utilisez-le lorsque vous avez besoin de structures de données cohérentes. Cela simplifie le traitement en aval. Assurez-vous que votre prompt encourage la sortie JSON pour de meilleurs résultats.
Paramètres, limites et erreurs
Gérez les requêtes avec des limites spécifiques. Max 300 requêtes par minute par clé. Max 8 requêtes simultanées. Corps de requête max 8 Mo. Les erreurs incluent 401 (clé invalide), 402 (pas de crédit) et 429 (limite de débit). La fenêtre de contexte est de 100 000 tokens. La sortie max est de 32 000 tokens. Utilisez des paramètres commetemperature, top_p, stop, seed, presence_penalty et frequency_penalty. Ceux-ci contrôlent le comportement de génération. Surveillez votre utilisation via les comptes de tokens. Le crédit prépayé n'expire jamais. Les erreurs sont gratuites. Ce modèle prévisible convient aux intégrations stables. Évitez de dépasser les limites pour prévenir les erreurs 429.cURL
curl https://api.unrestrictedaichatbot.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.unrestrictedaichatbot.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unrestrictedaichatbot.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Authentification | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.unrestrictedaichatbot.cc/v1 |
| Mode JSON | response_format: {"type": "json_object"} |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de débit | 300 requêtes par minute et par clé |
| Taille | jusqu'à 8 Mo par requête |
| Concurrence | 8 requêtes simultanées par clé |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Connexion | Google ou e-mail et mot de passe |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Quelle est la taille maximale de la fenêtre de contexte ?
La fenêtre de contexte prend en charge jusqu'à 100 000 tokens, incluant le prompt et la complétion. Cela permet des entrées importantes et des sorties longues dans une seule requête.
Comment gérer les réponses en streaming ?
Définissez le paramètre <code>stream</code> sur true dans votre requête. L'API renvoie des chunks Server-Sent Events (SSE) contenant du texte partiel. L'utilisation des tokens n'est fournie que dans le dernier chunk.
Existe-t-il une limite de requêtes simultanées ?
Oui, vous pouvez effectuer jusqu'à 8 requêtes simultanées par clé API. La limite de débit est de 300 requêtes par minute. Le dépassement de ces limites entraîne une erreur 429.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.