FR ▾

Unrestricted AI Chatbot : Démarrage rapide : Intégrer l'API LLM sans censure

Intégrez notre API de chatbot IA sans censure dans votre application via des endpoints compatibles OpenAI. Ce guide couvre l'authentification, les requêtes de base, le streaming et l'appel de fonctions avec notre modèle unique sans censure.

Authentification et URL de base

Notre API utilise une authentification standard compatible OpenAI. Vous avez besoin d'une clé API valide, que vous pouvez générer immédiatement sur la page Obtenir la clé API. L'URL de base pour toutes les requêtes est https://api.unrestrictedaichatbot.cc/v1. Configurez votre client en définissant cette URL de base et votre clé API. Nous proposons la connexion Google ou l'inscription par e-mail/mot de passe. Aucun numéro de téléphone n'est requis. Votre clé API n'est affichée qu'une seule fois après sa création. Conservez-la en toute sécurité. Chaque compte permet une seule clé active ; la génération d'une nouvelle clé remplace l'ancienne. Les requêtes sont authentifiées via l'en-tête Authorization: Bearer <API_KEY>. Si vous envoyez une clé invalide, vous recevrez une erreur 401. Si votre crédit prépayé est épuisé, vous recevrez une erreur 402. Cela garantit une utilisation transparente sans frais cachés.

Requête de complétion basique

Envoyez une requête standard POST /v1/chat/completions pour générer du texte. Notre API IA sans censure répond par des complétions de texte basées sur votre prompt. L'ID du modèle est toujours uncensored. Vous pouvez spécifier des paramètres comme temperature et top_p pour contrôler l'aléatoire. L'API accepte une entrée texte et renvoie une sortie texte. Elle ne supporte pas les images, l'audio ou les embeddings. Concentrez-vous sur la génération de texte. Vous pouvez définir une limite max_tokens, avec une valeur par défaut de 2 048 si non spécifiée. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens au total (prompt + complétion). Utilisez cet endpoint pour des tâches de génération de texte simples.

Réponses en streaming

Activez le streaming en définissant stream: true dans votre requête. L'API renvoie des chunks d'événements envoyés par le serveur (SSE). Chaque chunk contient du texte partiel. Le dernier chunk inclut les statistiques d'utilisation des tokens. Le streaming est idéal pour les expériences utilisateur en temps réel. Il réduit la latence perçue. Notre API de modèles d'IA sans censure gère le streaming efficacement. Vous pouvez analyser les chunks à mesure qu'ils arrivent. Cela permet l'affichage instantané du texte généré. Utilisez le streaming pour les interfaces de chat ou la génération de contenu long. Il offre une expérience utilisateur plus fluide par rapport à l'attente de la réponse complète. Les nombres de tokens sont uniquement disponibles dans le dernier chunk.

Appel de fonctions (Outils)

Supportez l'appel de fonctions pour des interactions structurées. Définissez des outils dans votre requête avec des noms, des descriptions et des schémas de paramètres. Le modèle peut choisir d'appeler une fonction. Définissez tool_choice sur auto ou spécifiez un outil. Cela permet l'intégration avec des systèmes externes. Utilisez ceci pour l'extraction de données ou les déclencheurs d'actions. L'API supporte les formats standard d'outils OpenAI. Elle fonctionne avec notre modèle sans censure pour une sélection fiable des fonctions. Définissez clairement vos outils. Le modèle renvoie une liste d'appels de fonctions. Analysez ces appels pour exécuter des fonctions dans votre application. Cela ajoute des capacités au-delà de la simple génération de texte.

Mode JSON

Forcez le modèle à produire du JSON valide. Définissez response_format: { "type": "json_object" } dans votre requête. Cela garantit que la sortie est du JSON analysable. Utile pour l'extraction de données structurées ou les réponses API. Le modèle respecte la syntaxe JSON. Cela réduit les erreurs d'analyse dans votre code. Combinez avec l'appel de fonctions pour des sorties structurées robustes. Notre API IA sans censure maintient ce format de manière fiable. Utilisez-le lorsque vous avez besoin de structures de données cohérentes. Cela simplifie le traitement en aval. Assurez-vous que votre prompt encourage la sortie JSON pour de meilleurs résultats.

Paramètres, limites et erreurs

Gérez les requêtes avec des limites spécifiques. Max 300 requêtes par minute par clé. Max 8 requêtes simultanées. Corps de requête max 8 Mo. Les erreurs incluent 401 (clé invalide), 402 (pas de crédit) et 429 (limite de débit). La fenêtre de contexte est de 100 000 tokens. La sortie max est de 32 000 tokens. Utilisez des paramètres comme temperature, top_p, stop, seed, presence_penalty et frequency_penalty. Ceux-ci contrôlent le comportement de génération. Surveillez votre utilisation via les comptes de tokens. Le crédit prépayé n'expire jamais. Les erreurs sont gratuites. Ce modèle prévisible convient aux intégrations stables. Évitez de dépasser les limites pour prévenir les erreurs 429.

cURL

curl https://api.unrestrictedaichatbot.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.unrestrictedaichatbot.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unrestrictedaichatbot.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Fiche technique de l'API

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
EndpointsPOST /v1/chat/completions · GET /v1/models
ID du modèleuncensored
AuthentificationAuthorization: Bearer YOUR_KEY
Base URLhttps://api.unrestrictedaichatbot.cc/v1
Mode JSONresponse_format: {"type": "json_object"}
Fenêtre de contexte100 000 tokens (entrée + sortie)
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite de débit300 requêtes par minute et par clé
Taillejusqu'à 8 Mo par requête
Concurrence8 requêtes simultanées par clé
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Bonus+5 % dès 50 $, +10 % dès 100 $
Validitéle crédit payé n'expire jamais, sans abonnement
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Clésune clé active par compte ; une nouvelle remplace l'ancienne
ConnexionGoogle ou e-mail et mot de passe
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

Quelle est la taille maximale de la fenêtre de contexte ?

La fenêtre de contexte prend en charge jusqu'à 100 000 tokens, incluant le prompt et la complétion. Cela permet des entrées importantes et des sorties longues dans une seule requête.

Comment gérer les réponses en streaming ?

Définissez le paramètre <code>stream</code> sur true dans votre requête. L'API renvoie des chunks Server-Sent Events (SSE) contenant du texte partiel. L'utilisation des tokens n'est fournie que dans le dernier chunk.

Existe-t-il une limite de requêtes simultanées ?

Oui, vous pouvez effectuer jusqu'à 8 requêtes simultanées par clé API. La limite de débit est de 300 requêtes par minute. Le dépassement de ces limites entraîne une erreur 429.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API