Unrestricted AI Chatbot: Guida rapida: Integra l'API LLM senza censura
Integra la nostra API per chatbot AI senza censura nella tua applicazione utilizzando endpoint standard compatibili con OpenAI. Questa guida rapida copre l'autenticazione, le richieste di base, lo streaming e la chiamata di funzioni con il nostro unico modello senza censura.
Autenticazione e URL di base
La nostra API utilizza un'autenticazione standard compatibile con OpenAI. Hai bisogno di una chiave API valida, che puoi generare immediatamente nella pagina Ottieni chiave API. L'URL di base per tutte le richieste èhttps://api.unrestrictedaichatbot.cc/v1. Configura il tuo client impostando questo URL di base e la tua chiave API. Supportiamo l'accesso con Google o la registrazione con email e password. Non è necessario il numero di telefono. La tua chiave API viene visualizzata una sola volta dopo la creazione. Tienila al sicuro. Ogni account permette una chiave attiva; la generazione di una nuova chiave sostituisce quella vecchia. Le richieste vengono autenticate tramite l'intestazione Authorization: Bearer <API_KEY>. Se invii una chiave non valida, riceverai un errore 401. Se il tuo credito prepagato è esaurito, riceverai un errore 402. Questo garantisce un utilizzo trasparente senza costi nascosti.
Richiesta di completamento di base
Invia una richiesta standardPOST /v1/chat/completions per generare testo. La nostra API AI senza censura risponde con completamenti di testo basati sul tuo prompt. L'ID del modello è sempre uncensored. Puoi specificare parametri come temperature e top_p per controllare la casualità. L'API accetta input testuali e restituisce output testuali. Non supporta immagini, audio o embedding. Concentrati sulla generazione di testo. Puoi impostare un limite max_tokens, con un valore predefinito di 2.048 se non specificato. La finestra di contesto supporta fino a 100.000 token in totale (prompt + completamento). Usa questo endpoint per attività di generazione di testo semplici.
Risposte in streaming
Abilita lo streaming impostandostream: true nella richiesta. L'API restituisce chunk di Server-Sent Events (SSE). Ogni chunk contiene testo parziale. L'ultimo chunk include le statistiche sull'utilizzo dei token. Lo streaming è ideale per esperienze utente in tempo reale. Riduce la latenza percepita. La nostra API per modelli AI senza censura gestisce lo streaming in modo efficiente. Puoi analizzare i chunk al loro arrivo. Questo permette la visualizzazione istantanea del testo generato. Usa lo streaming per interfacce chat o la generazione di contenuti di testo esteso. Offre un'esperienza utente più fluida rispetto all'attesa della risposta completa. I conteggi dei token sono disponibili solo nell'ultimo chunk.
Chiamata di funzioni (Strumenti)
Supporta la chiamata di funzioni per interazioni strutturate. Definisci gli strumenti nella tua richiesta con nomi, descrizioni e schemi di parametri. Il modello può scegliere di chiamare una funzione. Impostatool_choice su auto o specifica uno strumento. Ciò abilita l'integrazione con sistemi esterni. Usalo per l'estrazione di dati o l'attivazione di azioni. L'API supporta i formati standard degli strumenti OpenAI. Funziona con il nostro modello senza censura per una selezione affidabile delle funzioni. Definisci chiaramente i tuoi strumenti. Il modello restituisce un elenco di chiamate di funzioni. Analizza queste chiamate per eseguire le funzioni nella tua applicazione. Questo aggiunge funzionalità oltre la semplice generazione di testo.
Modalità JSON
Forza il modello a produrre JSON valido. Impostaresponse_format: { "type": "json_object" } nella tua richiesta. Questo garantisce che l'output sia JSON analizzabile. Utile per l'estrazione di dati strutturati o le risposte API. Il modello aderisce alla sintassi JSON. Questo riduce gli errori di analisi nel tuo codice. Combinalo con la chiamata di funzioni per output strutturati robusti. La nostra API AI senza censura mantiene questo formato in modo affidabile. Usalo quando hai bisogno di strutture dati coerenti. Semplifica l'elaborazione a valle. Assicurati che il tuo prompt incoraggi l'output JSON per ottenere i migliori risultati.
Parametri, limiti ed errori
Gestisci le richieste con limiti specifici. Max 300 richieste al minuto per chiave. Max 8 richieste parallele. Corpo della richiesta max 8 MB. Gli errori includono 401 (chiave non valida), 402 (nessun credito) e 429 (limite di richieste). La finestra di contesto è di 100.000 token. L'output massimo è di 32.000 token. Usa parametri cometemperature, top_p, stop, seed, presence_penalty e frequency_penalty. Questi controllano il comportamento di generazione. Monitora il tuo utilizzo tramite i conteggi dei token. Il credito prepagato non scade mai. Gli errori sono gratuiti. Questo modello prevedibile è adatto a integrazioni stabili. Evita di superare i limiti per prevenire errori 429.cURL
curl https://api.unrestrictedaichatbot.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.unrestrictedaichatbot.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unrestrictedaichatbot.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID modello | uncensored |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.unrestrictedaichatbot.cc/v1 |
| Modalità JSON | response_format: {"type": "json_object"} |
| Finestra di contesto | 100.000 token (input + output) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Concorrenza | 8 richieste contemporanee per chiave |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Bonus | +5% da $50, +10% da $100 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Qual è la finestra di contesto massima?
La finestra di contesto supporta fino a 100.000 token, inclusi prompt e completamento. Ciò consente input di dati cospicui e output di lunga durata in una singola richiesta.
Come gestire le risposte in streaming?
Imposta il parametro <code>stream</code> su true nella tua richiesta. L'API restituisce chunk di Server-Sent Events (SSE) contenenti testo parziale. L'utilizzo dei token viene fornito solo nell'ultimo chunk.
Esiste un limite alle richieste parallele?
Sì, puoi effettuare fino a 8 richieste parallele per chiave API. Il limite di richieste è di 300 richieste al minuto. Il superamento di questi limiti genererà un errore 429.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.