Unrestricted AI API : Guide de démarrage rapide de l'API LLM sans censure
Ce guide de démarrage rapide vous montre comment connecter votre application à Unrestricted AI API. Vous apprendrez à envoyer des requêtes, à gérer les réponses en streaming et à gérer les limites de votre compte à l'aide de formats compatibles avec l'API OpenAI.
- par 1M de tokens d'entrée
- $0,25
- Tokens de sortie / 1M
- $1,00
- fenêtre de contexte de tokens
- 100 000
- crédit d'essai
- $0,50
- requêtes par minute
- 300
Authentification et URL de base
Commencez par générer une clé API sur la page Obtenir la clé API. Vous n'avez besoin que d'un e-mail et d'un mot de passe ; aucune carte bancaire n'est requise pour l'essai. Utilisez votre clé dans l'en-tête Authorization comme jeton Bearer. Toutes les requêtes doivent cibler l'URL de base https://api.unrestrictedaiapi.com/v1.
curl https://api.unrestrictedaiapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Votre compte reçoit 0,50 $ de crédit d'essai valable 7 jours. Vous pouvez régénérer votre clé à tout moment, ce qui révoque immédiatement l'ancienne. Chaque compte est limité à une clé active.
Endpoint Chat Completions
Envoyez du texte à l'endpoint POST /v1/chat/completions. L'identifiant du modèle est uncensored. Il s'agit d'un modèle à poids ouverts fonctionnant sur des serveurs GPU dédiés, et non d'un proxy pour GPT ou Claude. Il répond sans refus de contenu pour une utilisation adulte légale.
from openai import OpenAI
client = OpenAI(base_url="https://api.unrestrictedaiapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Les réponses sont des sorties de texte standard. Le modèle prend en charge une fenêtre de contexte de 100 000 tokens pour le prompt et la complétion combinés. Vous pouvez envoyer des définitions d'outils pour l'appel de fonctions, que le modèle respectera dans son format de sortie.
Réponses en streaming
Activez le streaming en définissant stream: true dans votre requête. L'API renvoie des chunks d'événements envoyés par le serveur (SSE). Cela permet à votre application d'afficher les tokens au fur et à mesure de leur génération, réduisant la latence perçue pour les réponses longues.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Chaque fragment contient du texte partiel. Votre client doit agréger ces fragments pour reconstituer le message final. Cette méthode fonctionne avec n'importe quel SDK compatible OpenAI qui prend en charge les protocoles de streaming.
Support d'appel de fonctions
L'API prend en charge l'appel de fonctions via le paramètre tools. Définissez vos fonctions dans la requête, et le modèle renverra une sortie JSON structurée lorsque cela est approprié. Cela permet l'intégration avec des systèmes externes ou une logique personnalisée.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unrestrictedaiapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Analysez la réponse du modèle pour extraire les appels de fonctions. Exécutez vos fonctions définies et renvoyez les résultats au modèle dans une requête ultérieure si nécessaire. Cela permet des processus complexes sans couches d'orchestration externes.
Informations sur le modèle
Interrogez GET /v1/models pour vérifier les endpoints disponibles. Notre modèle principal est uncensored. Ce n'est pas GPT, Claude, Gemini ou tout autre modèle de fournisseur. Il est ajusté pour des réponses cohérentes sans filtres cachés.
La fenêtre de contexte est de 100 000 tokens. La tarification est transparente : 0,25 $ par 1M de tokens d'entrée et 1,00 $ par 1M de tokens de sortie. Le crédit n'expire jamais. Il n'y a pas de frais mensuels ni d'abonnements.
Limites de débit et erreurs
Limitez votre utilisation à 300 requêtes par minute par clé. La taille maximale du corps de la requête est de 8 Mo. Si vous dépassez la limite, vous recevrez une erreur 429. Attendez avant de réessayer.
Les erreurs courantes incluent 401 (clé invalide) et 402 (crédit insuffisant). Rechargez à partir de 10 $ via crypto (USDT ou USDC). Ajoutez +5 % de crédit bonus à partir de 50 $, et +10 % à partir de 100 $. Assurez-vous que votre solde couvre le coût estimé de votre prompt et de la complétion.
Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Base URL | https://api.unrestrictedaiapi.com/v1 |
| Mode JSON | response_format: {"type": "json_object"} |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Concurrence | 8 requêtes simultanées par clé |
| Taille | jusqu'à 8 Mo par requête |
| Limite de débit | 300 requêtes par minute et par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Connexion | Google ou e-mail et mot de passe |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Cette API est-elle adaptée au contenu NSFW ?
Oui, le modèle n'accepte pas le contenu adulte légal. Il est conçu pour des réponses sans censure. Cependant, le contenu sexuel impliquant des mineurs est toujours bloqué, quel que soit le contexte de la requête.
Ai-je besoin d'une carte bancaire pour commencer ?
Non. Vous pouvez vous inscrire avec simplement une adresse e-mail et un mot de passe. Chaque nouveau compte reçoit 0,50 $ de crédit d'essai gratuit valable 7 jours. Vous n'avez besoin d'un moyen de paiement que lorsque vous souhaitez recharger votre solde.
Comment gérer les erreurs dans mon application ?
Surveillez les codes de statut HTTP standards. Utilisez 401 pour vérifier votre clé, 402 pour ajouter du crédit, et 429 pour mettre en œuvre une logique de backoff pour les limites de débit. Validez toujours le corps de la réponse pour des messages d'erreur détaillés.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, changez l'URL de base. C'est toute la configuration.