Points clés
- L'API utilise des endpoints OpenAI compatibles, permettant une intégration prête à l'emploi avec les SDK existants.
- La tarification est basée sur l'usage avec une facturation uniquement en crypto et sans abonnements mensuels.
- Le modèle prend en charge le streaming, l'appel de fonctions et le mode JSON pour l'automatisation avancée.
- Le contenu est généralement sans restriction pour un usage adulte légal, avec un blocage strict sur le contenu sexuel impliquant des mineurs.
Pourquoi utiliser une API de modèles IA sans censure ?
Les LLM standards appliquent souvent des filtres de sécurité trop agressifs pour le contenu créatif ou adulte. Une API de modèles IA sans censure supprime ces refus arbitraires, permettant au modèle de générer du contenu selon le prompt plutôt qu'une politique de sécurité prédéfinie. C'est crucial pour les applications où l'utilisateur contrôle le contexte, comme la fiction interactive, le jeu de rôle ou l'écriture créative pour adultes.
Contrairement aux interfaces de chat web, une API fournit un accès programmatique, vous permettant d'automatiser la génération de contenu à grande échelle. Vous ne payez que pour les tokens utilisés, ce qui maintient les coûts prévisibles. Le modèle est réglé pour répondre sans refus de contenu pour un usage adulte légal, garantissant que votre application se comporte comme prévu sans blocages inattendus.
Cependant, « sans censure » ne signifie pas « sans règles ». Il existe toujours une limite stricte sur le contenu qui s'applique systématiquement : pas de contenu sexuel impliquant des mineurs. Les requêtes de ce type sont refusées. Pour la plupart des autres sujets pour adultes, controversés ou liés à la recherche en sécurité, le modèle fournira une réponse directe.
Comprendre l'endpoint de l'API
L'API expose deux endpoints standards : POST /v1/chat/completions pour générer du texte et GET /v1/models pour lister les modèles disponibles. Cette simplicité signifie que vous pouvez utiliser les SDK officiels OpenAI ou tout client compatible OpenAI en modifiant simplement le base_url et en fournissant votre clé API.
- URL de base :
https://api.uncensoredchatgpt.cc/v1 - ID du modèle :
uncensored - Fenêtre de contexte : 100 000 tokens (prompt + complétion ensemble)
Le modèle est un modèle à poids ouverts exécuté sur nos propres serveurs. Ce n'est pas GPT, Claude, Gemini ou tout autre modèle de fournisseur. Cette indépendance signifie que vous bénéficiez d'une expérience de modèle unique et cohérente sans la variabilité du routage de modèles.
Authentification et gestion des clés
L'authentification est gérée via une clé API transmise dans l'en-tête Authorization. Vous pouvez vous inscrire en utilisant « Se connecter avec Google » ou par e-mail et mot de passe sur la page « Obtenir la clé API ». La clé est affichée immédiatement après sa création.
Chaque compte est limité à une clé active. Si vous générez une nouvelle clé, l'ancienne est remplacée. Cela simplifie la gestion des clés pour la plupart des cas d'utilisation. Vous n'avez pas besoin d'un numéro de téléphone ou d'une carte bancaire pour vous inscrire.
La clé API est le seul identifiant dont vous avez besoin. Elle est liée à votre solde de crédit prépayé, garantissant que votre utilisation est directement liée à votre facturation. Les erreurs et les refus sont gratuits, vous ne payez que pour la génération de tokens réussie.
Structure de la requête pour les réponses sans censure
Les requêtes suivent le format standard de complétion de chat OpenAI. Vous envoyez un objet JSON avec model, messages, et des paramètres optionnels comme temperature, top_p et stop.
Pour obtenir des réponses sans censure, assurez-vous que votre prompt est clair et direct. Le modèle est réglé pour répondre sans refus de contenu pour un usage adulte légal, donc un prompt bien conçu produira le résultat souhaité. Il n'est pas nécessaire d'utiliser des prompts 'jailbreak' spéciaux sauf si vous voulez guider davantage le style.
La sortie maximale est de 32 000 tokens par requête, ou 2 048 si max_tokens n'est pas défini. Cela permet la génération de contenu long en un seul appel.
Gestion du streaming et des tokens
Le streaming est pris en charge via les Server-Sent Events (SSE). Cela vous permet de recevoir des tokens au fur et à mesure de leur génération, réduisant la latence perçue pour les utilisateurs. Le dernier segment du flux contient les informations d'utilisation des tokens, afin que vous puissiez suivre les coûts avec précision.
L'utilisation des tokens est calculée sur la base des tokens d'entrée et de sortie. Les tokens d'entrée sont facturés à 0,25 USD par 1M de tokens, et les tokens de sortie à 1,00 USD par 1M de tokens. Les erreurs ne consomment pas de tokens, vous n'êtes donc pas facturé pour les requêtes échouées.
Fonctionnalités avancées : Outils et JSON
L'API prend en charge l'appel de fonctions (outils) et le mode JSON. Vous pouvez définir des outils dans votre requête, et le modèle renverra des données structurées qui peuvent être analysées et exécutées. Cela est utile pour les tâches d'automatisation où le LLM doit interagir avec d'autres systèmes.
Le mode JSON garantit que la réponse est un JSON valide, facilitant l'analyse dans votre application. Vous pouvez définir le response_format sur {"type": "json_object"} pour l'imposer.
Tarification et facturation crypto
La tarification est simple : 0,25 USD par 1M de tokens d'entrée et 1,00 USD par 1M de tokens de sortie. Il n'y a pas d'abonnements mensuels ni de frais cachés. Vous ne payez que ce que vous utilisez.
Les recharges sont exclusivement en crypto. Vous pouvez utiliser USDT (TRC20) ou USDC (Base). Le minimum de rechargement est de 10 USD et le maximum est de 500 USD. Les paiements supérieurs à 50 USD bénéficient d'un bonus de 5 %, et ceux supérieurs à 100 USD d'un bonus de 10 %.
Le crédit n'expire jamais, vous pouvez donc recharger quand cela vous convient. Les nouveaux comptes reçoivent 0,50 USD de crédit d'essai, valable 7 jours, sans carte bancaire nécessaire.
Limitations et politique de contenu
L'API est conçue uniquement pour la génération de texte. Elle ne prend pas en charge les embeddings, la génération d'images, d'audio ou de vidéo. Il n'y a pas de fine-tuning ni de routage de modèle disponibles. Cette concentration garantit des performances élevées et une simplicité.
La politique de contenu est simple : pas de contenu sexuel impliquant des mineurs. Tout autre contenu adulte est autorisé. Le modèle n'est pas entraîné sur vos données, donc vos prompts sont privés. Vous avez un contrôle total sur le contenu généré, dans les limites de la politique.
Dépannage des problèmes courants
Si vous rencontrez des erreurs, vérifiez votre clé API et le format de la requête. Assurez-vous d'utiliser la bonne URL de base et l'ID du modèle. Les limites de débit sont de 300 requêtes par minute et 8 requêtes simultanées par clé. Si vous atteignez ces limites, vos requêtes seront refusées jusqu'à ce que la fenêtre soit réinitialisée.
Pour les problèmes de facturation, consultez la page Support. Le crédit n'est pas remboursé, mais les erreurs comme les doubles facturations peuvent être corrigées. Rappelez-vous que le crédit n'expire jamais, vous n'avez donc pas besoin de vous précipiter pour l'utiliser.