Wichtige Punkte
- Die API verwendet standard OpenAI-kompatible Endpunkte, was eine sofortige Integration in bestehende SDKs ermöglicht.
- Die Preise sind nutzungsbasiert mit Krypto-Abrechnung und ohne monatliche Abonnements.
- Das Modell unterstützt Streaming, Function Calling und JSON-Modus für fortgeschrittene Automatisierung.
- Inhalte sind für die rechtmäßige Erwachsenennutzung im Allgemeinen unbeschränkt, mit einer harten Blockade für sexuellen Inhalt, der Minderjährige betrifft.
Warum eine API für unzensierte KI-Modelle verwenden?
Standard-LLMs wenden oft Sicherheitsfilter an, die für kreativen oder erwachsenen Inhalt zu aggressiv sein können. Eine API für unzensierte KI-Modelle entfernt diese willkürlichen Ablehnungen und ermöglicht es dem Modell, Inhalte basierend auf dem Prompt und nicht auf einer vordefinierten Sicherheitsrichtlinie zu generieren. Dies ist entscheidend für Anwendungen, bei denen der Nutzer den Kontext steuert, wie interaktive fiktionale Geschichten, Charakter-Roleplay oder erwachsenes kreatives Schreiben.
Im Gegensatz zu Web-Chat-Schnittstellen bietet eine API programmatischen Zugriff, der es dir ermöglicht, Inhaltsgenerierung im großen Maßstab zu automatisieren. Du zahlst nur für die verwendeten Token, was die Kosten vorhersehbar hält. Das Modell ist darauf abgestimmt, ohne Inhaltsablehnungen für die rechtmäßige Erwachsenennutzung zu antworten, sodass deine Anwendung wie erwartet funktioniert, ohne unerwartete Blockaden.
Allerdings bedeutet 'unzensiert' nicht 'keine Regeln'. Es gibt immer noch eine harte Inhaltsgrenze, die immer gilt: kein sexueller Inhalt, der Minderjährige betrifft. Anfragen dieser Art werden abgelehnt. Für die meisten anderen erwachsenen, kontroversen oder sicherheitsforschungsbezogenen Themen wird das Modell eine direkte Antwort liefern.
Verstehen des API-Endpunkts
Die API bietet zwei Standard-Endpunkte: POST /v1/chat/completions zur Textgenerierung und GET /v1/models zur Auflistung verfügbarer Modelle. Diese Einfachheit bedeutet, dass du die offiziellen OpenAI-SDKs oder jeden OpenAI-kompatiblen Client nutzen kannst, indem du einfach die base_url änderst und deinen API-Schlüssel angibst.
- Basis-URL:
https://api.uncensoredchatgpt.cc/v1 - Modell-ID:
uncensored - Kontextfenster: 100.000 Token (Prompt + Completion zusammen)
Das Modell ist ein Open-Weight-Modell, das auf unseren eigenen Servern läuft. Es ist kein GPT, Claude, Gemini oder ein anderes Modell eines anderen Anbieters. Diese Unabhängigkeit bedeutet, dass du eine konsistente Single-Modell-Erfahrung erhältst, ohne die Variabilität des Modell-Routings.
Authentifizierung und Schlüsselverwaltung
Die Authentifizierung erfolgt über einen API-Schlüssel, der im Authorization-Header übergeben wird. Du kannst dich mit 'Weiter mit Google' oder per E-Mail und Passwort auf der Seite 'API-Schlüssel erhalten' anmelden. Der Schlüssel wird sofort nach der Erstellung angezeigt.
Jedes Konto ist auf einen aktiven Schlüssel beschränkt. Wenn du einen neuen Schlüssel generierst, wird der alte ersetzt. Dies vereinfacht die Schlüsselverwaltung für die meisten Anwendungsfälle. Du benötigst keine Telefonnummer oder Kreditkarte, um dich anzumelden.
Der API-Schlüssel ist die einzige Anmeldeinformation, die du benötigst. Er ist mit deinem Prepaid-Guthaben-Status verknüpft, sodass deine Nutzung direkt mit deiner Abrechnung verknüpft ist. Fehler und Ablehnungen sind kostenlos, sodass du nur für erfolgreiche Token-Generierung zahlst.
Anfragestruktur für unzensierte Antworten
Anfragen folgen dem standard OpenAI-Chat-Vervollständigungsformat. Du sendst ein JSON-Objekt mit model, messages und optionalen Parametern wie temperature, top_p und stop.
Um unzensierte Antworten zu erhalten, stelle sicher, dass dein Prompt klar und direkt ist. Das Modell ist darauf abgestimmt, ohne Inhaltsablehnungen für die rechtmäßige Erwachsenennutzung zu antworten, sodass ein gut formulierter Prompt die gewünschten Ergebnisse liefert. Es ist nicht notwendig, spezielle 'Jailbreak'-Prompts zu verwenden, es sei denn, du möchtest den Stil weiter steuern.
Die maximale Ausgabe beträgt 32.000 Token pro Anfrage oder 2.048, wenn max_tokens nicht festgelegt ist. Dies ermöglicht die Generierung von Langtexten in einem einzigen Aufruf.
Umgang mit Streaming und Token
Streaming wird über Server-Sent Events (SSE) unterstützt. So kannst du Token empfangen, sobald sie generiert werden, was die wahrgenommene Latenz für Nutzer reduziert. Der letzte Stream-Block enthält Token-Nutzungsinformationen, sodass du die Kosten genau verfolgen kannst.
Die Token-Nutzung wird basierend auf Input- und Output-Token berechnet. Input-Token werden mit 0,25 $ pro 1 Mio. Token berechnet, Output-Token mit 1,00 $ pro 1 Mio. Token. Fehler verbrauchen keine Token, sodass du für fehlgeschlagene Anfragen nicht belastet wirst.
Erweiterte Funktionen: Tools und JSON
Die API unterstützt Function Calling (Tools) und JSON-Modus. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt strukturierte Daten zurück, die analysiert und ausgeführt werden können. Dies ist nützlich für Automatisierungsaufgaben, bei denen das LLM mit anderen Systemen interagieren muss.
Der JSON-Modus stellt sicher, dass die Antwort gültiges JSON ist, was die Analyse in deiner Anwendung erleichtert. Du kannst den response_format auf {"type": "json_object"} setzen, um dies durchzusetzen.
Preise und Krypto-Abrechnung
Die Preise sind einfach: 0,25 $ pro 1 Mio. Input-Token und 1,00 $ pro 1 Mio. Output-Token. Es gibt keine monatlichen Abonnements oder versteckten Gebühren. Du zahlst nur für das, was du nutzt.
Aufladungen sind nur mit Krypto möglich. Du kannst USDT (TRC20) oder USDC (Base) verwenden. Die Mindestaufladung beträgt 10 $, die Höchstgrenze 500 $. Zahlungen über 50 $ erhalten einen 5-%-Bonus, Zahlungen über 100 $ einen 10-%-Bonus.
Das Guthaben verfällt nie, sodass du aufladen kannst, wenn es dir passt. Neue Konten erhalten 0,50 $ an Testguthaben, das 7 Tage gültig ist, ohne dass eine Karte benötigt wird.
Einschränkungen und Inhaltsrichtlinie
Die API ist nur für Textgenerierung ausgelegt. Sie unterstützt keine Embeddings, Bild-, Audio- oder Videogenerierung. Es gibt kein Fine-Tuning oder Modell-Routing. Dieser Fokus gewährleistet hohe Leistung und Einfachheit.
Die Inhaltsrichtlinie ist einfach: kein sexueller Inhalt, der Minderjährige betrifft. Alle anderen Erwachseneninhalte sind erlaubt. Das Modell ist nicht mit deinen Daten trainiert, also sind deine Prompts privat. Du hast die volle Kontrolle über den generierten Inhalt, innerhalb der Grenzen der Richtlinie.
Fehlerbehebung bei häufigen Problemen
Wenn du Fehler entdeckst, überprüfe deinen API-Schlüssel und das Anfrageformat. Stelle sicher, dass du die richtige Base URL und Model ID verwendest. Ratenlimits sind 300 Anfragen pro Minute und 8 parallele Anfragen pro Schlüssel. Wenn du diese Limits überschreitest, werden deine Anfragen abgelehnt, bis das Fenster zurückgesetzt wird.
Bei Abrechnungsfragen sieh dir die Support-Seite an. Guthaben wird nicht erstattet, aber Fehler wie doppelte Buchungen können korrigiert werden. Denk daran, dass das Guthaben verfällt nie, sodass du nicht hetzen musst.