Unfiltered AI Chatbot: Schnellstart: Integriere die unzensierte LLM-API
Integriere unsere unzensierte LLM-API in Minuten mit standardmäßigen OpenAI-kompatiblen Clients. Diese Anleitung behandelt Authentifizierung, Vervollständigungsanfragen, Streaming und Tool-Nutzung ohne Inhaltsfilter.
Basis-URL & Authentifizierung
Starte die Integration, indem du deinen Client auf die Basis-URL https://api.unfilteredaichatbot.cc/v1 richtest. Die API folgt der Standard-OpenAI-Chat-Vervollständigungsstruktur, sodass du vorhandene SDKs nutzen kannst, indem du einfach die Basis-URL aktualisierst und deinen API-Schlüssel angibst.
Die Authentifizierung erfolgt über den Authorization-Header. Füge deinen eindeutigen Schlüssel im Format Bearer YOUR_API_KEY ein. Das System validiert diesen Schlüssel bei jeder Anfrage. Wenn der Schlüssel fehlt oder ungültig ist, erhältst du einen 401-Fehler. Jedes Konto ist auf einen aktiven Schlüssel beschränkt; das Generieren eines neuen Schlüssels macht den vorherigen sofort ungültig. Dies gewährleistet eine einfache Zugriffskontrolle ohne komplexe Berechtigungsstrukturen.
Der API-Schlüssel wird sofort nach der Anmeldung über Google oder E-Mail angezeigt. Keine Telefonnummer erforderlich, und der Schlüssel bleibt gültig, solange dein Prepaid-Guthaben die Nutzung deckt. Fehler und Ablehnungen verbrauchen kein Guthaben, sodass du die Authentifizierung sicher testen kannst.
Basis-Vervollständigungsanfrage
Sende eine POST-Anfrage an /v1/chat/completions mit deiner Modell-ID auf uncensored. Der Payload erfordert ein messages-Array, das deinen Gesprächsverlauf enthält. Dieser Endpunkt akzeptiert Texteingaben und gibt Textausgaben zurück und hält sich strikt an das Chat-Vervollständigungsformat.
Unten findest du ein Standard-curl-Beispiel, das eine einfache Zwei-Wechsel-Gesprächssimulation zeigt. Das Modell antwortet, ohne erwachsene oder kontroverse Themen zu blockieren, solange sie gesetzlich zulässig sind. Stelle sicher, dass du das Feld model explizit angibst, um die richtige unzensierte Instanz zu treffen.
Für Python-Entwickler funktioniert das offizielle OpenAI SDK sofort. Initialisiere den Client einfach mit deiner Basis-URL und deinem Schlüssel.
from openai import OpenAI
client = OpenAI(base_url="https://api.unfilteredaichatbot.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Und für Node.js-Nutzer gilt die gleiche Struktur. Initialisiere den Client und rufe chat.completions.create auf.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unfilteredaichatbot.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-Antworten
Aktiviere das Streaming, indem du stream: true in deinem Anfrage-Payload festlegst. Die API gibt einen Server-Sent Events (SSE)-Stream zurück, der Token inkrementell liefert, sobald sie generiert werden. Dies ist ideal für Echtzeit-Benutzeroberflächen, bei denen Latenz wichtig ist.
Das letzte Paket des Streams enthält die vollständigen Nutzungsstatistiken, einschließlich der Anzahl der Input- und Output-Token. Du kannst diese Daten verwenden, um deine Benutzeroberfläche zu aktualisieren oder die Abrechnung genau zu verfolgen. Beachte, dass die Token-Nutzung nur im letzten Paket gemeldet wird, daher musst du den gesamten Stream parsen, um genaue Zählwerte zu erhalten.
Hier ist ein curl-Beispiel, das die Streaming-Anfragestruktur zeigt. Ersetze den Platzhalter durch deinen tatsächlichen Schlüssel und den Nachrichteninhalt.
curl https://api.unfilteredaichatbot.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Streaming hat keinen Einfluss auf die Preise oder Ratenlimits; jedes generierte Token zählt weiterhin zu deiner Nutzung und deinen Limits.
Function Calling
Die API unterstützt Function Calling über die Parameter tools und tool_choice. Definiere deine Funktionen im tools-Array, und das Modell gibt bei Bedarf strukturiertes JSON zurück. Du kannst die Tool-Nutzung erzwingen, indem du tool_choice auf eine bestimmte Funktion oder auto für die Modellentscheidung setzt.
Diese Funktion funktioniert im selben unzensierten Kontext, was bedeutet, dass das Modell keine Tools für erwachsene oder Nischenthemen aufrufen wird, es sei denn, sie verletzen die harte Inhaltsgrenze. Verwende response_format mit {"type": "json_object"}, wenn du eine strenge JSON-Ausgabe zur Analyse benötigst.
Function Calling ist Teil des Standard-Chat-Vervollständigungs-Endpunkts, sodass keine zusätzliche Konfiguration neben dem Anfrage-Payload erforderlich ist. Stelle sicher, dass deine Funktionsdefinitionen dem OpenAI-Schema-Format entsprechen, um Kompatibilität zu gewährleisten.
JSON-Modus
Für Anwendungen, die strukturierte Daten benötigen, setze response_format auf {"type": "json_object"}. Dies weist das Modell an, gültiges JSON auszugeben, was Parsing-Fehler in deinen nachgelagerten Systemen reduziert. Dieser Modus ist nützlich zum Extrahieren von Daten, Generieren von Konfigurationen oder zum Ansteuern von Agent-Workflows.
Der JSON-Modus funktioniert neben Function Calling, kann aber auch für direkte Text-zu-JSON-Konvertierungen verwendet werden. Das Modell ist unzensiert, sodass es JSON auch für komplexe oder ungewöhnliche Datenstrukturen generiert, ohne aufgrund von Inhaltsfiltern abzulehnen.
Denke daran, dass der JSON-Modus weiterhin zu deinen Token-Limits und der Abrechnung zählt. Stelle sicher, dass dein Prompt die JSON-Struktur klar definiert, um die Ausgabequalität zu verbessern. Das Kontextfenster mit 100.000 Token gilt für die gesamte Eingabe und Ausgabe zusammen.
Ratenlimits & Fehler
Jeder API-Schlüssel ist auf 300 Anfragen pro Minute und 8 gleichzeitige Anfragen begrenzt. Der Anfragetext darf 8 MB nicht überschreiten. Wenn du das Ratenlimit überschreitest, gibt die API einen 429-Fehler zurück. Wenn dein Guthaben aufgebraucht ist, erhältst du einen 402-Fehler. Authentifizierungsfehler führen zu einem 401-Fehler.
Das Kontextfenster umfasst insgesamt 100.000 Token, mit einer maximalen Ausgabe von 32.000 Token pro Anfrage (2.048, wenn max_tokens nicht festgelegt ist). Fehler und Ablehnungen sind kostenlos, sodass du Grenzen testen kannst, ohne Guthaben zu verbrauchen. Das Guthaben verfällt nie, und Prepaid-Beträge werden basierend auf der tatsächlichen Nutzung berechnet.
Für detaillierte Fehlerbehandlungen prüfe die Statuscodes. Ein 401 weist auf einen ungültigen oder fehlenden Schlüssel hin, während 402 eine Aufladung erfordert. Nutze die Support-Seite, um Abrechnungsprobleme zu lösen. Für das Testguthaben wird keine Karte benötigt, für Aufladungen ist jedoch Krypto erforderlich.
Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Funktionen und Limits
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.unfilteredaichatbot.cc/v1 |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| JSON-Modus | response_format: {"type": "json_object"} |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Anfragegröße | bis 8 MB |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Wie bekomme ich einen API-Schlüssel?
Registriere dich über „Weiter mit Google“ oder E-Mail und Passwort auf der Seite API-Schlüssel erhalten. Dein Schlüssel wird sofort nach der Registrierung angezeigt. Keine Telefonnummer erforderlich, der Schlüssel ist sofort aktiv.
Was passiert, wenn ich mein Ratenlimit überschreite?
Die API gibt einen 429-Fehler zurück. Jeder Schlüssel erlaubt 300 Anfragen pro Minute und 8 parallele Anfragen. Fehler und Ablehnungen werden nicht von deinem Guthaben abgezogen, zählen aber zum Ratenlimit.
Ist das Testguthaben erneuerbar?
Nein, das kostenlose Testguthaben in Höhe von 0,50 $ ist einmalig pro Person gültig und 7 Tage lang. Nach Ablauf oder Verbrauch musst du mit Krypto (USDT TRC20 oder USDC Base) aufladen, um die API weiterhin nutzen zu können.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.