Schnellstart für Qwen-Nutzer
Verbinde deinen bestehenden OpenAI-kompatiblen Client mit unserem unzensierten Endpunkt. Ändere die Basis-URL, füge deinen Schlüssel ein und beginne mit dem Senden von Anfragen.
uncensoredhttps://api.qwenapi.cc/v1
Auf dieser Seite
Authentifizierung und Basis-URL
Unsere API verwendet die standardmäßige Bearer-Token-Authentifizierung. Du erhältst deinen Schlüssel sofort nach der Anmeldung über Google oder E-Mail. Bewahre diesen Schlüssel sicher auf; er gewährt Zugriff auf dein Prepaid-Guthaben. Die Basis-URL für alle Anfragen ist https://api.qwenapi.cc/v1. Aktualisiere die Konfiguration deines Clients, um diesen Endpunkt statt der Standard-OpenAI-URL zu verwenden.
Die Authentifizierung erfolgt durch Übergeben des Authorization-Headers bei jeder Anfrage. Ohne API-Schlüssel kann das Modell deinen Kontostand nicht verifizieren, was zu einem 401-Fehler führt. Es werden keine versteckten Header oder benutzerdefinierten Authentifizierungsschemata benötigt.
Erste Anfrage
Sende eine Standard-Chat-Completion-Anfrage, um die Konnektivität zu testen. Ersetze YOUR_API_KEY durch deinen tatsächlichen Schlüssel. Der Endpunkt akzeptiert standardmäßige JSON-Payloads mit den Feldern model, messages und content.
- Modellkennung:
uncensored - Endpunkt:
POST /v1/chat/completions - Format: JSON
Diese Anfrage verbraucht Input-Token von deinem Guthaben. Stelle sicher, dass dein Client die JSON-Antwort korrekt verarbeitet, um zu überprüfen, ob die Verbindung funktioniert.
Python SDK-Integration
Verwende die offizielle OpenAI Python-Bibliothek. Sie erfordert minimale Konfiguration, um den Datenverkehr zu unserem Endpunkt zu leiten. Initialisiere den Client mit deinem Schlüssel und der korrekten Basis-URL. Dieser Ansatz nutzt bestehende Codebasen aus, ohne die Anfrage-Logik neu schreiben zu müssen.
Gib die Modellkennung uncensored beim Erstellen der Antwort an. Die Bibliothek übernimmt Serialisierung und Deserialisierung automatisch. Diese Methode wird für die meisten Backend-Integrationen und skriptbasierten Workflows empfohlen.
Node SDK-Integration
Für JavaScript- oder TypeScript-Umgebungen verwende das @anthropic-ai/sdk oder das Standard-OpenAI Node-Paket. Konfiguriere die Basis-URL so, dass sie auf unsere API verweist. Dies ermöglicht es dir, unseren Dienst ohne große Refaktorierung in bestehende Node-Anwendungen zu integrieren.
Stelle sicher, dass du eine aktuelle Version des SDK verwendest, die benutzerdefinierte Basis-URLs unterstützt. Übergebe die Modellkennung uncensored, um unser unzensiertes Modell auszuwählen. Dieses Setup funktioniert nahtlos mit Express-Routen oder serverlosen Funktionen.
Streaming-Antworten
Aktiviere Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt Server-Sent Events (SSE) zurück, während das Modell Text generiert. Dies bietet geringere Latenz für Endnutzer und ermöglicht die Echtzeitanzeige von Ausgaben.
Token-Nutzungsstatistiken sind im letzten Chunk des Streams enthalten. Verarbeite jeden Delta inkrementell, um die vollständige Antwort zu erstellen. Diese Funktion ist für Chat-Schnittstellen und Anwendungen erforderlich, die sofortiges Feedback benötigen.
Limits, Fehler und Kontext
Respektiere die Ratenlimits, um Dienstunterbrechungen zu vermeiden. Die API erlaubt 300 Anfragen pro Minute und 8 parallele Anfragen pro Schlüssel. Die maximale Größe des Anfragekörpers beträgt 8 MB. Wird dieses Limit überschritten, erhältst du einen 429-Fehler.
Authentifizierungsfehler geben 401 zurück, was einen ungültigen oder fehlenden Schlüssel anzeigt. Kontostandfehler geben 402 zurück, was bedeutet, dass dein Prepaid-Guthaben aufgebraucht ist. Das Kontextfenster unterstützt insgesamt 100.000 Token, mit maximal 32.000 Token pro Anfrage. Fehler und Refusals verbrauchen kein Guthaben.
cURL
curl https://api.qwenapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Fragen und Antworten
Wie gehe ich mit Ratenlimits um?
Die API legt ein Limit von 300 Anfragen pro Minute und 8 parallelen Anfragen pro Schlüssel fest. Wenn du diese Limits überschreitest, gibt die API den Statuscode 429 zurück. Implementiere eine exponentielle Backoff-Strategie in deinem Client, um Wiederholungen korrekt zu behandeln.
Unterstützt die API Function Calling?
Ja, die API unterstützt Function Calling über das Standard-Tools-Format. Du kannst tools und tool_choice in deiner Anfrage angeben, um strukturierte Ausgaben oder externe Tool-Integrationen zu aktivieren. Diese Funktion funktioniert mit dem Standard-Schema für OpenAI-Kompatibilität.
Was passiert, wenn ich mein Kontextfenster überschreite?
Das Modell unterstützt ein Gesamtkontextfenster von 100.000 Token, einschließlich sowohl Prompt als auch Completion. Wenn du dieses Limit überschreitest, schlägt die Anfrage fehl. Stelle sicher, dass deine Anwendung die Token-Nutzung verfolgt, um innerhalb dieser Grenzen zu bleiben.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.
API-Spezifikation
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Modell-ID | uncensored |
| Base-URL | https://api.qwenapi.cc/v1 |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Anfragegröße | bis 8 MB |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |