DE ▾
API-Schlüssel erhalten

Schnellstart für Qwen-Nutzer

Verbinde deinen bestehenden OpenAI-kompatiblen Client mit unserem unzensierten Endpunkt. Ändere die Basis-URL, füge deinen Schlüssel ein und beginne mit dem Senden von Anfragen.

uncensoredhttps://api.qwenapi.cc/v1

Auf dieser Seite
  1. Authentifizierung und Basis-URL
  2. Erste Anfrage
  3. Python SDK-Integration
  4. Node SDK-Integration
  5. Streaming-Antworten
  6. Limits, Fehler und Kontext
  7. Fragen und Antworten
qwenapi.cc/docs/#text

Authentifizierung und Basis-URL

Unsere API verwendet die standardmäßige Bearer-Token-Authentifizierung. Du erhältst deinen Schlüssel sofort nach der Anmeldung über Google oder E-Mail. Bewahre diesen Schlüssel sicher auf; er gewährt Zugriff auf dein Prepaid-Guthaben. Die Basis-URL für alle Anfragen ist https://api.qwenapi.cc/v1. Aktualisiere die Konfiguration deines Clients, um diesen Endpunkt statt der Standard-OpenAI-URL zu verwenden.

Die Authentifizierung erfolgt durch Übergeben des Authorization-Headers bei jeder Anfrage. Ohne API-Schlüssel kann das Modell deinen Kontostand nicht verifizieren, was zu einem 401-Fehler führt. Es werden keine versteckten Header oder benutzerdefinierten Authentifizierungsschemata benötigt.

Erste Anfrage

Sende eine Standard-Chat-Completion-Anfrage, um die Konnektivität zu testen. Ersetze YOUR_API_KEY durch deinen tatsächlichen Schlüssel. Der Endpunkt akzeptiert standardmäßige JSON-Payloads mit den Feldern model, messages und content.

  • Modellkennung: uncensored
  • Endpunkt: POST /v1/chat/completions
  • Format: JSON

Diese Anfrage verbraucht Input-Token von deinem Guthaben. Stelle sicher, dass dein Client die JSON-Antwort korrekt verarbeitet, um zu überprüfen, ob die Verbindung funktioniert.

Python SDK-Integration

Verwende die offizielle OpenAI Python-Bibliothek. Sie erfordert minimale Konfiguration, um den Datenverkehr zu unserem Endpunkt zu leiten. Initialisiere den Client mit deinem Schlüssel und der korrekten Basis-URL. Dieser Ansatz nutzt bestehende Codebasen aus, ohne die Anfrage-Logik neu schreiben zu müssen.

Gib die Modellkennung uncensored beim Erstellen der Antwort an. Die Bibliothek übernimmt Serialisierung und Deserialisierung automatisch. Diese Methode wird für die meisten Backend-Integrationen und skriptbasierten Workflows empfohlen.

Node SDK-Integration

Für JavaScript- oder TypeScript-Umgebungen verwende das @anthropic-ai/sdk oder das Standard-OpenAI Node-Paket. Konfiguriere die Basis-URL so, dass sie auf unsere API verweist. Dies ermöglicht es dir, unseren Dienst ohne große Refaktorierung in bestehende Node-Anwendungen zu integrieren.

Stelle sicher, dass du eine aktuelle Version des SDK verwendest, die benutzerdefinierte Basis-URLs unterstützt. Übergebe die Modellkennung uncensored, um unser unzensiertes Modell auszuwählen. Dieses Setup funktioniert nahtlos mit Express-Routen oder serverlosen Funktionen.

Streaming-Antworten

Aktiviere Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt Server-Sent Events (SSE) zurück, während das Modell Text generiert. Dies bietet geringere Latenz für Endnutzer und ermöglicht die Echtzeitanzeige von Ausgaben.

Token-Nutzungsstatistiken sind im letzten Chunk des Streams enthalten. Verarbeite jeden Delta inkrementell, um die vollständige Antwort zu erstellen. Diese Funktion ist für Chat-Schnittstellen und Anwendungen erforderlich, die sofortiges Feedback benötigen.

Limits, Fehler und Kontext

Respektiere die Ratenlimits, um Dienstunterbrechungen zu vermeiden. Die API erlaubt 300 Anfragen pro Minute und 8 parallele Anfragen pro Schlüssel. Die maximale Größe des Anfragekörpers beträgt 8 MB. Wird dieses Limit überschritten, erhältst du einen 429-Fehler.

Authentifizierungsfehler geben 401 zurück, was einen ungültigen oder fehlenden Schlüssel anzeigt. Kontostandfehler geben 402 zurück, was bedeutet, dass dein Prepaid-Guthaben aufgebraucht ist. Das Kontextfenster unterstützt insgesamt 100.000 Token, mit maximal 32.000 Token pro Anfrage. Fehler und Refusals verbrauchen kein Guthaben.

cURL

curl https://api.qwenapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)
qwenapi.cc/docs/#s1

Fragen und Antworten

Wie gehe ich mit Ratenlimits um?

Die API legt ein Limit von 300 Anfragen pro Minute und 8 parallelen Anfragen pro Schlüssel fest. Wenn du diese Limits überschreitest, gibt die API den Statuscode 429 zurück. Implementiere eine exponentielle Backoff-Strategie in deinem Client, um Wiederholungen korrekt zu behandeln.

Unterstützt die API Function Calling?

Ja, die API unterstützt Function Calling über das Standard-Tools-Format. Du kannst tools und tool_choice in deiner Anfrage angeben, um strukturierte Ausgaben oder externe Tool-Integrationen zu aktivieren. Diese Funktion funktioniert mit dem Standard-Schema für OpenAI-Kompatibilität.

Was passiert, wenn ich mein Kontextfenster überschreite?

Das Modell unterstützt ein Gesamtkontextfenster von 100.000 Token, einschließlich sowohl Prompt als auch Completion. Wenn du dieses Limit überschreitest, schlägt die Anfrage fehl. Stelle sicher, dass deine Anwendung die Token-Nutzung verfolgt, um innerhalb dieser Grenzen zu bleiben.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten

API-Spezifikation

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Modell-IDuncensored
Base-URLhttps://api.qwenapi.cc/v1
EndpunktePOST /v1/chat/completions · GET /v1/models
AuthentifizierungAuthorization: Bearer YOUR_KEY
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-Modusresponse_format: {"type": "json_object"}
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Ratenlimit300 Anfragen pro Minute und Schlüssel
Anfragegrößebis 8 MB
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Bonus+5 % ab $50, +10 % ab $100
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen