Qwen उपयोगकर्ताओं के लिए क्विकस्टार्ट
अपने मौजूदा OpenAI-संगत क्लाइंट को हमारे बिना सेंसर एंडपॉइंट से कनेक्ट करें। बेस URL बदलें, अपनी कुंजी इंजेक्ट करें और अनुरोध भेजना शुरू करें।
uncensoredhttps://api.qwenapi.cc/v1
इस पेज पर
प्रमाणीकरण और बेस URL
हमारा API मानक Bearer टोकन प्रमाणीकरण का उपयोग करता है। Google या ईमेल के माध्यम से साइन अप करने के तुरंत बाद आपको अपनी कुंजी मिल जाती है। इस कुंजी को सुरक्षित रखें; यह आपके प्रीपेड क्रेडिट तक पहुंच प्रदान करती है। सभी अनुरोधों के लिए बेस यूआरएल https://api.qwenapi.cc/v1 है। अपने क्लाइंट कॉन्फ़िगरेशन को अपडेट करें ताकि यह डिफ़ॉल्ट OpenAI URL के बजाय इस एंडपॉइंट की ओर इशारा करे।
प्रत्येक अनुरोध के साथ Authorization हेडर पास करके प्रमाणीकरण संभाला जाता है। API कुंजी न होने का अर्थ है कि मॉडल आपके खाता शेष को सत्यापित नहीं कर सकता, जिससे 401 त्रुटि आती है। कोई छिपा हुआ हेडर या कस्टम प्रमाणीकरण योजना की आवश्यकता नहीं है।
पहला अनुरोध
कनेक्टिविटी परीक्षण करने के लिए एक मानक चैट कंप्लीशन अनुरोध भेजें। YOUR_API_KEY को अपनी वास्तविक कुंजी से बदलें। एंडपॉइंट model, messages और content फ़ील्ड्स के साथ मानक JSON पेलोड स्वीकार करता है।
- मॉडल पहचानकर्ता:
uncensored - एंडपॉइंट:
POST /v1/chat/completions - फॉर्मेट: JSON
यह अनुरोध आपके बैलेंस से इनपुट टोकन खर्द करेगा। सुनिश्चित करें कि आपका क्लाइंट JSON रिस्पॉन्स को सही तरीके से हैंडल करता है ताकि यह सत्यापित किया जा सके कि कनेक्शन काम कर रहा है।
Python SDK इंटीग्रेशन
आधिकारिक OpenAI Python लाइब्रेरी का उपयोग करें। इसे हमारे एंडपॉइंट पर ट्रैफ़िक भेजने के लिए न्यूनतम कॉन्फ़िगरेशन की आवश्यकता होती है। अपनी कुंजी और सही बेस URL के साथ क्लाइंट को प्रारंभ करें। यह मौजूदा कोडबेस का लाभ उठाता है बिना अनुरोध तर्क को फिर से लिखे।
प्रतिक्रिया बनाते समय मॉडल आईडी uncensored पास करें। लाइब्रेरी स्वचालित रूप से संयोजन और असंयोजन संभालती है। इस विधि को अधिकांश बैकएंड एकीकरण और स्क्रिप्ट-आधारित वर्कफ़्लो के लिए अनुशंसित किया जाता है।
Node SDK इंटीग्रेशन
JavaScript या TypeScript वातावरण के लिए, @anthropic-ai/sdk या मानक OpenAI Node पैकेज का उपयोग करें। बेस URL को हमारे API की ओर इशारा करने के लिए कॉन्फ़िगर करें। इससे आपको मौजूदा Node एप्लिकेशन में बिना बड़े रीफ़ैक्टरिंग के हमारी सेवा डालने की अनुमति मिलती है।
सुनिश्चित करें कि आप SDK के एक हालिया संस्करण का उपयोग कर रहे हैं जो कस्टम बेस URL का समर्थन करता है। हमारे बिना सेंसर मॉडल को चुनने के लिए मॉडल पहचानकर्ता uncensored पास करें। यह सेटअप Express राउट या सर्वरलेस फ़ंक्शन के साथ सहजता से काम करता है।
स्ट्रीमिंग रिस्पॉन्स
अपने अनुरोध में stream: true सेट करके स्ट्रीमिंग सक्षम करें। API टेक्स्ट जनरेट करते समय सर्वर-सेंट इवेंट्स (SSE) लौटाता है। यह अंत-उपयोगकर्ताओं के लिए कम लेटेंसी प्रदान करता है और आउटपुट की रियल-टाइम प्रदर्शित करने की अनुमति देता है।
टोकन उपयोग आंकड़े स्ट्रीम के अंतिम चंक में शामिल होते हैं। पूर्ण रिस्पॉन्स बनाने के लिए प्रत्येक डेल्टा को क्रमिक रूप से प्रोसेस करें। यह सुविधा चैट इंटरफ़ेस और तत्कल प्रतिक्रिया की आवश्यकता वाली एप्लिकेशन के लिए आवश्यक है।
सीमाएं, त्रुटियां और कॉन्टेक्स्ट
सर्विस विघटन से बचने के लिए रेट लिमिट का सम्मान करें। API प्रति मिनट 300 अनुरोध और प्रति कुंजी 8 समानांतर अनुरोध की अनुमति देता है। अधिकतम अनुरोध बॉडी साइज 8 MB है। यदि आप इन सीमाओं को पार करते हैं, तो आपको 429 त्रुटि प्राप्त होगी।
प्रमाणीकरण त्रुटियां 401 लौटाती हैं, जो एक अमान्य या अनुपलब्ध कुंजी को इंगित करती हैं। बैलेंस त्रुटियां 402 लौटाती हैं, जिसका अर्थ है कि आपका प्रीपेड क्रेडिट समाप्त हो गया है। कॉन्टेक्स्ट विंडो कुल 100,000 टोकन का समर्थन करती है, प्रति अनुरोध अधिकतम आउटपुट 32,000 टोकन है। त्रुटियां और रिफ्यूजल क्रेडिट खर्द नहीं करते हैं।
cURL
curl https://api.qwenapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);स्ट्रीमिंग
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)प्रश्न और उत्तर
मैं रेट लिमिटिंग को कैसे हैंडल करूं?
API प्रति मिनट 300 अनुरोधों और प्रति कुंजी 8 समानांतर अनुरोधों की सीमा लागू करता है। यदि आप इन सीमाओं को पार करते हैं, तो API 429 स्टेटस कोड लौटाता है। क्लाइंट में एक्सपोनेंशियल बैकऑफ लागू करें ताकि रीट्राइज़ को सहजता से हैंडल किया जा सके।
क्या API फ़ंक्शन कॉलिंग का समर्थन करता है?
हाँ, API मानक टूल्स फॉर्मेट के माध्यम से फ़ंक्शन कॉलिंग का समर्थन करता है। आप स्ट्रक्चर्ड आउटपुट या बाहरी टूल इंटीग्रेशन सक्षम करने के लिए अपने अनुरोध में tools और tool_choice निर्दिष्ट कर सकते हैं। यह सुविधा मानक OpenAI-संगत स्कीमा के साथ काम करती है।
यदि मैं अपनी कॉन्टेक्स्ट विंडो को पार कर जाता हूं तो क्या होता है?
मॉडल प्रॉम्प्ट और कंप्लीशन दोनों सहित 100,000 टोकन की कुल कॉन्टेक्स्ट विंडो का समर्थन करता है। यदि आप इस सीमा को पार करते हैं, तो अनुरोध विफल हो जाएगा। सुनिश्चित करें कि आपकी एप्लिकेशन टोकन उपयोग को ट्रैक करती है ताकि आप इन सीमाओं के भीतर रहें।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।
API विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| मॉडल ID | uncensored |
| Base URL | https://api.qwenapi.cc/v1 |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON मोड | response_format: {"type": "json_object"} |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| अनुरोध का आकार | 8 MB तक |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| बोनस | $50 से +5%, $100 से +10% |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
| साइन इन | Google या ईमेल और पासवर्ड |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |