VI ▾
Lấy khóa API

Hướng dẫn nhanh cho người dùng Qwen

Kết nối client tương thích OpenAI hiện có của bạn với endpoint không kiểm duyệt của chúng tôi. Thay đổi URL cơ sở, chèn khóa của bạn và bắt đầu gửi yêu cầu.

uncensoredhttps://api.qwenapi.cc/v1

Trên trang này
  1. Xác thực và URL cơ sở
  2. Yêu cầu đầu tiên
  3. Tích hợp Python SDK
  4. Tích hợp Node SDK
  5. Phản hồi truyền phát
  6. Giới hạn, Lỗi và Ngữ cảnh
  7. Hỏi đáp
qwenapi.cc/docs/#text

Xác thực và URL cơ sở

API của chúng tôi sử dụng xác thực token Bearer tiêu chuẩn. Bạn nhận được khóa của mình ngay sau khi đăng ký qua Google hoặc email. Hãy giữ khóa này an toàn; nó cung cấp quyền truy cập vào tín dụng trả trước của bạn. URL cơ sở cho tất cả các yêu cầu là https://api.qwenapi.cc/v1. Cập nhật cấu hình client của bạn để trỏ đến endpoint này thay vì URL OpenAI mặc định.

Xác thực được xử lý bằng cách chuyển tiêu đề Authorization với mọi yêu cầu. Không có khóa API thì mô hình không thể xác minh số dư tài khoản của bạn, dẫn đến lỗi 401. Không có tiêu đề ẩn hoặc lược đồ xác thực tùy chỉnh nào được yêu cầu.

Yêu cầu đầu tiên

Gửi một yêu cầu hoàn thành trò chuyện tiêu chuẩn để kiểm tra kết nối. Thay thế YOUR_API_KEY bằng khóa thực tế của bạn. Endpoint chấp nhận các tải trọng JSON tiêu chuẩn với các trường model, messages và content.

  • Mã định danh mô hình: uncensored
  • Endpoint: POST /v1/chat/completions
  • Định dạng: JSON

Yêu cầu này sẽ tiêu thụ token đầu vào từ số dư của bạn. Hãy đảm bảo client của bạn xử lý phản hồi JSON đúng cách để xác minh kết nối đang hoạt động.

Tích hợp Python SDK

Sử dụng thư viện Python OpenAI chính thức. Nó yêu cầu cấu hình tối thiểu để định tuyến lưu lượng truy cập đến endpoint của chúng tôi. Khởi tạo client với khóa của bạn và URL cơ sở chính xác. Cách tiếp cận này tận dụng các cơ sở mã hiện có mà không cần viết lại logic yêu cầu.

Chuyển mã định danh mô hình uncensored khi tạo phản hồi. Thư viện tự động xử lý việc tuần tự hóa và giải tuần tự hóa. Phương pháp này được khuyến nghị cho hầu hết các tích hợp backend và quy trình dựa trên kịch bản.

Tích hợp Node SDK

Đối với môi trường JavaScript hoặc TypeScript, hãy sử dụng @anthropic-ai/sdk hoặc gói Node OpenAI tiêu chuẩn. Cấu hình URL cơ sở để trỏ đến API của chúng tôi. Điều này cho phép bạn đưa dịch vụ của chúng tôi vào các ứng dụng Node hiện có mà không cần tái cấu trúc lớn.

Hãy đảm bảo bạn đang sử dụng phiên bản SDK gần đây hỗ trợ URL cơ sở tùy chỉnh. Chuyển mã định danh mô hình uncensored để chọn mô hình không kiểm duyệt của chúng tôi. Cấu hình này hoạt động liền mạch với các tuyến Express hoặc các hàm serverless.

Phản hồi truyền phát

Bật truyền phát bằng cách đặt stream: true trong yêu cầu của bạn. API trả về các sự kiện được gửi qua máy chủ (SSE) khi mô hình tạo văn bản. Điều này cung cấp độ trễ thấp hơn cho người dùng cuối và cho phép hiển thị đầu ra theo thời gian thực.

Thống kê sử dụng token được bao gồm trong phần cuối cùng của luồng. Hãy xử lý từng phần tăng dần để xây dựng phản hồi hoàn chỉnh. Tính năng này rất cần thiết cho các giao diện trò chuyện và các ứng dụng yêu cầu phản hồi ngay lập tức.

Giới hạn, Lỗi và Ngữ cảnh

Hãy tôn trọng các giới hạn tốc độ để tránh gián đoạn dịch vụ. API cho phép 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời mỗi khóa. Kích thước tối đa của thân yêu cầu là 8 MB. Nếu bạn vượt quá các giới hạn này, bạn sẽ nhận được lỗi 429.

Lỗi xác thực trả về 401, cho biết khóa không hợp lệ hoặc bị thiếu. Lỗi số dư trả về 402, có nghĩa là tín dụng trả trước của bạn đã hết. Cửa sổ ngữ cảnh hỗ trợ tổng cộng 100.000 token, với tối đa 32.000 token đầu ra mỗi yêu cầu. Lỗi và từ chối không tiêu thụ tín dụng.

cURL

curl https://api.qwenapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Truyền phát

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)
qwenapi.cc/docs/#s1

Hỏi đáp

Làm thế nào để xử lý giới hạn tốc độ?

API áp dụng giới hạn 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời mỗi khóa. Nếu bạn vượt quá giới hạn này, API sẽ trả về mã trạng thái 429. Hãy triển khai cơ chế backoff theo cấp số nhân trong client của bạn để xử lý việc thử lại một cách mượt mà.

API có hỗ trợ gọi hàm không?

Có, API hỗ trợ gọi hàm thông qua định dạng tools tiêu chuẩn. Bạn có thể chỉ định tools và tool_choice trong yêu cầu của mình để kích hoạt đầu ra có cấu trúc hoặc tích hợp công cụ bên ngoài. Tính năng này hoạt động với lược đồ tương thích OpenAI tiêu chuẩn.

Điều gì xảy ra nếu tôi vượt quá cửa sổ ngữ cảnh của mình?

Mô hình hỗ trợ tổng cộng 100.000 token cho cửa sổ ngữ cảnh, bao gồm cả prompt và completion. Nếu bạn vượt quá giới hạn này, yêu cầu sẽ thất bại. Hãy đảm bảo ứng dụng của bạn theo dõi việc sử dụng token để duy trì trong các giới hạn này.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ quá trình thiết lập.

Lấy khóa API

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
ID mô hìnhuncensored
Base URLhttps://api.qwenapi.cc/v1
EndpointPOST /v1/chat/completions · GET /v1/models
Xác thựcAuthorization: Bearer YOUR_KEY
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Chế độ JSONresponse_format: {"type": "json_object"}
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Thưởng+5% từ $50, +10% từ $100
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây