IT ▾
Ottieni la chiave API

Guida rapida per gli utenti Qwen

Collega il tuo client compatibile con OpenAI esistente al nostro endpoint senza censura. Modifica l'URL di base, inietta la tua chiave e inizia a inviare richieste.

uncensoredhttps://api.qwenapi.cc/v1

In questa pagina
  1. Autenticazione e URL di base
  2. Prima richiesta
  3. Integrazione SDK Python
  4. Integrazione SDK Node.js
  5. Risposte in streaming
  6. Limiti, errori e contesto
  7. Domande e risposte
qwenapi.cc/docs/#text

Autenticazione e URL di base

La nostra API utilizza l'autenticazione standard con token Bearer. Ricevi la tua chiave immediatamente dopo esserti registrato tramite Google o email. Conserva questa chiave in modo sicuro; garantisce l'accesso al tuo credito prepagato. L'URL di base per tutte le richieste è https://api.qwenapi.cc/v1. Aggiorna la configurazione del tuo client per puntare a questo endpoint invece dell'URL predefinito di OpenAI.

L'autenticazione viene gestita passando l'intestazione Authorization con ogni richiesta. Senza una chiave API, il modello non può verificare il saldo del tuo account, risultando in un errore 401. Non sono necessarie intestazioni nascoste o schemi di autenticazione personalizzati.

Prima richiesta

Invia una richiesta standard di completamento chat per testare la connettività. Sostituisci YOUR_API_KEY con la tua chiave effettiva. L'endpoint accetta payload JSON standard con i campi model, messages e content.

  • Identificatore del modello: uncensored
  • Endpoint: POST /v1/chat/completions
  • Formato: JSON

Questa richiesta consumerà token di input dal tuo saldo. Assicurati che il tuo client gestisca correttamente la risposta JSON per verificare che la connessione funzioni.

Integrazione SDK Python

Utilizza la libreria ufficiale Python di OpenAI. Richiede una configurazione minima per instradare il traffico verso il nostro endpoint. Inizializza il client con la tua chiave e l'URL di base corretto. Questo approccio sfrutta le codebase esistenti senza riscrivere la logica delle richieste.

Passa l'ID del modello uncensored quando crei la risposta. La libreria gestisce automaticamente la serializzazione e la deserializzazione. Questo metodo è consigliato per la maggior parte delle integrazioni backend e dei flussi di lavoro basati su script.

Integrazione SDK Node.js

Per gli ambienti JavaScript o TypeScript, utilizza il pacchetto @anthropic-ai/sdk o quello standard di OpenAI per Node. Configura l'URL di base per puntare alla nostra API. Questo ti permette di integrare il nostro servizio nelle applicazioni Node esistenti senza un importante refactoring.

Assicurati di utilizzare una versione recente dell'SDK che supporti gli URL di base personalizzati. Passa l'identificatore del modello uncensored per selezionare il nostro modello senza censura. Questa configurazione funziona perfettamente con le route Express o le funzioni serverless.

Risposte in streaming

Abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce Server-Sent Events (SSE) mentre il modello genera testo. Questo fornisce una latenza inferiore per gli utenti finali e consente la visualizzazione in tempo reale dell'output.

Le statistiche sull'utilizzo dei token sono incluse nell'ultimo chunk dello streaming. Elabora ogni delta in modo incrementale per costruire la risposta completa. Questa funzione è essenziale per le interfacce chat e le applicazioni che richiedono feedback immediato.

Limiti, errori e contesto

Rispetta i limiti di richiesta per evitare interruzioni del servizio. L'API consente 300 richieste al minuto e 8 richieste parallele per chiave. La dimensione massima del corpo della richiesta è di 8 MB. Se superi questi limiti, riceverai un errore 429.

Gli errori di autenticazione restituiscono 401, indicando una chiave non valida o mancante. Gli errori di saldo restituiscono 402, il che significa che il tuo credito prepagato è esaurito. La finestra di contesto supporta 100.000 token in totale, con un output massimo di 32.000 token per richiesta. Errori e rifiuti non consumano crediti.

cURL

curl https://api.qwenapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)
qwenapi.cc/docs/#s1

Domande e risposte

Come gestisco il limite di richieste?

L'API impone un limite di 300 richieste al minuto e 8 richieste parallele per chiave. Se superi questi limiti, l'API restituisce un codice di stato 429. Implementa un backoff esponenziale nel tuo client per gestire i ritentativi in modo elegante.

L'API supporta la chiamata di funzioni?

Sì, l'API supporta la chiamata di funzioni tramite il formato standard degli strumenti. Puoi specificare strumenti e tool_choice nella tua richiesta per abilitare l'output strutturato o l'integrazione con strumenti esterni. Questa funzionalità funziona con lo schema standard compatibile con OpenAI.

Cosa succede se supero la mia finestra di contesto?

Il modello supporta una finestra di contesto totale di 100.000 token, inclusi sia prompt che completamento. Se superi questo limite, la richiesta fallirà. Assicurati che la tua applicazione tenga traccia dell'utilizzo dei token per rimanere entro questi limiti.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
ID modellouncensored
Base URLhttps://api.qwenapi.cc/v1
EndpointPOST /v1/chat/completions · GET /v1/models
AutenticazioneAuthorization: Bearer YOUR_KEY
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Finestra di contesto100.000 token (input + output)
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Modalità JSONresponse_format: {"type": "json_object"}
Concorrenza8 richieste contemporanee per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite di frequenza300 richieste al minuto per chiave
Dimensionefino a 8 MB per richiesta
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Bonus+5% da $50, +10% da $100
Scadenzail credito pagato non scade, nessun abbonamento
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
AccessoGoogle oppure e-mail e password
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi