Inicio rápido para usuarios de Qwen
Conecta tu cliente compatible con OpenAI existente a nuestro endpoint sin censura. Cambia la URL base, inyecta tu clave y empieza a enviar peticiones.
uncensoredhttps://api.qwenapi.cc/v1
En esta página
Autenticación y URL base
Nuestra API utiliza autenticación estándar con token Bearer. Recibes tu clave inmediatamente después de registrarte con Google o correo electrónico. Mantén esta clave segura; proporciona acceso a tu crédito prepago. La URL base para todas las peticiones es https://api.qwenapi.cc/v1. Actualiza la configuración de tu cliente para apuntar a este endpoint en lugar de la URL predeterminada de OpenAI.
La autenticación se maneja pasando el encabezado Authorization con cada petición. Sin una clave de API, el modelo no puede verificar el saldo de tu cuenta, lo que resulta en un error 401. No se requieren encabezados ocultos ni esquemas de autenticación personalizados.
Primera petición
Envía una petición estándar de completación de chat para probar la conectividad. Reemplaza YOUR_API_KEY con tu clave real. El endpoint acepta cargas útiles JSON estándar con los campos model, messages y content.
- Identificador del modelo:
uncensored - Endpoint:
POST /v1/chat/completions - Formato: JSON
Esta petición consumirá tokens de entrada de tu saldo. Asegúrate de que tu cliente maneje correctamente la respuesta JSON para verificar que la conexión está funcionando.
Integración con SDK de Python
Usa la biblioteca oficial de OpenAI para Python. Requiere configuración mínima para enrutar el tráfico a nuestro endpoint. Inicializa el cliente con tu clave y la URL base correcta. Este enfoque aprovecha las bases de código existentes sin reescribir la lógica de las peticiones.
Pasa el ID del modelo uncensored al crear la respuesta. La biblioteca maneja la serialización y deserialización automáticamente. Este método se recomienda para la mayoría de las integraciones de backend y flujos de trabajo basados en scripts.
Integración con SDK de Node.js
Para entornos de JavaScript o TypeScript, usa @anthropic-ai/sdk o el paquete estándar de OpenAI para Node. Configura la URL base para que apunte a nuestra API. Esto te permite integrar nuestro servicio en aplicaciones Node existentes sin una gran reestructuración.
Asegúrate de usar una versión reciente del SDK que admita URLs base personalizadas. Pasa el identificador del modelo uncensored para seleccionar nuestro modelo sin censura. Esta configuración funciona perfectamente con rutas de Express o funciones sin servidor.
Respuestas en streaming
Habilita el streaming estableciendo stream: true en tu petición. La API devuelve Server-Sent Events (SSE) a medida que el modelo genera texto. Esto proporciona menor latencia para los usuarios finales y permite la visualización en tiempo real de la salida.
Las estadísticas de uso de tokens se incluyen en el último fragmento del flujo. Procesa cada delta incrementalmente para construir la respuesta completa. Esta función es esencial para interfaces de chat y aplicaciones que requieren retroalimentación inmediata.
Límites, errores y contexto
Respeta los límites de peticiones para evitar interrupciones del servicio. La API permite 300 peticiones por minuto y 8 peticiones simultáneas por clave. El tamaño máximo del cuerpo de la petición es de 8 MB. Si excedes estos límites, recibirás un error 429.
Los errores de autenticación devuelven 401, lo que indica una clave inválida o faltante. Los errores de saldo devuelven 402, lo que significa que tu crédito prepago se ha agotado. La ventana de contexto admite 100.000 tokens en total, con un máximo de 32.000 tokens de salida por petición. Los errores y rechazos no consumen créditos.
cURL
curl https://api.qwenapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Preguntas y respuestas
¿Cómo manejo los límites de peticiones?
La API impone un límite de 300 peticiones por minuto y 8 peticiones simultáneas por clave. Si excedes estos límites, la API devuelve un código de estado 429. Implementa retroceso exponencial en tu cliente para gestionar los reintentos de forma adecuada.
¿La API admite llamadas a funciones?
Sí, la API admite llamadas a funciones mediante el formato estándar de herramientas. Puedes especificar herramientas y tool_choice en tu petición para habilitar la salida estructurada o la integración de herramientas externas. Esta función funciona con el esquema estándar compatible con OpenAI.
¿Qué ocurre si excedo mi ventana de contexto?
El modelo admite una ventana de contexto total de 100,000 tokens, incluyendo tanto el prompt como la completion. Si superas este límite, la petición fallará. Asegúrate de que tu aplicación controle el uso de tokens para mantenerse dentro de estos límites.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.
Ficha técnica de la API
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| ID del modelo | uncensored |
| Base URL | https://api.qwenapi.cc/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Concurrencia | 8 peticiones a la vez por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Límite de peticiones | 300 por minuto por clave |
| Tamaño de petición | hasta 8 MB |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Bono | +5 % desde $50, +10 % desde $100 |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |