API de Venice AI: primera petición en cinco minutos
Pon en marcha tu LLM sin censura en menos de cinco minutos con esta guía rápida de la API de Venice AI. Usa los endpoints compatibles con OpenAI para enviar texto, transmitir respuestas y llamar a funciones con precios transparentes de pago por uso.
https://api.veniceapialternative.com/v1
URL base y autenticación
Empieza creando una cuenta en la página Obtener clave de API. Solo necesitas un correo electrónico y una contraseña; no se requiere tarjeta de crédito para recibir el crédito de prueba de $0.50 válido por siete días. Tu clave de API se muestra inmediatamente después del registro y puedes regenerarla en cualquier momento, lo que invalida la clave anterior.
Usa la URL base https://api.veniceapialternative.com/v1 con los SDKs oficiales de OpenAI o cualquier cliente compatible con OpenAI. Establece tu clave de API como token Bearer en el encabezado Authorization. Este endpoint venice ai api reemplaza la URL base predeterminada de OpenAI en la configuración de tu cliente.
Primera petición
Envía una petición simple de chat completion para probar la conexión. El ID del modelo es siempre uncensored. Este modelo de pesos abiertos se ejecuta en nuestros servidores GPU y está ajustado para responder sin rechazos de contenido para uso adulto lícito.
Reemplaza YOUR_API_KEY con tu clave real. La respuesta devuelve texto basado en tu prompt.
curl https://api.veniceapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Ejemplo con SDK de Python
Instala la biblioteca de Python de OpenAI y configúrala para usar nuestra URL base. Esto te permite aprovechar codebases existentes que esperan endpoints de OpenAI.
from openai import OpenAI
client = OpenAI(base_url="https://api.veniceapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Ejemplo con SDK de Node.js
Para entornos Node.js, usa el paquete openai. Inicializa el cliente con la URL base personalizada y tu clave de API. Esto asegura que todas las peticiones se enruten a través de la infraestructura venice ai api.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.veniceapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respuestas en streaming
Habilita el streaming estableciendo stream: true en tu petición. La API devuelve Server-Sent Events (SSE) para la entrega de tokens en tiempo real. Esto es útil para interfaces de chat que necesitan mostrar texto a medida que se genera.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Límites de peticiones y restricciones
El modelo uncensored admite una ventana de contexto de 100,000 tokens para prompt y completion combinados. Estás limitado a 300 peticiones por minuto por clave de API. Los cuerpos de las peticiones no deben exceder 8 MB.
Los errores comunes incluyen 401 (clave inválida), 402 (crédito insuficiente) y 429 (límite de peticiones excedido). Recarga tu crédito prepago desde $10; los créditos no caducan. No hay suscripción mensual que limite tu uso.
Ficha técnica de la API
Una tabla con cada límite, función y precio.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID del modelo | uncensored |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.veniceapialternative.com/v1 |
| Modo JSON | response_format: {"type": "json_object"} |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Tamaño de petición | hasta 8 MB |
| Concurrencia | 8 peticiones a la vez por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Límite de peticiones | 300 por minuto por clave |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Bono | +5 % desde $50, +10 % desde $100 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Acceso | Google o correo y contraseña |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Es esta la API oficial de Venice.ai?
No. Este es un servicio independiente que aloja un modelo de pesos abiertos sin censura. No está afiliado ni es revendedor de la plataforma principal de Venice.ai ni de los modelos de ningún otro proveedor.
¿Esta API admite generación de imágenes o audio?
No. Esta es una API de chat completion solo de texto. No admite embeddings, generación de imágenes, audio, video ni fine-tuning.
¿Qué pasa si caduca mi crédito de prueba?
Tu crédito de prueba caduca después de siete días. Puedes recargar con cripto (USDT o USDC) a partir de $10. Los créditos prepago no caducan y puedes regenerar tu clave de API en cualquier momento.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.