API Venice AI : première requête en cinq minutes
Faites tourner votre LLM sans censure en moins de cinq minutes avec ce guide de démarrage rapide pour l'API Venice AI. Utilisez les endpoints compatibles OpenAI pour envoyer du texte, diffuser des réponses et appeler des fonctions avec une tarification transparente à l'usage.
https://api.veniceapialternative.com/v1
URL de base et authentification
Commencez par créer un compte sur la page Obtenir la clé API. Il vous suffit d'une adresse e-mail et d'un mot de passe ; aucune carte bancaire n'est nécessaire pour recevoir le crédit d'essai gratuit de 0,50 $ valable sept jours. Votre clé API s'affiche immédiatement après l'inscription et peut être régénérée à tout moment, ce qui révoque l'ancienne clé.
Utilisez l'URL de base https://api.veniceapialternative.com/v1 avec les SDK OpenAI officiels ou tout client compatible OpenAI. Définissez votre clé API comme jeton Bearer dans l'en-tête Authorization. Cet endpoint venice ai api remplace l'URL de base OpenAI par défaut dans votre configuration client.
Première requête
Envoyez une requête simple de complétion de chat pour tester la connexion. L'ID du modèle est toujours uncensored. Ce modèle à poids ouverts s'exécute sur nos serveurs GPU et est réglé pour répondre sans refus de contenu pour un usage adulte légal.
Remplacez YOUR_API_KEY par votre clé réelle. La réponse renvoie une sortie textuelle basée sur votre prompt.
curl https://api.veniceapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Exemple SDK Python
Installez la bibliothèque Python OpenAI et configurez-la pour utiliser notre URL de base. Cela vous permet d'exploiter des bases de code existantes qui attendent des endpoints OpenAI.
from openai import OpenAI
client = OpenAI(base_url="https://api.veniceapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Exemple SDK Node.js
Pour les environnements Node.js, utilisez le package openai. Initialisez le client avec l'URL de base personnalisée et votre clé API. Cela garantit que toutes les requêtes transitent par l'infrastructure venice ai api.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.veniceapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Réponses en streaming
Activez le streaming en définissant stream: true dans votre requête. L'API renvoie des Server-Sent Events (SSE) pour la livraison des tokens en temps réel. Cela est utile pour les interfaces de chat qui doivent afficher le texte au fur et à mesure de sa génération.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites de débit et contraintes
Le modèle uncensored prend en charge une fenêtre de contexte de 100 000 tokens pour le prompt et la complétion combinés. Vous êtes limité à 300 requêtes par minute par clé API. Les corps de requête ne doivent pas dépasser 8 Mo.
Les erreurs courantes incluent 401 (clé invalide), 402 (crédit insuffisant) et 429 (limite de débit dépassée). Rechargez votre crédit prépayé à partir de 10 $ ; les crédits n'expirent jamais. Aucun abonnement mensuel ne verrouille votre utilisation.
Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Authentification | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.veniceapialternative.com/v1 |
| Mode JSON | response_format: {"type": "json_object"} |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Taille | jusqu'à 8 Mo par requête |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de débit | 300 requêtes par minute et par clé |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Connexion | Google ou e-mail et mot de passe |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
S'agit-il de l'API officielle Venice.ai ?
Non. Il s'agit d'un service indépendant hébergeant un modèle à poids ouverts sans censure. Il n'est ni affilié ni revendeur de la plateforme principale Venice.ai ou des modèles d'autres fournisseurs.
Cette API prend-elle en charge la génération d'images ou d'audio ?
Non. Il s'agit d'une API de complétion de chat textuel uniquement. Elle ne prend pas en charge les embeddings, la génération d'images, l'audio, la vidéo ou le fine-tuning.
Que se passe-t-il si mon crédit d'essai expire ?
Votre crédit d'essai expire après sept jours. Vous pouvez recharger avec des cryptomonnaies (USDT ou USDC) à partir de 10 $. Les crédits prépayés n'expirent jamais, et vous pouvez régénérer votre clé API à tout moment.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.