API Venice AI: prima richiesta in cinque minuti
Avvia il tuo LLM senza censura in meno di cinque minuti con questa guida rapida per l'API Venice AI. Usa gli endpoint compatibili con OpenAI per inviare testo, fare streaming delle risposte e chiamare funzioni con prezzi trasparenti a consumo.
https://api.veniceapialternative.com/v1
URL base e autenticazione
Inizia creando un account nella pagina Ottieni chiave API. Ti servono solo email e password; non è richiesta una carta di credito per ricevere il credito di prova gratuito di $0,50 valido per sette giorni. La tua chiave API viene visualizzata subito dopo la registrazione e può essere rigenerata in qualsiasi momento, revocando quella vecchia.
Usa l'URL di base https://api.veniceapialternative.com/v1 con gli SDK ufficiali OpenAI o qualsiasi client compatibile con OpenAI. Imposta la tua chiave API come token bearer nell'intestazione Authorization. Questo endpoint venice ai api sostituisce l'URL di base predefinito di OpenAI nella configurazione del tuo client.
Prima richiesta
Invia una semplice richiesta di chat completion per testare la connessione. L'ID del modello è sempre uncensored. Questo modello a pesi aperti gira sui nostri server GPU ed è ottimizzato per rispondere senza rifiuti di contenuto per uso adulto legale.
Sostituisci YOUR_API_KEY con la tua chiave effettiva. La risposta restituisce testo in base al tuo prompt.
curl https://api.veniceapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Esempio SDK Python
Installa la libreria Python di OpenAI e configurala per usare il nostro URL base. Questo ti permette di sfruttare codebase esistenti che si aspettano endpoint OpenAI.
from openai import OpenAI
client = OpenAI(base_url="https://api.veniceapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Esempio SDK Node.js
Per gli ambienti Node.js, usa il pacchetto openai. Inizializza il client con l'URL di base personalizzato e la tua chiave API. In questo modo tutte le richieste vengono instradate attraverso l'infrastruttura venice ai api.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.veniceapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Risposte in streaming
Abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce Server-Sent Events (SSE) per la consegna dei token in tempo reale. Utile per interfacce chat che devono visualizzare il testo man mano che viene generato.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limiti di velocità e vincoli
Il modello uncensored supporta una finestra di contesto di 100.000 token per prompt e completamento combinati. Sei limitato a 300 richieste al minuto per chiave API. I corpi delle richieste non devono superare 8 MB.
Gli errori comuni includono 401 (chiave non valida), 402 (credito insufficiente) e 429 (limite di richieste superato). Ricarica il credito prepagato a partire da $10; i crediti non scadono mai. Nessun abbonamento mensile blocca il tuo utilizzo.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID modello | uncensored |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.veniceapialternative.com/v1 |
| Modalità JSON | response_format: {"type": "json_object"} |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Finestra di contesto | 100.000 token (input + output) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Dimensione | fino a 8 MB per richiesta |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Bonus | +5% da $50, +10% da $100 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
È questa l'API ufficiale di Venice.ai?
No. Questo è un servizio indipendente che ospita un modello a pesi aperti senza censura. Non è affiliato alla piattaforma principale di Venice.ai né è un rivenditore dei modelli di altri fornitori.
Questa API supporta la generazione di immagini o audio?
No. È un'API di chat-completion solo testo. Non supporta embeddings, generazione di immagini, audio, video o fine-tuning.
Cosa succede se il credito di prova scade?
Il credito di prova scade dopo sette giorni. Puoi ricaricare con criptovalute (USDT o USDC) a partire da $10. I crediti prepagati non scadono mai e puoi rigenerare la chiave API in qualsiasi momento.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.