Venice AI API: Erste Anfrage in fünf Minuten
Lass dein unzensiertes LLM in unter fünf Minuten mit dieser Schnellstartanleitung für die Venice AI API laufen. Nutze die OpenAI-kompatiblen Endpunkte, um Text zu senden, Antworten zu streamen und Funktionen aufzurufen.
https://api.veniceapialternative.com/v1
Basis-URL und Authentifizierung
Beginne damit, ein Konto auf der API-Schlüssel erhalten-Seite zu erstellen. Du brauchst nur eine E-Mail-Adresse und ein Passwort; keine Kreditkarte ist erforderlich, um das $0.50 Testguthaben zu erhalten, das sieben Tage gültig ist. Dein API-Schlüssel wird direkt nach der Anmeldung angezeigt und kann jederzeit neu erstellt werden, wodurch der alte Schlüssel ungültig wird.
Nutze die Basis-URL https://api.veniceapialternative.com/v1 mit den offiziellen OpenAI SDKs oder jedem OpenAI-kompatiblen Client. Setze deinen API-Schlüssel als Bearer-Token im Authorization-Header. Dieser venice ai api-Endpunkt ersetzt die Standard-Basis-URL von OpenAI in deiner Client-Konfiguration.
Erste Anfrage
Sende eine einfache Chat-Antwort-Anfrage, um die Verbindung zu testen. Die Modell-ID ist immer uncensored. Dieses Open-Weight-Modell läuft auf unseren GPU-Servern und ist darauf abgestimmt, ohne Inhaltsablehnungen für die legale erwachsene Nutzung zu antworten.
Ersetze YOUR_API_KEY durch deinen tatsächlichen Schlüssel. Die Antwort gibt Textausgabe basierend auf deinem Prompt zurück.
curl https://api.veniceapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK-Beispiel
Installiere die OpenAI Python-Bibliothek und konfiguriere sie, um unsere Basis-URL zu nutzen. Dies ermöglicht es dir, bestehende Codebasen zu nutzen, die OpenAI-Endpunkte erwarten.
from openai import OpenAI
client = OpenAI(base_url="https://api.veniceapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK-Beispiel
Für Node.js-Umgebungen nutze das openai-Paket. Initialisiere den Client mit der benutzerdefinierten Basis-URL und deinem API-Schlüssel. Dies stellt sicher, dass alle Anfragen über die venice ai api-Infrastruktur geleitet werden.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.veniceapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-Antworten
Aktiviere Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt Server-Sent Events (SSE) für die Echtzeit-Token-Auslieferung zurück. Dies ist nützlich für Chat-Schnittstellen, die Text anzeigen müssen, während er generiert wird.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Ratenlimits und Einschränkungen
Das uncensored-Modell unterstützt ein Kontextfenster mit 100.000 Token für Prompt und Antwort zusammen. Du bist auf 300 Anfragen pro Minute pro API-Schlüssel begrenzt. Die Anforderungstexte dürfen 8 MB nicht überschreiten.
Häufige Fehler sind 401 (ungültiger Schlüssel), 402 (unzureichendes Guthaben) und 429 (Ratenlimit überschritten). Lade Prepaid-Guthaben ab einem Mindestbetrag von $10 auf; Guthaben verfallen nie. Keine monatliche Abonnementbindung schränkt deine Nutzung ein.
API-Spezifikation
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Modell-ID | uncensored |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.veniceapialternative.com/v1 |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Anfragegröße | bis 8 MB |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist dies die offizielle Venice.ai API?
Nein. Dies ist ein unabhängiger Dienst, der ein unzensiertes Open-Weight-Modell hostet. Er ist nicht mit der Hauptplattform von Venice.ai oder Modellen anderer Anbieter verbunden oder ein Wiederverkäufer.
Unterstützt diese API die Bild- oder Audioerstellung?
Nein. Dies ist eine Text-Only-Chat-Antwort-API. Sie unterstützt keine Embeddings, Bildgenerierung, Audio, Video oder Feinabstimmung.
Was passiert, wenn mein Testguthaben verfällt?
Dein Testguthaben verfällt nach sieben Tagen. Du kannst mit Krypto (USDT oder USDC) ab $10 aufladen. Prepaid-Guthaben verfallen nie, und du kannst deinen API-Schlüssel jederzeit neu generieren.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.