API Venice AI: pierwsze zapytanie w pięć minut
Uruchom swój LLM bez cenzury w mniej niż pięć minut dzięki temu przewodnikowi szybkiego startu dla API Venice AI. Używaj endpointów kompatybilnych z OpenAI do wysyłania tekstu, strumieniowania odpowiedzi i wywoływania funkcji przy przejrzystym cenniku pay-as-you-go.
https://api.veniceapialternative.com/v1
Base URL i uwierzytelnianie
Zacznij od utworzenia konta na stronie Pobierz klucz API. Potrzebujesz tylko adresu e-mail i hasła; nie jest wymagana karta kredytowa, aby otrzymać 0,50 USD kredytu próbnego ważnego przez siedem dni. Twój klucz API jest wyświetlany natychmiast po rejestracji i można go wygenerować ponownie w dowolnym momencie, co unieważnia poprzedni klucz.
Użyj podstawowego adresu URL https://api.veniceapialternative.com/v1 z oficjalnymi SDK OpenAI lub dowolnym klientem zgodnym z OpenAI. Ustaw swój klucz API jako token nośnika w nagłówku Authorization. Ten endpoint venice ai api zastępuje domyślny podstawowy adres URL OpenAI w konfiguracji klienta.
Pierwsze zapytanie
Wyślij proste zapytanie uzupełniające czat, aby przetestować połączenie. ID modelu to zawsze uncensored. Ten model o otwartych wagach działa na naszych serwerach GPU i jest dostrojony do odpowiadania bez odmów treści dla prawnego użytku dorosłego.
Zamień YOUR_API_KEY na swój właściwy klucz. Odpowiedź zwraca wynik tekstowy na podstawie Twojego promptu.
curl https://api.veniceapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Przykład SDK Python
Zainstaluj bibliotekę OpenAI dla Pythona i skonfiguruj ją do używania naszego base URL. Pozwala to wykorzystać istniejące bazy kodu, które oczekują endpointów OpenAI.
from openai import OpenAI
client = OpenAI(base_url="https://api.veniceapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Przykład SDK Node.js
W środowiskach Node.js użyj pakietu openai. Zainicjuj klienta niestandardowym podstawowym adresem URL i swoim kluczem API. Zapewnia to, że wszystkie zapytania są kierowane przez infrastrukturę venice ai api.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.veniceapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Strumieniowanie odpowiedzi
Włącz strumieniowanie, ustawiając stream: true w swoim zapytaniu. API zwraca zdarzenia wysyłane przez serwer (SSE) dla dostarczania tokenów w czasie rzeczywistym. Jest to przydatne dla interfejsów czatu, które muszą wyświetlać tekst w miarę jego generowania.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limity zapytań i ograniczenia
Model uncensored obsługuje okno kontekstu o rozmiarze 100 000 tokenów dla promptu i uzupełnienia łącznie. Limit to 300 zapytań na minutę na klucz API. Treść zapytania nie może przekraczać 8 MB.
Typowe błędy to 401 (nieprawidłowy klucz), 402 (niewystarczający kredyt) i 429 (przekroczony limit zapytań). Doładuj przedpłacony kredyt od kwoty 10 USD; kredyty nigdy nie wygasają. Żadna subskrypcja miesięczna nie blokuje Twojego użytkowania.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| ID modelu | uncensored |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.veniceapialternative.com/v1 |
| Tryb JSON | response_format: {"type": "json_object"} |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Rozmiar zapytania | do 8 MB |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Bonus | +5% od $50, +10% od $100 |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Logowanie | Google albo e-mail i hasło |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy to oficjalne API Venice.ai?
Nie. Jest to niezależna usługa hostująca model o otwartych wagach bez cenzury. Nie jest powiązana ani nie jest resellerem głównej platformy Venice.ai ani modeli innych dostawców.
Czy to API obsługuje generowanie obrazu lub audio?
Nie. To jest API tylko do uzupełniania czatu tekstowego. Nie obsługuje embeddingów, generowania obrazu, audio, wideo ani dostrajania.
Co się stanie, jeśli mój darmowy kredyt próbny wygaśnie?
Twój darmowy kredyt próbny wygasa po siedmiu dniach. Możesz doładować kryptowalutą (USDT lub USDC) od kwoty 10 USD. Przedpłacony kredyt nigdy nie wygasa, a klucz API możesz wygenerować ponownie w dowolnym momencie.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień base URL. To cała konfiguracja.