Szybki start dla potoków Vibevoice
Uzyskaj surowy, bez cenzury tekst wyjściowy od VibeVoice w kilka sekund. Ten szybki start pokazuje, jak zintegrować nasze API kompatybilne z OpenAI w swoim potoku, używając standardowych SDK.
Wymagania wstępne
Przed integracją upewnij się, że masz aktywne konto. Zarejestruj się przez Google lub e-mail na stronie Uzyskaj klucz API, aby natychmiast otrzymać swój unikalny klucz. Nie potrzebujesz karty kredytowej do początkowego kredytu próbnego $0.50. Nasz bez cenzury LLM obsługuje identyfikator modelu "uncensored" przez standardowy endpoint. Podstawowy URL to https://api.vibevoice.top/v1. Ta konfiguracja działa z dowolnym SDK OpenAI, co czyni ją bezpośrednią zastępczą dla wielu istniejących potoków.
Uwierzytelnianie
Przekaż swój klucz API w nagłówku Authorization. Format musi być "Bearer YOUR_API_KEY". Jeśli klucz jest nieobecny lub nieprawidłowy, API zwraca błąd 401. Skupiamy się na przetwarzaniu tekstu, więc upewnij się, że Twój potok wysyła tylko dane tekstowe. Klucz jest powiązany z jednym kontem; wygenerowanie nowego klucza natychmiast zastępuje stary. Ta prostota pozwala na szybkie iteracje w środowisku programistycznym.
Wysyłanie zapytania
Wyślij żądanie POST do /v1/chat/completions. Dołącz identyfikator modelu, swoje wiadomości i dowolne parametry. Oto podstawowy przykład używający cURL:
curl https://api.vibevoice.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'To zapytanie wysyła prostą instrukcję do modelu. Odpowiedź zawiera wygenerowany tekst. Możesz dostosować parametry takie jak temperatura dla kreatywności lub ustawić ścisłe limity długości wyjścia. To bezpośrednie podejście jest idealne do generowania skryptów, podpisów lub wariacji promptów dla innych narzędzi.
Integracja z Python SDK
Użyj oficjalnej biblioteki Pythona OpenAI. Skonfiguruj podstawowy URL wskazujący na naszą usługę. Przekaż swój klucz API jako api_key. Pozwala to na używanie znanych metod takich jak client.chat.completions.create(). To API kompatybilne z OpenAI, więc Twoja istniejąca struktura kodu prawdopodobnie wymaga minimalnych zmian. Ta metoda jest idealna do przetwarzania backendowego lub ekstrakcji danych.
from openai import OpenAI
client = OpenAI(base_url="https://api.vibevoice.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Pamiętaj o obsłudze wyjątków w sposób elegancki. Błędy sieciowe lub limity zapytań mogą przerwać Twój potok. Logowanie odpowiedzi pomaga w debugowaniu, dlaczego konkretny prompt mógł zostać odrzucony lub wygenerować nieoczekiwany wynik.
Integracja z Node SDK
W środowiskach JavaScript użyj pakietu openai npm. Ustaw właściwości apiKey i baseURL w obiekcie konfiguracji. Zapewnia to, że zapytania trafiają do właściwego endpointu. Node SDK obsługuje te same parametry co wersja Python. Jest idealny dla serwerów sieciowych lub funkcji brzegowych, które muszą generować tekst na żądanie.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.vibevoice.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Upewnij się, że zarządzasz cyklem życia obiektu klienta, aby uniknąć wycieków zasobów. Ta integracja jest solidna do obsługi asynchronicznych zadań generowania tekstu w nowoczesnych aplikacjach internetowych.
Strumieniowanie odpowiedzi
Włącz strumieniowanie, ustawiając stream na true w swoim zapytaniu. API zwraca dane w fragmentach, gdy są generowane. Jest to przydatne dla wyświetlania w czasie rzeczywistym lub progresywnego renderowania tekstu. Ostatni fragment zawiera pełne statystyki użycia tokenów. Strumieniowanie zmniejsza postrzeganą opóźnienie dla użytkowników końcowych.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Obsłuż strumień poprawnie, aby upewnić się, że wszystkie dane są przetworzone. Jeśli połączenie zostanie zerwane, możesz przegapić końcowe dane użycia. Ta funkcja jest cenna dla aplikacji, które muszą wyświetlać tekst, gdy jest on pisany.
Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| ID modelu | uncensored |
| Base URL | https://api.vibevoice.top/v1 |
| Tryb JSON | response_format: {"type": "json_object"} |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Okno kontekstu | 64 000 tokenów (wejście + odpowiedź) |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Maks. odpowiedź | do reszty okna 64 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Rozmiar zapytania | do 8 MB |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Bonus | +5% od $50, +10% od $100 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Jakie są limity zapytań?
Limit to 300 zapytań na minutę na klucz i 8 równoległych zapytań. Ciało zapytania nie może przekraczać 8 MB. Przekroczenie tych limitów powoduje błąd 429.
Jak działa cennik?
Płacisz $0,25 za 1M tokenów wejściowych i $1,00 za 1M tokenów wyjściowych. Kredyt doładowywany jest kryptowalutą (USDT lub USDC) i nigdy nie wygasa. Błędy i odrzucenia są darmowe.
Jakie jest okno kontekstu?
Całkowite okno kontekstu wynosi 100 000 tokenów dla prompta i uzupełnienia łącznie. Maksymalne wyjście na zapytanie to 32 000 tokenów lub 2048, jeśli max_tokens nie jest określone.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień podstawowy URL. To cała konfiguracja.