PL ▾
Pobierz klucz API

API kompatybilne z OpenAI bez cenzury dla programistów.

Szybki start dla potoków Vibevoice

Uzyskaj surowy, bez cenzury tekst wyjściowy od VibeVoice w kilka sekund. Ten szybki start pokazuje, jak zintegrować nasze API kompatybilne z OpenAI w swoim potoku, używając standardowych SDK.

Wymagania wstępne

Przed integracją upewnij się, że masz aktywne konto. Zarejestruj się przez Google lub e-mail na stronie Uzyskaj klucz API, aby natychmiast otrzymać swój unikalny klucz. Nie potrzebujesz karty kredytowej do początkowego kredytu próbnego $0.50. Nasz bez cenzury LLM obsługuje identyfikator modelu "uncensored" przez standardowy endpoint. Podstawowy URL to https://api.vibevoice.top/v1. Ta konfiguracja działa z dowolnym SDK OpenAI, co czyni ją bezpośrednią zastępczą dla wielu istniejących potoków.

Uwierzytelnianie

Przekaż swój klucz API w nagłówku Authorization. Format musi być "Bearer YOUR_API_KEY". Jeśli klucz jest nieobecny lub nieprawidłowy, API zwraca błąd 401. Skupiamy się na przetwarzaniu tekstu, więc upewnij się, że Twój potok wysyła tylko dane tekstowe. Klucz jest powiązany z jednym kontem; wygenerowanie nowego klucza natychmiast zastępuje stary. Ta prostota pozwala na szybkie iteracje w środowisku programistycznym.

Wysyłanie zapytania

Wyślij żądanie POST do /v1/chat/completions. Dołącz identyfikator modelu, swoje wiadomości i dowolne parametry. Oto podstawowy przykład używający cURL:

curl https://api.vibevoice.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

To zapytanie wysyła prostą instrukcję do modelu. Odpowiedź zawiera wygenerowany tekst. Możesz dostosować parametry takie jak temperatura dla kreatywności lub ustawić ścisłe limity długości wyjścia. To bezpośrednie podejście jest idealne do generowania skryptów, podpisów lub wariacji promptów dla innych narzędzi.

Integracja z Python SDK

Użyj oficjalnej biblioteki Pythona OpenAI. Skonfiguruj podstawowy URL wskazujący na naszą usługę. Przekaż swój klucz API jako api_key. Pozwala to na używanie znanych metod takich jak client.chat.completions.create(). To API kompatybilne z OpenAI, więc Twoja istniejąca struktura kodu prawdopodobnie wymaga minimalnych zmian. Ta metoda jest idealna do przetwarzania backendowego lub ekstrakcji danych.

from openai import OpenAI

client = OpenAI(base_url="https://api.vibevoice.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Pamiętaj o obsłudze wyjątków w sposób elegancki. Błędy sieciowe lub limity zapytań mogą przerwać Twój potok. Logowanie odpowiedzi pomaga w debugowaniu, dlaczego konkretny prompt mógł zostać odrzucony lub wygenerować nieoczekiwany wynik.

Integracja z Node SDK

W środowiskach JavaScript użyj pakietu openai npm. Ustaw właściwości apiKey i baseURL w obiekcie konfiguracji. Zapewnia to, że zapytania trafiają do właściwego endpointu. Node SDK obsługuje te same parametry co wersja Python. Jest idealny dla serwerów sieciowych lub funkcji brzegowych, które muszą generować tekst na żądanie.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.vibevoice.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Upewnij się, że zarządzasz cyklem życia obiektu klienta, aby uniknąć wycieków zasobów. Ta integracja jest solidna do obsługi asynchronicznych zadań generowania tekstu w nowoczesnych aplikacjach internetowych.

Strumieniowanie odpowiedzi

Włącz strumieniowanie, ustawiając stream na true w swoim zapytaniu. API zwraca dane w fragmentach, gdy są generowane. Jest to przydatne dla wyświetlania w czasie rzeczywistym lub progresywnego renderowania tekstu. Ostatni fragment zawiera pełne statystyki użycia tokenów. Strumieniowanie zmniejsza postrzeganą opóźnienie dla użytkowników końcowych.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Obsłuż strumień poprawnie, aby upewnić się, że wszystkie dane są przetworzone. Jeśli połączenie zostanie zerwane, możesz przegapić końcowe dane użycia. Ta funkcja jest cenna dla aplikacji, które muszą wyświetlać tekst, gdy jest on pisany.

Specyfikacja techniczna

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
UwierzytelnianieAuthorization: Bearer YOUR_KEY
EndpointyPOST /v1/chat/completions · GET /v1/models
ID modeluuncensored
Base URLhttps://api.vibevoice.top/v1
Tryb JSONresponse_format: {"type": "json_object"}
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Okno kontekstu64 000 tokenów (wejście + odpowiedź)
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Maks. odpowiedźdo reszty okna 64 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Limit zapytań300 zapytań na minutę na klucz
Rozmiar zapytaniado 8 MB
Równoległe zapytaniado 8 jednocześnie na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Bonus+5% od $50, +10% od $100
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
LogowanieGoogle albo e-mail i hasło

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Jakie są limity zapytań?

Limit to 300 zapytań na minutę na klucz i 8 równoległych zapytań. Ciało zapytania nie może przekraczać 8 MB. Przekroczenie tych limitów powoduje błąd 429.

Jak działa cennik?

Płacisz $0,25 za 1M tokenów wejściowych i $1,00 za 1M tokenów wyjściowych. Kredyt doładowywany jest kryptowalutą (USDT lub USDC) i nigdy nie wygasa. Błędy i odrzucenia są darmowe.

Jakie jest okno kontekstu?

Całkowite okno kontekstu wynosi 100 000 tokenów dla prompta i uzupełnienia łącznie. Maksymalne wyjście na zapytanie to 32 000 tokenów lub 2048, jeśli max_tokens nie jest określone.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień podstawowy URL. To cała konfiguracja.

Pobierz klucz API