Snelstart voor Vibevoice-pipelines
Krijg rauwe, ongecensureerde tekstuitvoer van VibeVoice in enkele seconden. Deze snelstart laat zien hoe je onze openai-compatible api integreert in je pipeline met standaard SDK's.
Vereisten
Voordat je integreert, zorg dat je een actief account hebt. Meld je aan via Google of e-mail op de pagina API-sleutel krijgen om je unieke sleutel direct te ontvangen. Je hebt geen creditcard nodig voor de initiële proef van $0,50. Onze ongecensureerde llm serveert de model id "uncensored" via een standaard endpoint. De base URL is https://api.vibevoice.top/v1. Deze setup werkt met elke OpenAI SDK, waardoor het een drop-in vervanging is voor veel bestaande pipelines.
Authenticatie
Geef je API-sleutel mee in de Authorization header. De indeling moet "Bearer YOUR_API_KEY" zijn. Als de sleutel ontbreekt of ongeldig is, retourneert de API een 401-fout. Omdat we ons richten op tekstverwerking, zorg dat je pipeline alleen tekstgegevens verstuurt. De sleutel is gekoppeld aan één account; het genereren van een nieuwe sleutel vervangt de oude direct. Deze eenvoud stelt je in staat snel te itereren in je ontwikkelomgeving.
Een verzoek versturen
Maak een POST-verzoek naar /v1/chat/completions. Voeg het model id, je berichten en eventuele parameters toe. Hier is een basisvoorbeeld met cURL:
curl https://api.vibevoice.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Dit verzoek stuurt een eenvoudige instructie naar het model. De respons bevat de gegenereerde tekst. Je kunt parameters aanpassen zoals temperature voor creativiteit of strikte limieten instellen voor de outputlengte. Deze directe aanpak is ideaal voor het genereren van scripts, bijschriften of promptvariaties voor andere tools.
Python SDK-integratie
Gebruik de officiële OpenAI Python-bibliotheek. Configureer de base URL zodat deze naar onze service verwijst. Geef je API-sleutel door als api_key. Hierdoor kun je bekende methoden gebruiken zoals client.chat.completions.create(). Het is een openai-compatible api, dus je bestaande codestructuur vereist waarschijnlijk minimale aanpassingen. Deze methode is perfect voor backendverwerking of data-extractietaken.
from openai import OpenAI
client = OpenAI(base_url="https://api.vibevoice.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Vergeet niet om uitzonderingen af te handelen. Netwerkfouten of rate limits kunnen je pipeline onderbreken. Het loggen van de respons helpt bij het debuggen waarom een specifieke prompt mogelijk is geweigerd of onverwachte output heeft gegenereerd.
Node SDK-integratie
Gebruik voor JavaScript-omgevingen het openai npm-pakket. Stel de apiKey en baseURL-eigenschappen in in het configuratieobject. Dit zorgt ervoor dat verzoeken naar het juiste endpoint gaan. De Node SDK ondersteunt dezelfde parameters als de Python-versie. Het is ideaal voor webservers of edge-functies die tekst op verzoek moeten genereren.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.vibevoice.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Zorg ervoor dat je de levenscyclus van het clientobject beheert om resourcelekken te voorkomen. Deze integratie is robuust voor het afhandelen van asynchrone tekstgeneratietaken in moderne webapplicaties.
Streaming-responsen
Schakel streaming in door stream in te stellen op true in je verzoek. De API retourneert gegevens in chunks zodra ze zijn gegenereerd. Dit is nuttig voor realtime-weergaven of progressieve tekstrendering. De laatste chunk bevat de volledige token-gebruiksstatistieken. Streaming vermindert de waargenomen latentie voor eindgebruikers.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Verwerk de stream correct om ervoor te zorgen dat alle gegevens worden verwerkt. Als de verbinding verbroken raakt, mis je mogelijk de finale gebruiksgegevens. Deze functie is waardevol voor applicaties die tekst willen weergeven terwijl deze wordt geschreven.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Model-ID | uncensored |
| Base URL | https://api.vibevoice.top/v1 |
| JSON-modus | response_format: {"type": "json_object"} |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Contextvenster | 64.000 tokens (invoer + uitvoer) |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Max. uitvoer | tot de rest van het venster van 64.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Verzoekgrootte | tot 8 MB |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inloggen | Google of e-mail en wachtwoord |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Wat zijn de rate limits?
Je bent beperkt tot 300 verzoeken per minuut per sleutel en 8 gelijktijdige verzoeken. De request body mag niet groter zijn dan 8 MB. Het overschrijden van deze limieten resulteert in een 429-fout.
Hoe werkt de prijsstelling?
Je betaalt $0,25 per 1M input tokens en $1,00 per 1M output tokens.tegoed wordt opgewaardeerd via crypto (USDT of USDC) en verloopt nooit. Fouten en weigeringen zijn gratis.
Wat is het contextvenster?
Het totale contextvenster is 100.000 tokens voor prompt en completion samen. De maximale output per verzoek is 32.000 tokens, of 2.048 als max_tokens niet is gespecificeerd.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.