NL ▾
API-sleutel aanvragen

Ongecensureerd OpenAI-compatible API voor ontwikkelaars.

Snelstart voor Vibevoice-pipelines

Krijg rauwe, ongecensureerde tekstuitvoer van VibeVoice in enkele seconden. Deze snelstart laat zien hoe je onze openai-compatible api integreert in je pipeline met standaard SDK's.

Vereisten

Voordat je integreert, zorg dat je een actief account hebt. Meld je aan via Google of e-mail op de pagina API-sleutel krijgen om je unieke sleutel direct te ontvangen. Je hebt geen creditcard nodig voor de initiële proef van $0,50. Onze ongecensureerde llm serveert de model id "uncensored" via een standaard endpoint. De base URL is https://api.vibevoice.top/v1. Deze setup werkt met elke OpenAI SDK, waardoor het een drop-in vervanging is voor veel bestaande pipelines.

Authenticatie

Geef je API-sleutel mee in de Authorization header. De indeling moet "Bearer YOUR_API_KEY" zijn. Als de sleutel ontbreekt of ongeldig is, retourneert de API een 401-fout. Omdat we ons richten op tekstverwerking, zorg dat je pipeline alleen tekstgegevens verstuurt. De sleutel is gekoppeld aan één account; het genereren van een nieuwe sleutel vervangt de oude direct. Deze eenvoud stelt je in staat snel te itereren in je ontwikkelomgeving.

Een verzoek versturen

Maak een POST-verzoek naar /v1/chat/completions. Voeg het model id, je berichten en eventuele parameters toe. Hier is een basisvoorbeeld met cURL:

curl https://api.vibevoice.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Dit verzoek stuurt een eenvoudige instructie naar het model. De respons bevat de gegenereerde tekst. Je kunt parameters aanpassen zoals temperature voor creativiteit of strikte limieten instellen voor de outputlengte. Deze directe aanpak is ideaal voor het genereren van scripts, bijschriften of promptvariaties voor andere tools.

Python SDK-integratie

Gebruik de officiële OpenAI Python-bibliotheek. Configureer de base URL zodat deze naar onze service verwijst. Geef je API-sleutel door als api_key. Hierdoor kun je bekende methoden gebruiken zoals client.chat.completions.create(). Het is een openai-compatible api, dus je bestaande codestructuur vereist waarschijnlijk minimale aanpassingen. Deze methode is perfect voor backendverwerking of data-extractietaken.

from openai import OpenAI

client = OpenAI(base_url="https://api.vibevoice.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Vergeet niet om uitzonderingen af te handelen. Netwerkfouten of rate limits kunnen je pipeline onderbreken. Het loggen van de respons helpt bij het debuggen waarom een specifieke prompt mogelijk is geweigerd of onverwachte output heeft gegenereerd.

Node SDK-integratie

Gebruik voor JavaScript-omgevingen het openai npm-pakket. Stel de apiKey en baseURL-eigenschappen in in het configuratieobject. Dit zorgt ervoor dat verzoeken naar het juiste endpoint gaan. De Node SDK ondersteunt dezelfde parameters als de Python-versie. Het is ideaal voor webservers of edge-functies die tekst op verzoek moeten genereren.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.vibevoice.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Zorg ervoor dat je de levenscyclus van het clientobject beheert om resourcelekken te voorkomen. Deze integratie is robuust voor het afhandelen van asynchrone tekstgeneratietaken in moderne webapplicaties.

Streaming-responsen

Schakel streaming in door stream in te stellen op true in je verzoek. De API retourneert gegevens in chunks zodra ze zijn gegenereerd. Dit is nuttig voor realtime-weergaven of progressieve tekstrendering. De laatste chunk bevat de volledige token-gebruiksstatistieken. Streaming vermindert de waargenomen latentie voor eindgebruikers.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Verwerk de stream correct om ervoor te zorgen dat alle gegevens worden verwerkt. Als de verbinding verbroken raakt, mis je mogelijk de finale gebruiksgegevens. Deze functie is waardevol voor applicaties die tekst willen weergeven terwijl deze wordt geschreven.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
AuthenticatieAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Model-IDuncensored
Base URLhttps://api.vibevoice.top/v1
JSON-modusresponse_format: {"type": "json_object"}
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Contextvenster64.000 tokens (invoer + uitvoer)
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Max. uitvoertot de rest van het venster van 64.000 tokens; max_tokens optioneel (geen aparte limiet)
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Rate limit300 verzoeken per minuut per sleutel
Verzoekgroottetot 8 MB
Gelijktijdige verzoekentot 8 tegelijk per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Bonus+5% vanaf $50, +10% vanaf $100
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Wat zijn de rate limits?

Je bent beperkt tot 300 verzoeken per minuut per sleutel en 8 gelijktijdige verzoeken. De request body mag niet groter zijn dan 8 MB. Het overschrijden van deze limieten resulteert in een 429-fout.

Hoe werkt de prijsstelling?

Je betaalt $0,25 per 1M input tokens en $1,00 per 1M output tokens.tegoed wordt opgewaardeerd via crypto (USDT of USDC) en verloopt nooit. Fouten en weigeringen zijn gratis.

Wat is het contextvenster?

Het totale contextvenster is 100.000 tokens voor prompt en completion samen. De maximale output per verzoek is 32.000 tokens, of 2.048 als max_tokens niet is gespecificeerd.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.

API-sleutel aanvragen