IT ▾
Ottieni la chiave API

API compatibile con OpenAI senza censura per gli sviluppatori.

Guida rapida per le pipeline Vibevoice

Ottieni testo grezzo e senza censura da VibeVoice in pochi secondi. Questa guida rapida mostra come integrare la nostra api compatibile con openai nella tua pipeline utilizzando SDK standard.

Prerequisiti

Prima di integrare, assicurati di avere un account attivo. Iscriviti tramite Google o email nella pagina Ottieni chiave API per ricevere immediatamente la tua chiave univoca. Non serve la carta di credito per la prova iniziale da $0,50. Il nostro llm senza censura serve l'id del modello "uncensored" tramite un endpoint standard. L'URL di base è https://api.vibevoice.top/v1. Questa configurazione funziona con qualsiasi SDK OpenAI, rendendola un'alternativa pronta all'uso per molte pipeline esistenti.

Autenticazione

Passa la tua chiave API nell'intestazione Authorization. Il formato deve essere "Bearer YOUR_API_KEY". Se la chiave è mancante o non valida, l'API restituisce un errore 401. Poiché ci concentriamo sull'elaborazione del testo, assicurati che la tua pipeline invii solo dati testuali. La chiave è associata a un singolo account; la generazione di una nuova chiave sostituisce istantaneamente quella vecchia. Questa semplicità consente iterazioni rapide nel tuo ambiente di sviluppo.

Invio di una richiesta

Esegui una richiesta POST a /v1/chat/completions. Include l'id del modello, i tuoi messaggi e qualsiasi parametro. Ecco un esempio di base utilizzando cURL:

curl https://api.vibevoice.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Questa richiesta invia una semplice istruzione al modello. La risposta contiene il testo generato. Puoi regolare parametri come temperature per la creatività o impostare limiti rigorosi sulla lunghezza dell'output. Questo approccio diretto è ideale per generare script, didascalie o variazioni di prompt per altri strumenti.

Integrazione SDK Python

Utilizza la libreria ufficiale OpenAI Python. Configura l'URL di base per puntare al nostro servizio. Passa la tua chiave API come api_key. Questo ti permette di utilizzare metodi familiari come client.chat.completions.create(). È un'api compatibile con openai, quindi la struttura del tuo codice esistente probabilmente richiede modifiche minime. Questo metodo è perfetto per l'elaborazione backend o le attività di estrazione dati.

from openai import OpenAI

client = OpenAI(base_url="https://api.vibevoice.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Ricorda di gestire le eccezioni in modo appropriato. Errori di rete o limiti di richieste possono interrompere la tua pipeline. Registrare la risposta aiuta a eseguire il debug del motivo per cui un prompt specifico potrebbe essere stato rifiutato o aver generato un output imprevisto.

Integrazione SDK Node

Per gli ambienti JavaScript, utilizza il pacchetto npm openai. Imposta le proprietà apiKey e baseURL nell'oggetto di configurazione. Questo garantisce che le richieste vadano all'endpoint corretto. L'SDK Node supporta gli stessi parametri della versione Python. È ideale per server web o funzioni edge che devono generare testo su richiesta.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.vibevoice.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Assicurati di gestire il ciclo di vita dell'oggetto client per evitare perdite di risorse. Questa integrazione è robusta per gestire attività di generazione di testo asincrone nelle moderne applicazioni web.

Risposte in streaming

Abilita lo streaming impostando stream su true nella tua richiesta. L'API restituisce i dati in chunk man mano che vengono generati. Questo è utile per visualizzazioni in tempo reale o rendering progressivo del testo. L'ultimo chunk include le statistiche complete sull'utilizzo dei token. Lo streaming riduce la latenza percepita per gli utenti finali.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Gestisci correttamente lo stream per assicurarti che tutti i dati vengano elaborati. Se la connessione si interrompe, potresti perdere i dati di utilizzo finali. Questa funzione è preziosa per le applicazioni che devono visualizzare il testo man mano che viene scritto.

Specifiche tecniche

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
AutenticazioneAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
ID modellouncensored
Base URLhttps://api.vibevoice.top/v1
Modalità JSONresponse_format: {"type": "json_object"}
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Finestra di contesto64.000 token (input + output)
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Output massimofino al resto della finestra di 64.000 token; max_tokens opzionale (nessun limite separato)
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Limite di frequenza300 richieste al minuto per chiave
Dimensionefino a 8 MB per richiesta
Concorrenza8 richieste contemporanee per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Bonus+5% da $50, +10% da $100
Scadenzail credito pagato non scade, nessun abbonamento
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
AccessoGoogle oppure e-mail e password

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Quali sono i limiti di richieste?

Il limite è di 300 richieste al minuto per chiave e 8 richieste concorrenti. Il corpo della richiesta non deve superare gli 8 MB. Il superamento di questi limiti restituisce un errore 429.

Come funziona la tariffazione?

Paghi $0,25 per 1M token di input e $1,00 per 1M token di output. Il credito viene ricaricato tramite criptovalute (USDT o USDC) e non scade mai. Errori e rifiuti non comportano costi.

Cos'è la finestra di contesto?

La finestra di contesto totale è di 100.000 token per prompt e completamento combinati. L'output massimo per richiesta è di 32.000 token, o 2.048 se max_tokens non è specificato.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API