Guida rapida per le pipeline Vibevoice
Ottieni testo grezzo e senza censura da VibeVoice in pochi secondi. Questa guida rapida mostra come integrare la nostra api compatibile con openai nella tua pipeline utilizzando SDK standard.
Prerequisiti
Prima di integrare, assicurati di avere un account attivo. Iscriviti tramite Google o email nella pagina Ottieni chiave API per ricevere immediatamente la tua chiave univoca. Non serve la carta di credito per la prova iniziale da $0,50. Il nostro llm senza censura serve l'id del modello "uncensored" tramite un endpoint standard. L'URL di base è https://api.vibevoice.top/v1. Questa configurazione funziona con qualsiasi SDK OpenAI, rendendola un'alternativa pronta all'uso per molte pipeline esistenti.
Autenticazione
Passa la tua chiave API nell'intestazione Authorization. Il formato deve essere "Bearer YOUR_API_KEY". Se la chiave è mancante o non valida, l'API restituisce un errore 401. Poiché ci concentriamo sull'elaborazione del testo, assicurati che la tua pipeline invii solo dati testuali. La chiave è associata a un singolo account; la generazione di una nuova chiave sostituisce istantaneamente quella vecchia. Questa semplicità consente iterazioni rapide nel tuo ambiente di sviluppo.
Invio di una richiesta
Esegui una richiesta POST a /v1/chat/completions. Include l'id del modello, i tuoi messaggi e qualsiasi parametro. Ecco un esempio di base utilizzando cURL:
curl https://api.vibevoice.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Questa richiesta invia una semplice istruzione al modello. La risposta contiene il testo generato. Puoi regolare parametri come temperature per la creatività o impostare limiti rigorosi sulla lunghezza dell'output. Questo approccio diretto è ideale per generare script, didascalie o variazioni di prompt per altri strumenti.
Integrazione SDK Python
Utilizza la libreria ufficiale OpenAI Python. Configura l'URL di base per puntare al nostro servizio. Passa la tua chiave API come api_key. Questo ti permette di utilizzare metodi familiari come client.chat.completions.create(). È un'api compatibile con openai, quindi la struttura del tuo codice esistente probabilmente richiede modifiche minime. Questo metodo è perfetto per l'elaborazione backend o le attività di estrazione dati.
from openai import OpenAI
client = OpenAI(base_url="https://api.vibevoice.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Ricorda di gestire le eccezioni in modo appropriato. Errori di rete o limiti di richieste possono interrompere la tua pipeline. Registrare la risposta aiuta a eseguire il debug del motivo per cui un prompt specifico potrebbe essere stato rifiutato o aver generato un output imprevisto.
Integrazione SDK Node
Per gli ambienti JavaScript, utilizza il pacchetto npm openai. Imposta le proprietà apiKey e baseURL nell'oggetto di configurazione. Questo garantisce che le richieste vadano all'endpoint corretto. L'SDK Node supporta gli stessi parametri della versione Python. È ideale per server web o funzioni edge che devono generare testo su richiesta.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.vibevoice.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Assicurati di gestire il ciclo di vita dell'oggetto client per evitare perdite di risorse. Questa integrazione è robusta per gestire attività di generazione di testo asincrone nelle moderne applicazioni web.
Risposte in streaming
Abilita lo streaming impostando stream su true nella tua richiesta. L'API restituisce i dati in chunk man mano che vengono generati. Questo è utile per visualizzazioni in tempo reale o rendering progressivo del testo. L'ultimo chunk include le statistiche complete sull'utilizzo dei token. Lo streaming riduce la latenza percepita per gli utenti finali.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Gestisci correttamente lo stream per assicurarti che tutti i dati vengano elaborati. Se la connessione si interrompe, potresti perdere i dati di utilizzo finali. Questa funzione è preziosa per le applicazioni che devono visualizzare il testo man mano che viene scritto.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID modello | uncensored |
| Base URL | https://api.vibevoice.top/v1 |
| Modalità JSON | response_format: {"type": "json_object"} |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Finestra di contesto | 64.000 token (input + output) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Output massimo | fino al resto della finestra di 64.000 token; max_tokens opzionale (nessun limite separato) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Bonus | +5% da $50, +10% da $100 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Quali sono i limiti di richieste?
Il limite è di 300 richieste al minuto per chiave e 8 richieste concorrenti. Il corpo della richiesta non deve superare gli 8 MB. Il superamento di questi limiti restituisce un errore 429.
Come funziona la tariffazione?
Paghi $0,25 per 1M token di input e $1,00 per 1M token di output. Il credito viene ricaricato tramite criptovalute (USDT o USDC) e non scade mai. Errori e rifiuti non comportano costi.
Cos'è la finestra di contesto?
La finestra di contesto totale è di 100.000 token per prompt e completamento combinati. L'output massimo per richiesta è di 32.000 token, o 2.048 se max_tokens non è specificato.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.