Vibevoice 管線快速入門
在數秒內取得 VibeVoice 原始、無審查的文字輸出。本快速入門將展示如何使用標準 SDK 將我們 openai compatible api 整合至您的管線。
前置條件
在整合之前,請確保您擁有活躍的帳戶。前往取得 API 金鑰頁面,透過 Google 或電子郵件註冊,即可立即獲得您的專屬金鑰。初始 $0.50 試用無需信用卡。我們的無審查 llm 透過標準端點提供模型 id「uncensored」。基礎 URL 為 https://api.vibevoice.top/v1.。此設定適用於任何 OpenAI SDK,可作為許多現有管線的即插即用替代方案。
驗證
在 Authorization 標頭中傳遞您的 API 金鑰。格式必須為「Bearer YOUR_API_KEY」。若金鑰遺失或無效,API 將回傳 401 錯誤。由於我們專注於文字處理,請確保您的管線僅傳送文字資料。金鑰與單一帳戶綁定;產生新金鑰會立即取代舊金鑰。這種簡易性讓您在開發環境中能快速迭代。
發送請求
向 /v1/chat/completions 發送 POST 請求。包含模型 id、您的訊息以及任何參數。以下是使用 cURL 的基本範例:
curl https://api.vibevoice.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'此請求將簡單指令傳送給模型。回應包含生成的文字。您可以調整 temperature 等參數以控制創意,或嚴格限制輸出長度。這種直接方法非常適合生成腳本、字幕或其他工具的提示詞變體。
Python SDK 整合
使用官方 OpenAI Python 函式庫。將基礎 URL 設定指向我們的服務。將您的 API 金鑰作為 api_key 傳遞。這使您能使用熟悉的 client.chat.completions.create() 等方法。由於這是 openai compatible api,您現有的程式碼結構可能只需微調。此方法非常適合後端處理或資料擷取任務。
from openai import OpenAI
client = OpenAI(base_url="https://api.vibevoice.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)請務必妥善處理例外狀況。網路錯誤或速率限制可能會中斷您的管線。記錄回應有助於除錯,了解為何特定提示詞被拒絕或產生了非預期的輸出。
Node SDK 整合
對於 JavaScript 環境,請使用 openai npm 套件。在設定物件中設定 apiKey 和 baseURL 屬性。這可確保請求傳送至正確的端點。Node SDK 支援與 Python 版本相同的參數。它非常適合需要在按需情況下生成文字的網頁伺服器或邊緣函式。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.vibevoice.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);請妥善管理 client 物件的生命週期,以避免資源洩漏。此整合能穩健地處理現代網頁應用程式中的非同步文字生成任務。
串流回應
在請求中將 stream 設定為 true 以啟用串流。API 會以資料區塊的形式回傳已生成的內容。這對於即時顯示或漸進式文字渲染非常有用。最後一個區塊包含完整的 token 使用統計數據。串流可降低終端使用者的感知延遲。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)正確處理串流輸出以確保所有資料都已處理。如果連線中斷,你可能會遺失最終的使用量資料。此功能對於需要即時顯示文字的应用非常有用。
技術規格
購買額度前,請先確認介面是否符合你的需求——以下是全部真實參數。
| 項目 | 說明 |
|---|---|
| 介面格式 | 相容 OpenAI:任何 OpenAI SDK 只需更換 base URL 和金鑰 |
| 驗證 | Authorization: Bearer YOUR_KEY |
| 端點 | POST /v1/chat/completions · GET /v1/models |
| 模型 ID | uncensored |
| Base URL | https://api.vibevoice.top/v1 |
| JSON 模式 | response_format: {"type": "json_object"} |
| 函式呼叫 | 支援 tools、tool_choice;回覆包含 tool_calls(串流同樣支援),結果以 role: tool 訊息回傳 |
| 上下文視窗 | 64,000 tokens(輸入與輸出合計) |
| 取樣參數 | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 最大輸出 | 不另設輸出上限;提示+回覆共 64,000 個 token 視窗內,max_tokens 可選 |
| 串流輸出 | 支援 SSE,最後一段包含 token 用量 |
| 速率限制 | 每把金鑰每分鐘 300 次請求 |
| 請求大小 | 每次請求不超過 8 MB |
| 並行請求 | 每把金鑰同時最多 8 個請求 |
| 回應標頭 | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 免費試用 | $0.50,有效期 7 天,不需信用卡 · 試用金鑰:2 個並行請求,每分鐘 60 次;首次儲值後恢復完整限額(8 和 300) |
| 儲值 | USDT(TRC20)或 USDC(Base),$10–$500 任意整數金額 |
| 贈送額度 | 滿 $50 送 5%,滿 $100 送 10% |
| 額度效期 | 付費額度永不過期,無訂閱 |
| 價格 | 輸入 $0.25 / 百萬 tokens · 輸出 $1.00 / 百萬 tokens |
| 計費 | 預付額度,按實際 token 用量扣費;錯誤和拒絕不收費 |
| 內容政策 | 允許成人內容;涉及未成年人的性內容一律拒絕 |
| 金鑰 | 每個帳戶一把有效金鑰;產生新金鑰後舊金鑰失效 |
| 登入 | Google 或電子郵件 + 密碼 |
錯誤代碼
錯誤以 JSON 回傳,type 欄位固定;失敗或被拒絕的請求不計費。
| 狀態碼 | 類型 | 含義 |
|---|---|---|
400 | bad_request | JSON 無效、訊息為空、參數錯誤或超出上下文視窗 |
401 | missing_key · invalid_key · key_revoked | 缺少金鑰、金鑰錯誤或已被新金鑰取代 |
402 | no_credit | 餘額不足——儲值後立即恢復 |
403 | content_blocked | 涉及未成年人的性內容——拒絕且不計費 |
404 | not_found | 未知端點 |
413 | request_too_large | 請求內容超過 8 MB |
429 | rate_limited · concurrency | 超過每分鐘 300 次或 8 個並行——稍後重試 |
503 | upstream_busy | 模型忙碌——幾秒後重試 |
問答
速率限制為何?
每個金鑰每分鐘限 300 個請求,並行請求上限為 8 個。請求主體不得超過 8 MB。超出這些限制將導致 429 錯誤。
計費方式為何?
你每 1M 個輸入 token 需支付 $0.25,每 1M 個輸出 token 需支付 $1.00。透過加密貨幣(USDT 或 USDC)儲值額度,且永不過期。錯誤和拒絕回應皆免費。
上下文視窗為何?
提示詞與補全合計的總上下文視窗為 100,000 個 token。每個請求的最大輸出為 32,000 個 token;若未指定 max_tokens,則上限為 2,048 個 token。
只差一張表單,即可取得金鑰
建立帳戶、複製金鑰、更改基礎 URL。這就是完整的設定。