Hướng dẫn nhanh cho quy trình Vibevoice
Nhận đầu ra văn bản thô, không kiểm duyệt từ VibeVoice trong vài giây. Hướng dẫn nhanh này cho bạn thấy cách tích hợp api tương thích openai của chúng tôi vào quy trình của bạn bằng các SDK tiêu chuẩn.
Yêu cầu tiên quyết
Trước khi tích hợp, hãy đảm bảo bạn có một tài khoản hoạt động. Đăng ký qua Google hoặc email trên trang Nhận khóa API để nhận khóa duy nhất của bạn ngay lập tức. Bạn không cần thẻ tín dụng cho $0,50 dùng thử ban đầu. llm không kiểm duyệt của chúng tôi phục vụ id mô hình "uncensored" qua một endpoint tiêu chuẩn. URL cơ sở là https://api.vibevoice.top/v1. Thiết lập này hoạt động với bất kỳ SDK OpenAI nào, khiến nó trở thành giải pháp thay thế trực tiếp cho nhiều quy trình hiện có.
Xác thực
Chuyển khóa API của bạn trong tiêu đề Authorization. Định dạng phải là "Bearer YOUR_API_KEY". Nếu khóa bị thiếu hoặc không hợp lệ, API sẽ trả về lỗi 401. Vì chúng tôi tập trung vào xử lý văn bản, hãy đảm bảo quy trình của bạn chỉ gửi dữ liệu văn bản. Khóa được liên kết với một tài khoản; tạo khóa mới sẽ thay thế khóa cũ ngay lập tức. Sự đơn giản này cho phép lặp lại nhanh chóng trong môi trường phát triển của bạn.
Gửi yêu cầu
Thực hiện yêu cầu POST đến /v1/chat/completions. Bao gồm id mô hình, tin nhắn của bạn và bất kỳ tham số nào. Đây là một ví dụ cơ bản sử dụng cURL:
curl https://api.vibevoice.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Yêu cầu này gửi một hướng dẫn đơn giản đến mô hình. Phản hồi chứa văn bản được tạo. Bạn có thể điều chỉnh các tham số như nhiệt độ cho sự sáng tạo hoặc đặt giới hạn nghiêm ngặt về độ dài đầu ra. Cách tiếp cận trực tiếp này rất lý tưởng để tạo kịch bản, phụ đề hoặc biến thể prompt cho các công cụ khác.
Tích hợp SDK Python
Sử dụng thư viện Python OpenAI chính thức. Cấu hình URL cơ sở để trỏ đến dịch vụ của chúng tôi. Chuyển khóa API của bạn dưới dạng api_key. Điều này cho phép bạn sử dụng các phương thức quen thuộc như client.chat.completions.create(). Đây là một api tương thích openai, vì vậy cấu trúc mã hiện có của bạn có thể yêu cầu thay đổi tối thiểu. Phương pháp này hoàn hảo cho xử lý backend hoặc các nhiệm vụ trích xuất dữ liệu.
from openai import OpenAI
client = OpenAI(base_url="https://api.vibevoice.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Hãy nhớ xử lý ngoại lệ một cách khéo léo. Lỗi mạng hoặc giới hạn tốc độ có thể làm gián đoạn quy trình của bạn. Ghi nhật ký phản hồi giúp gỡ lỗi tại sao một prompt cụ thể có thể bị từ chối hoặc tạo ra đầu ra không mong đợi.
Tích hợp SDK Node
Đối với môi trường JavaScript, hãy sử dụng gói npm openai. Đặt các thuộc tính apiKey và baseURL trong đối tượng cấu hình. Điều này đảm bảo các yêu cầu đi đến endpoint chính xác. SDK Node hỗ trợ cùng các tham số như phiên bản Python. Nó lý tưởng cho máy chủ web hoặc các chức năng biên cần tạo văn bản theo yêu cầu.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.vibevoice.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Hãy đảm bảo bạn quản lý vòng đời của đối tượng client để tránh rò rỉ tài nguyên. Tích hợp này rất mạnh mẽ để xử lý các nhiệm vụ tạo văn bản bất đồng bộ trong các ứng dụng web hiện đại.
Phản hồi streaming
Bật streaming bằng cách đặt stream thành true trong yêu cầu của bạn. API trả dữ liệu theo từng phần khi chúng được tạo. Điều này hữu ích cho các hiển thị thời gian thực hoặc hiển thị văn bản tiến bộ. Chunk cuối cùng bao gồm thống kê sử dụng token đầy đủ. Streaming giảm độ trễ cảm nhận cho người dùng cuối.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Xử lý stream đúng cách để đảm bảo tất cả dữ liệu được xử lý. Nếu kết nối bị ngắt, bạn có thể bỏ lỡ dữ liệu sử dụng cuối cùng. Tính năng này rất có giá trị cho các ứng dụng cần hiển thị văn bản khi nó đang được viết.
Thông số kỹ thuật
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID mô hình | uncensored |
| Base URL | https://api.vibevoice.top/v1 |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Cửa sổ ngữ cảnh | 64.000 token (đầu vào + đầu ra) |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 64.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Kích thước yêu cầu | tối đa 8 MB |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Thưởng | +5% từ $50, +10% từ $100 |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Đăng nhập | Google hoặc email và mật khẩu |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
Giới hạn tốc độ là gì?
Bạn bị giới hạn 300 yêu cầu mỗi phút trên mỗi khóa và 8 yêu cầu đồng thời. Thân yêu cầu không được vượt quá 8 MB. Vượt quá giới hạn này sẽ dẫn đến lỗi 429.
Giá cả hoạt động như thế nào?
Bạn trả $0,25 cho 1 triệu token đầu vào và $1,00 cho 1 triệu token đầu ra. Tín dụng được nạp tiền qua crypto (USDT hoặc USDC) và không bao giờ hết hạn. Lỗi và từ chối đều miễn phí.
Cửa sổ ngữ cảnh là gì?
Tổng cửa sổ ngữ cảnh là 100.000 token cho prompt và kết hợp hoàn thành. Đầu ra tối đa mỗi yêu cầu là 32.000 token, hoặc 2.048 nếu max_tokens không được chỉ định.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.