VI ▾
Lấy khóa API

API tương thích OpenAI không kiểm duyệt dành cho nhà phát triển.

Hướng dẫn nhanh cho quy trình Vibevoice

Nhận đầu ra văn bản thô, không kiểm duyệt từ VibeVoice trong vài giây. Hướng dẫn nhanh này cho bạn thấy cách tích hợp api tương thích openai của chúng tôi vào quy trình của bạn bằng các SDK tiêu chuẩn.

Yêu cầu tiên quyết

Trước khi tích hợp, hãy đảm bảo bạn có một tài khoản hoạt động. Đăng ký qua Google hoặc email trên trang Nhận khóa API để nhận khóa duy nhất của bạn ngay lập tức. Bạn không cần thẻ tín dụng cho $0,50 dùng thử ban đầu. llm không kiểm duyệt của chúng tôi phục vụ id mô hình "uncensored" qua một endpoint tiêu chuẩn. URL cơ sở là https://api.vibevoice.top/v1. Thiết lập này hoạt động với bất kỳ SDK OpenAI nào, khiến nó trở thành giải pháp thay thế trực tiếp cho nhiều quy trình hiện có.

Xác thực

Chuyển khóa API của bạn trong tiêu đề Authorization. Định dạng phải là "Bearer YOUR_API_KEY". Nếu khóa bị thiếu hoặc không hợp lệ, API sẽ trả về lỗi 401. Vì chúng tôi tập trung vào xử lý văn bản, hãy đảm bảo quy trình của bạn chỉ gửi dữ liệu văn bản. Khóa được liên kết với một tài khoản; tạo khóa mới sẽ thay thế khóa cũ ngay lập tức. Sự đơn giản này cho phép lặp lại nhanh chóng trong môi trường phát triển của bạn.

Gửi yêu cầu

Thực hiện yêu cầu POST đến /v1/chat/completions. Bao gồm id mô hình, tin nhắn của bạn và bất kỳ tham số nào. Đây là một ví dụ cơ bản sử dụng cURL:

curl https://api.vibevoice.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Yêu cầu này gửi một hướng dẫn đơn giản đến mô hình. Phản hồi chứa văn bản được tạo. Bạn có thể điều chỉnh các tham số như nhiệt độ cho sự sáng tạo hoặc đặt giới hạn nghiêm ngặt về độ dài đầu ra. Cách tiếp cận trực tiếp này rất lý tưởng để tạo kịch bản, phụ đề hoặc biến thể prompt cho các công cụ khác.

Tích hợp SDK Python

Sử dụng thư viện Python OpenAI chính thức. Cấu hình URL cơ sở để trỏ đến dịch vụ của chúng tôi. Chuyển khóa API của bạn dưới dạng api_key. Điều này cho phép bạn sử dụng các phương thức quen thuộc như client.chat.completions.create(). Đây là một api tương thích openai, vì vậy cấu trúc mã hiện có của bạn có thể yêu cầu thay đổi tối thiểu. Phương pháp này hoàn hảo cho xử lý backend hoặc các nhiệm vụ trích xuất dữ liệu.

from openai import OpenAI

client = OpenAI(base_url="https://api.vibevoice.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Hãy nhớ xử lý ngoại lệ một cách khéo léo. Lỗi mạng hoặc giới hạn tốc độ có thể làm gián đoạn quy trình của bạn. Ghi nhật ký phản hồi giúp gỡ lỗi tại sao một prompt cụ thể có thể bị từ chối hoặc tạo ra đầu ra không mong đợi.

Tích hợp SDK Node

Đối với môi trường JavaScript, hãy sử dụng gói npm openai. Đặt các thuộc tính apiKey và baseURL trong đối tượng cấu hình. Điều này đảm bảo các yêu cầu đi đến endpoint chính xác. SDK Node hỗ trợ cùng các tham số như phiên bản Python. Nó lý tưởng cho máy chủ web hoặc các chức năng biên cần tạo văn bản theo yêu cầu.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.vibevoice.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Hãy đảm bảo bạn quản lý vòng đời của đối tượng client để tránh rò rỉ tài nguyên. Tích hợp này rất mạnh mẽ để xử lý các nhiệm vụ tạo văn bản bất đồng bộ trong các ứng dụng web hiện đại.

Phản hồi streaming

Bật streaming bằng cách đặt stream thành true trong yêu cầu của bạn. API trả dữ liệu theo từng phần khi chúng được tạo. Điều này hữu ích cho các hiển thị thời gian thực hoặc hiển thị văn bản tiến bộ. Chunk cuối cùng bao gồm thống kê sử dụng token đầy đủ. Streaming giảm độ trễ cảm nhận cho người dùng cuối.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Xử lý stream đúng cách để đảm bảo tất cả dữ liệu được xử lý. Nếu kết nối bị ngắt, bạn có thể bỏ lỡ dữ liệu sử dụng cuối cùng. Tính năng này rất có giá trị cho các ứng dụng cần hiển thị văn bản khi nó đang được viết.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Xác thựcAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
ID mô hìnhuncensored
Base URLhttps://api.vibevoice.top/v1
Chế độ JSONresponse_format: {"type": "json_object"}
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Cửa sổ ngữ cảnh64.000 token (đầu vào + đầu ra)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Đầu ra tối đatối đa phần còn lại của cửa sổ 64.000 token; max_tokens tùy chọn (không giới hạn riêng)
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thưởng+5% từ $50, +10% từ $100
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Đăng nhậpGoogle hoặc email và mật khẩu

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Giới hạn tốc độ là gì?

Bạn bị giới hạn 300 yêu cầu mỗi phút trên mỗi khóa và 8 yêu cầu đồng thời. Thân yêu cầu không được vượt quá 8 MB. Vượt quá giới hạn này sẽ dẫn đến lỗi 429.

Giá cả hoạt động như thế nào?

Bạn trả $0,25 cho 1 triệu token đầu vào và $1,00 cho 1 triệu token đầu ra. Tín dụng được nạp tiền qua crypto (USDT hoặc USDC) và không bao giờ hết hạn. Lỗi và từ chối đều miễn phí.

Cửa sổ ngữ cảnh là gì?

Tổng cửa sổ ngữ cảnh là 100.000 token cho prompt và kết hợp hoàn thành. Đầu ra tối đa mỗi yêu cầu là 32.000 token, hoặc 2.048 nếu max_tokens không được chỉ định.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.

Lấy khóa API