Vibevoice पाइपलाइनों के लिए क्विकस्टार्ट
सेकंडों में VibeVoice से कच्चा, बिना सेंसर टेक्स्ट आउटपुट प्राप्त करें। यह क्विकस्टार्ट दिखाता है कि मानक SDK का उपयोग करके अपनी पाइपलाइन में हमारी openai compatible api को कैसे इंटीग्रेट करें।
आवश्यक पूर्व शर्तें
इंटीग्रेट करने से पहले, सुनिश्चित करें कि आपके पास एक सक्रिय खाता है। Get API key पेज पर Google या ईमेल के माध्यम से साइन अप करें और तुरंत अपनी अद्वितीय कुंजी प्राप्त करें। प्रारंभिक $0.50 ट्रायल के लिए आपको कोई क्रेडिट कार्ड की आवश्यकता नहीं है। हमारा बिना सेंसर LLM "uncensored" मॉडल आईडी को एक मानक एंडपॉइंट के माध्यम से सर्व करता है। बेस यूआरएल https://api.vibevoice.top/v1. है। यह सेटअप किसी भी OpenAI SDK के साथ काम करता है, जिससे यह कई मौजूदा पाइपलाइनों के लिए एक सीधा प्रतिस्थापन बन जाता है।
प्रमाणीकरण
अपनी API कुंजी Authorization हेडर में पास करें। फॉर्मेट "Bearer YOUR_API_KEY" होना चाहिए। यदि कुंजी गायब है या अमान्य है, तो API 401 त्रुटि लौटाता है। चूंकि हम टेक्स्ट प्रोसेसिंग पर केंद्रित हैं, सुनिश्चित करें कि आपकी पाइपलाइन केवल टेक्स्ट डेटा भेजती है। कुंजी एक खाते से जुड़ी है; एक नई कुंजी जनरेट करने से पुरानी कुंजी तुरंत बदल जाती है। यह सरलता आपके डेवलपमेंट एनवायरनमेंट में तेज़ इटेरेशन की अनुमति देती है।
अनुरोध भेजना
/v1/chat/completions पर एक POST अनुरोध करें। मॉडल आईडी, आपके संदेश और किसी भी पैरामीटर शामिल करें। यहाँ cURL का उपयोग करके एक बुनियादी उदाहरण है:
curl https://api.vibevoice.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'यह अनुरोध मॉडल को एक सरल निर्देश भेजता है। प्रतिक्रिया में जनरेटेड टेक्स्ट होता है। आप रचनात्मकता के लिए तापमान जैसे पैरामीटर्स को समायोजित कर सकते हैं या आउटपुट लंबाई पर कठोर सीमाएं सेट कर सकते हैं। यह सीधा दृष्टिकोण अन्य टूल्स के लिए स्क्रिप्ट, कैप्शन या प्रॉम्प्ट वेरिएशन जनरेट करने के लिए आदर्श है।
Python SDK इंटीग्रेशन
आधिकारिक OpenAI Python लाइब्रेरी का उपयोग करें। बेस यूआरएल को हमारे सेवा की ओर इशारा करने के लिए कॉन्फ़िगर करें। अपनी API कुंजी को api_key के रूप में पास करें। यह आपको client.chat.completions.create() जैसे परिचित विधियों का उपयोग करने की अनुमति देता है। यह एक openai compatible api है, इसलिए आपके मौजूदा कोड संरचना में न्यूनतम परिवर्तनों की आवश्यकता हो सकती है। यह विधि बैकएंड प्रोसेसिंग या डेटा एक्सट्रैक्शन कार्यों के लिए आदर्श है।
from openai import OpenAI
client = OpenAI(base_url="https://api.vibevoice.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)अपवादों को प्रभावी ढंग से हैंडल करना न भूलें। नेटवर्क त्रुटियां या रेट लिमिट आपकी पाइपलाइन में बाधा डाल सकते हैं। प्रतिक्रिया को लॉग करने से डिबगिंग में मदद मिलती है कि एक विशिष्ट प्रॉम्प्ट को अस्वीकार क्यों किया गया या अप्रत्याशित आउटपुट क्यों जनरेट किया गया।
Node SDK इंटीग्रेशन
JavaScript वातावरण के लिए, openai npm पैकेज का उपयोग करें। कॉन्फ़िगरेशन ऑब्जेक्ट में apiKey और baseURL गुण सेट करें। यह सुनिश्चित करता है कि अनुरोध सही एंडपॉइंट पर जाएं। Node SDK Python संस्करण के समान ही पैरामीटर समर्थित करता है। यह वेब सर्वर या एज फंक्शंस के लिए आदर्श है जिन्हें आवश्यकतानुसार टेक्स्ट जनरेट करने की आवश्यकता होती है।
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.vibevoice.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);संसाधन लीक से बचने के लिए क्लाइंट ऑब्जेक्ट के जीवन चक्र का प्रबंधन करें। यह इंटीग्रेशन आधुनिक वेब एप्लिकेशन में एसींक्रोनस टेक्स्ट जनरेशन कार्यों को हैंडल करने के लिए मजबूत है।
स्ट्रीमिंग प्रतिक्रियाएं
अपने अनुरोध में stream को true सेट करके स्ट्रीमिंग सक्षम करें। एपीआई डेटा को चंक के रूप में लौटाता है जैसे ही वे जनरेट होते हैं। यह रियल-टाइम डिस्प्ले या प्रोग्रेसिव टेक्स्ट रेंडरिंग के लिए उपयोगी है। अंतिम चंक में पूर्ण टोकन उपयोग आंकड़े शामिल होते हैं। स्ट्रीमिंग से अंत-उपयोगकर्ताओं के लिए अनुभवी विलंबता कम हो जाती है।
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)सुनिश्चित करें कि स्ट्रीम को सही ढंग से हैंडल किया जाए। यदि कनेक्शन टूट जाता है, तो आप अंतिम उपयोग डेटा मिस कर सकते हैं। यह सुविधा उन एप्लिकेशन के लिए मूल्यवान है जिन्हें टेक्स्ट को लिखते हुए प्रदर्शित करने की आवश्यकता होती है।
तकनीकी विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| मॉडल ID | uncensored |
| Base URL | https://api.vibevoice.top/v1 |
| JSON मोड | response_format: {"type": "json_object"} |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| कॉन्टेक्स्ट विंडो | 64,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| अधिकतम आउटपुट | 64,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| अनुरोध का आकार | 8 MB तक |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| बोनस | $50 से +5%, $100 से +10% |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| साइन इन | Google या ईमेल और पासवर्ड |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
रेट लिमिट क्या हैं?
प्रति कुंजी प्रति मिनट 300 अनुरोध और 8 समानांतर अनुरोधों की सीमा है। अनुरोध बॉडी 8 MB से अधिक नहीं होनी चाहिए। इन सीमाओं को पार करने पर 429 त्रुटि आती है।
मूल्य निर्धारण कैसे काम करता है?
आप 1M इनपुट टोकन के लिए $0.25 और 1M आउटपुट टोकन के लिए $1.00 भुगतान करते हैं। क्रेडिट क्रिप्टो (USDT या USDC) के माध्यम से टॉप-अप किया जाता है और कभी समाप्त नहीं होता। त्रुटियां और अस्वीकृतियां मुफ़्त हैं।
कॉन्टेक्स्ट विंडो क्या है?
प्रॉम्प्ट और कंप्लीशन को मिलाकर कुल कॉन्टेक्स्ट विंडो 100,000 टोकन है। प्रति अनुरोध अधिकतम आउटपुट 32,000 टोकन है, या 2,048 यदि max_tokens निर्दिष्ट नहीं है।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस यूआरएल बदलें। सेटअप यही है।