होमदस्तावेज़
LLM API त्वरित प्रारंभ गाइड | LLM API Source
अपने मौजूदा स्टैक में बिना सेंसर LLM API को एकल base_url परिवर्तन के साथ डालें। यह त्वरित प्रारंभ प्रमाणीकरण, स्ट्रीमिंग, टूल कॉलिंग और सीमाओं को कवर करता है ताकि आप मिनटों में उत्पादन के लिए तैयार हो सकें।
- बेस URL
- https://api.llmapisource.com/v1
- मॉडल
- बिना सेंसर
बेस URL और प्रमाणीकरण
llm api का उपयोग करने के लिए, अपने https://api.llmapisource.com/v1 क्लाइंट को पॉइंट करें। प्रमाणीकरण में Authorization: Bearer <key> हेडर में एक मानक API कुंजी भेजी जाती है। आप डैशबोर्ड पर कुंजियाँ जनरेट या रोटेट कर सकते हैं; एक कुंजी रद्द करने पर पुरानी तुरंत अमान्य हो जाती है।
- ट्रायल के लिए फोन नंबर या क्रेडिट कार्ड की आवश्यकता नहीं है।
- प्रत्येक खाते में एक समय में ठीक एक सक्रिय कुंजी होती है।
- प्रॉम्प्ट को प्रशिक्षण के लिए उपयोग नहीं किया जाता है।
पहला अनुरोध
कनेक्टिविटी की जाँच करने के लिए एक साधारण चैट पूरक भेजें। एंडपॉइंट मानक OpenAI JSON संरचनाओं का समर्थन करता है। अपने वास्तविक कुंजी के साथ स्थानापन्न को बदलें।
curl https://api.llmapisource.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'यदि कुंजी अमान्य है, तो आपको 401 त्रुटि मिलती है। यदि आपके पास प्रीपेड क्रेडिट नहीं है, तो आपको 402 त्रुटि मिलती है। मॉडल पहचानकर्ता हमेशा uncensored होता है।
Python SDK
औपचारिक OpenAI पैकेज को इंस्टॉल करें और अनुरोधों को हमारी इंफ्रास्ट्रक्चर की ओर रूट करने के लिए बेस URL को कॉन्फ़िगर करें। यह किसी भी OpenAI संगत Python क्लाइंट के साथ काम करता है।
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapisource.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)base_url में /v1 की पूर्ण पथ शामिल होनी चाहिए। समर्पित इंस्टेंस तक पहुँचने के लिए मॉडल नाम को uncensored पर सेट किया जाना चाहिए।
Node SDK
Node.js वातावरण के लिए, क्लाइंट को इसी तरह कॉन्फ़िगर करें। संरचना मानक OpenAI इंटरफ़ेस की नकल करती है, जिससे माइग्रेशन सरल हो जाता है।
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapisource.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);apiKey पास करें और https://api.llmapisource.com/v1 के लिए basePath सेट करें। यह सुनिश्चित करता है कि सभी कंप्लीशन हमारे बिना सेंसर मॉडल की ओर रूट किए जाएं।
स्ट्रीमिंग सक्षम करें
सर्वर-सेंट इवेंट्स (SSE) प्राप्त करने के लिए अपने अनुरोध में stream: true सेट करें। इससे आपको टोकन जनरेट होते ही उन्हें प्रोसेस करने की अनुमति मिलती है, जिससे लंबे उत्तरों के लिए अनुभूत विलंबता कम हो जाती है।
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)रियल-टाइम में अपनी UI को अपडेट करने के लिए स्ट्रीम इवेंट्स हैंडल करें। प्रत्येक चंक में पूरक का एक आंशिक डेल्टा होता है।
सीमाएँ, त्रुटियाँ और संदर्भ
हमारी इंफ्रास्ट्रक्चर स्थिरता सुनिश्चित करने के लिए विशिष्ट सीमाएँ लागू करती है। कॉन्टेक्स्ट विंडो प्रॉम्प्ट और पूर्णता को मिलाकर 100,000 टोकन तक का समर्थन करती है।
- रेट लिमिट: प्रति कुंजी प्रति मिनट 300 अनुरोध (429 लौटाता है)।
- बॉडी साइज़: प्रति अनुरोध अधिकतम 8 MB।
- मूल्य: $0.25/1M इनपुट टोकन, $1.00/1M आउटपुट टोकन।
किशोरों के साथ यौन सामग्री वाले अनुरोध अवरुद्ध हो जाते हैं। अन्य सभी कानूनी वयस्क सामग्री की अनुमति है।
API विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapisource.com/v1 |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| मॉडल ID | uncensored |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| JSON मोड | response_format: {"type": "json_object"} |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| अनुरोध का आकार | 8 MB तक |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| बोनस | $50 से +5%, $100 से +10% |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| साइन इन | Google या ईमेल और पासवर्ड |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
क्या यह एक OpenAI मॉडल है?
नहीं। हम एक समर्पित ओपन-वेट मॉडल चलाते हैं जो असीमित जनरेशन के लिए अनुकूलित है। यह GPT, Claude या किसी अन्य विक्रेता का मॉडल नहीं है, लेकिन यह उसी API फॉर्मेट का उपयोग करता है।
क्या ट्रायल के लिए क्रेडिट कार्ड की आवश्यकता है?
नहीं। नए खातों को केवल ईमेल और पासवर्ड का उपयोग करके 7 दिनों के लिए मान्य $0.50 का मुफ़्त ट्रायल क्रेडिट प्राप्त होता है। शुरू करने के लिए कार्ड की आवश्यकता नहीं है।
क्या मैं इसका उपयोग टूल कॉलिंग के लिए कर सकता हूँ?
हाँ। API चैट कंप्लीशन एंडपॉइंट में मानक <code>tools</code> पैरामीटर के माध्यम से फ़ंक्शन और टूल कॉलिंग का समर्थन करता है।