GLM API: तीन पंक्तियों में अपना क्लाइंट बदलें
दो कॉन्फ़िगरेशन मानों को अपडेट करके मिनटों में अपने मौजूदा कोड को एक बिना सेंसर GLM API से कनेक्ट करें। यह त्वरित प्रारंभ आपको प्रीपेड क्रेडिट का उपयोग करते हुए मानक OpenAI-कम्पैटिबल एंडपॉइंट्स से गुज़ाराता है।
पूर्वशर्त: अपनी कुंजी प्राप्त करें
कोड लिखने से पहले, आपको एक API कुंजी की आवश्यकता है। ईमेल और पासवर्ड से साइन इन करने के लिए इस साइट पर API कुंजी प्राप्त करें पृष्ठ पर जाएं। शुरू करने के लिए फ़ोन नंबर या क्रेडिट कार्ड की आवश्यकता नहीं है। पंजीकरण पर, आपको 7 दिनों के लिए मान्य $0.50 का मुफ़्त ट्रायल क्रेडिट प्राप्त होता है, या आप क्रिप्टो (USDT या USDC) के साथ टॉप-अप कर सकते हैं। आपकी कुंजी साइन अप के तुरंत बाद प्रदर्शित होती है। इसे सुरक्षित रूप से संग्रहीत करें, क्योंकि आप पुरानी कुंजी को रद्द करने के लिए इसे किसी भी समय पुनः उत्पन्न कर सकते हैं।
यह कुंजी हमारे glm api एंडपॉइंट को सभी अनुरोधों के लिए प्रमाणीकृत करती है। हम आपके प्रॉम्प्ट्स को प्रशिक्षण के लिए उपयोग नहीं करते हैं, और कुंजी एकल खाते से जुड़ी होती है। यदि आपको उच्च मात्रा की आवश्यकता है, तो आप प्रीपेड क्रेडिट खरीद सकते हैं जो कभी समाप्त नहीं होते।
बेस URL और कुंजी कॉन्फ़िगर करें
OpenAI के लिए एक ड्रॉप-इन प्रतिस्थापन के रूप में हमारी सेवा का उपयोग करने के लिए, आपको अपने SDK को हमारे बेस URL पर इंगित करना होगा। यह आवश्यक एकमात्र इंफ्रास्ट्रक्चर परिवर्तन है। बेस URL https://api.glmapikey.com/v1 है। आपको अपनी प्रमाणीकरण हेडर या SDK क्लाइंट कुंजी को साइनअप के दौरान प्राप्त मान पर सेट करने की भी आवश्यकता है।
अधिकतर OpenAI-कम्पैटिबल क्लाइंट, जिसमें आधिकारिक Python और Node SDKs शामिल हैं, आपको बेस URL को ओवरराइड करने की अनुमति देते हैं। यह आपको मौजूदा एप्लिकेशन लॉजिक को बनाए रखते हुए अंडरलाइंग मॉडल को बदलने की अनुमति देता है। अनुरोध करने से पहले सुनिश्चित करें कि आपकी कुंजी सही से सेट है ताकि प्रमाणीकरण त्रुटियों से बचा जा सके।
अपना पहला चैट कंप्लीशन अनुरोध बनाएं
टेक्स्ट जनरेट करने के लिए /v1/chat/completions पर एक POST अनुरोध भेजें। हमारा मॉडल user और assistant जैसे भूमिकाओं के साथ मानक संदेश संरचनाओं को स्वीकार करता है। आपको जिस मॉडल ID को निर्दिष्ट करने की आवश्यकता है वह uncensored है। यह हमारे GPU पर होस्ट किए गए ओपन-वेट मॉडल को ट्रिगर करता है, जिसे कानूनी वयस्क उपयोग के लिए बिना सामग्री अस्वीकृति के उत्तर देने के लिए ट्यून्ड किया गया है।
प्रतिक्रिया में जनरेटेड टेक्स्ट वाला JSON होगा। यदि आपको 401 त्रुटि मिलती है, तो अपनी कुंजी की जांच करें। यदि आपको 402 दिखता है, तो आपका प्रीपेड क्रेडिट समाप्त हो गया है। आप $10 से शुरू करके टॉप-अप कर सकते हैं। ध्यान दें कि हम इस एंडपॉइंट पर एम्बेडिंग्स, इमेजेस या फाइन-ट्यूनिंग का समर्थन नहीं करते हैं।
Python SDK का उपयोग करें
आधिकारिक OpenAI Python लाइब्रेरी हमारे API के साथ सीधे काम करती है। अपनी कुंजी और विशिष्ट बेस URL के साथ क्लाइंट को इनिशियलाइज़ करें। यह दृष्टिकोण उन बैकएंड सेवाओं या स्क्रिप्ट्स के लिए आदर्श है जहाँ आपको संरचित JSON प्रतिक्रियाओं की आवश्यकता होती है। क्लाइंट स्वचालित रूप से सीरियलाइजेशन और रीट्राई लॉजिक संभालता है।
सुनिश्चित करने के लिए मॉडल नाम uncensored पास करें कि आप हमारे विशिष्ट एंडपॉइंट पर पहुंच रहे हैं। कॉन्टेक्स्ट विंडो प्रॉम्प्ट और पूर्णता दोनों के लिए 100,000 टोकन तक समर्थित करती है। यह 8 MB के अनुरोध बॉडी सीमा के भीतर रहने की शर्त के साथ, बिना ट्रंकेशन के महत्वपूर्ण इनपुट डेटा की अनुमति देता है।
Node SDK का उपयोग करें
JavaScript और TypeScript एप्लिकेशंस के लिए, openai NPM पैकेट संगत है। Python उदाहरण के समान बेस URL और कुंजी के साथ क्लाइंट को कॉन्फ़िगर करें। यह ऐसे सर्वर-साइड रेंडरिंग या API एंडपॉइंट्स को सक्षम करता है जिनके बिना सेंसर टेक्स्ट जनरेशन की आवश्यकता होती है। यदि सही से कॉन्फ़िगर किया जाए, तो SDK डेटा को कुशलतापूर्वक स्ट्रीम करता है।
इस SDK में फ़ंक्शन कॉलिंग का समर्थन किया जाता है। आप अनुरोध में फ़ंक्शन स्कीमा परिभाषित कर सकते हैं, और मॉडल आपके स्कीमा से मेल खाने वाले संरचित JSON आउटपुट लौटाएगा। यह आपके एप्लिकेशन फ्लो में बाहरी डेटा स्रोतों या एक्शन को इंटीग्रेट करना आसान बनाता है बिना कच्चे टेक्स्ट को पार्स किए।
स्ट्रीमिंग प्रतिक्रियाएं सक्षम करें
अपने अनुरोध में stream: true सेट करें ताकि सर्वर-सेंट इवेंट्स (SSE) प्राप्त हों। यह आपको टेक्स्ट को जनरेट होते ही उपयोगकर्ताओं को प्रदर्शित करने की अनुमति देता है, जिससे संकीर्ण विलंबता में सुधार होता है। API टेक्स्ट के चंक लौटाता है, जिसे आपके क्लाइंट को संयोजित या क्रमिक रूप से रेंडर करना चाहिए।
स्ट्रीमिंग Python और Node SDKs दोनों के लिए समर्थित है। यह उन चैट इंटरफेस के लिए विशेष रूप से उपयोगी है जहाँ उपयोगकर्ता तत्काल प्रतिक्रिया की उम्मीद करते हैं। प्रत्येक चंक में प्रतिक्रिया का एक हिस्सा होता है। मॉडल तब तक जनरेट करता रहता है जब तक कि यह समाप्त नहीं हो जाता या कॉन्टेक्स्ट विंडो सीमा पर नहीं पहुंच जाता। स्ट्रीमिंग के साथ फ़ंक्शन कॉलिंग का उपयोग करते समय सुनिश्चित करें कि आपका क्लाइंट आंशिक JSON संरचनाओं को सही से संभालता है।
सीमाएं, त्रुटियां और मॉडल
हमारी API प्रति कुंजी प्रति मिनट 300 अनुरोधों के लिए एक रेट लिमिट लागू करती है। यदि आप इससे अधिक करते हैं, तो आपको 429 त्रुटि मिलेगी। अधिकतम अनुरोध बॉडी आकार 8 MB है। मॉडल खोज के लिए, GET /v1/models एंडपॉइंट का उपयोग करें। यह उपलब्ध मॉडल्स की एक सूची लौटाता है, जिसमें uncensored मॉडल ID शामिल है।
सामान्य त्रुटियों में अमान्य कुंजियों के लिए 401 और अपर्याप्त क्रेडिट के लिए 402 शामिल हैं। क्रेडिट समाप्त नहीं होते, लेकिन मुफ़्त ट्रायल क्रेडिट 7 दिनों के लिए मान्य होते हैं। हम SLA या प्रमाणपत्र प्रदान नहीं करते हैं। मॉडल किशोरों से संबंधित यौन सामग्री को ब्लॉक करता है लेकिन अन्यथा बिना सेंसर है। इन सीमाओं का उपयोग अपनी रीट्राई तर्क और उपयोगकर्ता सूचनाओं को डिज़ाइन करने के लिए उचित रूप से करने के लिए करें।
cURL
curl https://api.glmapikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.glmapikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.glmapikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);स्ट्रीमिंग
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)तकनीकी विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| मॉडल ID | uncensored |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.glmapikey.com/v1 |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| JSON मोड | response_format: {"type": "json_object"} |
| अनुरोध का आकार | 8 MB तक |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| बोनस | $50 से +5%, $100 से +10% |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| साइन इन | Google या ईमेल और पासवर्ड |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
क्या यह आधिकारिक GLM API है?
नहीं, हम एक स्वतंत्र सेवा हैं। हम एक ओपन-वेट बिना सेंसर मॉडल होस्ट करते हैं और एक OpenAI-कम्पैटिबल एंडपॉइंट प्रदान करते हैं। हम मूल GLM निर्माताओं या किसी अन्य प्रमुख AI विक्रेता से संबद्ध नहीं हैं।
क्या मैं अपना मौजूदा OpenAI कुंजी उपयोग कर सकता हूँ?
नहीं, आपको हमारी साइट से एक कुंजी की आवश्यकता है। हालाँकि, आप अपने क्लाइंट कॉन्फ़िगरेशन में बेस URL और कुंजी को बदलकर OpenAI के लिए उपयोग की जाने वाली उसी SDK कोड का उपयोग कर सकते हैं।
यदि मेरे क्रेडिट समाप्त हो जाएं तो क्या होता है?
अनुरोध 402 त्रुटि लौटाएंगे। आप किसी भी समय क्रिप्टो (USDT या USDC) का उपयोग करके अपने प्रीपेड क्रेडिट को टॉप-अप कर सकते हैं। आपके क्रेडिट कभी समाप्त नहीं होते हैं, इसलिए आप जब भी आवश्यक हो धन जोड़ सकते हैं।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।