HI ▾
API कुंजी पाएँ

GLM API: तीन पंक्तियों में अपना क्लाइंट बदलें

दो कॉन्फ़िगरेशन मानों को अपडेट करके मिनटों में अपने मौजूदा कोड को एक बिना सेंसर GLM API से कनेक्ट करें। यह त्वरित प्रारंभ आपको प्रीपेड क्रेडिट का उपयोग करते हुए मानक OpenAI-कम्पैटिबल एंडपॉइंट्स से गुज़ाराता है।

पूर्वशर्त: अपनी कुंजी प्राप्त करें

कोड लिखने से पहले, आपको एक API कुंजी की आवश्यकता है। ईमेल और पासवर्ड से साइन इन करने के लिए इस साइट पर API कुंजी प्राप्त करें पृष्ठ पर जाएं। शुरू करने के लिए फ़ोन नंबर या क्रेडिट कार्ड की आवश्यकता नहीं है। पंजीकरण पर, आपको 7 दिनों के लिए मान्य $0.50 का मुफ़्त ट्रायल क्रेडिट प्राप्त होता है, या आप क्रिप्टो (USDT या USDC) के साथ टॉप-अप कर सकते हैं। आपकी कुंजी साइन अप के तुरंत बाद प्रदर्शित होती है। इसे सुरक्षित रूप से संग्रहीत करें, क्योंकि आप पुरानी कुंजी को रद्द करने के लिए इसे किसी भी समय पुनः उत्पन्न कर सकते हैं।

यह कुंजी हमारे glm api एंडपॉइंट को सभी अनुरोधों के लिए प्रमाणीकृत करती है। हम आपके प्रॉम्प्ट्स को प्रशिक्षण के लिए उपयोग नहीं करते हैं, और कुंजी एकल खाते से जुड़ी होती है। यदि आपको उच्च मात्रा की आवश्यकता है, तो आप प्रीपेड क्रेडिट खरीद सकते हैं जो कभी समाप्त नहीं होते।

बेस URL और कुंजी कॉन्फ़िगर करें

OpenAI के लिए एक ड्रॉप-इन प्रतिस्थापन के रूप में हमारी सेवा का उपयोग करने के लिए, आपको अपने SDK को हमारे बेस URL पर इंगित करना होगा। यह आवश्यक एकमात्र इंफ्रास्ट्रक्चर परिवर्तन है। बेस URL https://api.glmapikey.com/v1 है। आपको अपनी प्रमाणीकरण हेडर या SDK क्लाइंट कुंजी को साइनअप के दौरान प्राप्त मान पर सेट करने की भी आवश्यकता है।

अधिकतर OpenAI-कम्पैटिबल क्लाइंट, जिसमें आधिकारिक Python और Node SDKs शामिल हैं, आपको बेस URL को ओवरराइड करने की अनुमति देते हैं। यह आपको मौजूदा एप्लिकेशन लॉजिक को बनाए रखते हुए अंडरलाइंग मॉडल को बदलने की अनुमति देता है। अनुरोध करने से पहले सुनिश्चित करें कि आपकी कुंजी सही से सेट है ताकि प्रमाणीकरण त्रुटियों से बचा जा सके।

अपना पहला चैट कंप्लीशन अनुरोध बनाएं

टेक्स्ट जनरेट करने के लिए /v1/chat/completions पर एक POST अनुरोध भेजें। हमारा मॉडल user और assistant जैसे भूमिकाओं के साथ मानक संदेश संरचनाओं को स्वीकार करता है। आपको जिस मॉडल ID को निर्दिष्ट करने की आवश्यकता है वह uncensored है। यह हमारे GPU पर होस्ट किए गए ओपन-वेट मॉडल को ट्रिगर करता है, जिसे कानूनी वयस्क उपयोग के लिए बिना सामग्री अस्वीकृति के उत्तर देने के लिए ट्यून्ड किया गया है।

प्रतिक्रिया में जनरेटेड टेक्स्ट वाला JSON होगा। यदि आपको 401 त्रुटि मिलती है, तो अपनी कुंजी की जांच करें। यदि आपको 402 दिखता है, तो आपका प्रीपेड क्रेडिट समाप्त हो गया है। आप $10 से शुरू करके टॉप-अप कर सकते हैं। ध्यान दें कि हम इस एंडपॉइंट पर एम्बेडिंग्स, इमेजेस या फाइन-ट्यूनिंग का समर्थन नहीं करते हैं।

Python SDK का उपयोग करें

आधिकारिक OpenAI Python लाइब्रेरी हमारे API के साथ सीधे काम करती है। अपनी कुंजी और विशिष्ट बेस URL के साथ क्लाइंट को इनिशियलाइज़ करें। यह दृष्टिकोण उन बैकएंड सेवाओं या स्क्रिप्ट्स के लिए आदर्श है जहाँ आपको संरचित JSON प्रतिक्रियाओं की आवश्यकता होती है। क्लाइंट स्वचालित रूप से सीरियलाइजेशन और रीट्राई लॉजिक संभालता है।

सुनिश्चित करने के लिए मॉडल नाम uncensored पास करें कि आप हमारे विशिष्ट एंडपॉइंट पर पहुंच रहे हैं। कॉन्टेक्स्ट विंडो प्रॉम्प्ट और पूर्णता दोनों के लिए 100,000 टोकन तक समर्थित करती है। यह 8 MB के अनुरोध बॉडी सीमा के भीतर रहने की शर्त के साथ, बिना ट्रंकेशन के महत्वपूर्ण इनपुट डेटा की अनुमति देता है।

Node SDK का उपयोग करें

JavaScript और TypeScript एप्लिकेशंस के लिए, openai NPM पैकेट संगत है। Python उदाहरण के समान बेस URL और कुंजी के साथ क्लाइंट को कॉन्फ़िगर करें। यह ऐसे सर्वर-साइड रेंडरिंग या API एंडपॉइंट्स को सक्षम करता है जिनके बिना सेंसर टेक्स्ट जनरेशन की आवश्यकता होती है। यदि सही से कॉन्फ़िगर किया जाए, तो SDK डेटा को कुशलतापूर्वक स्ट्रीम करता है।

इस SDK में फ़ंक्शन कॉलिंग का समर्थन किया जाता है। आप अनुरोध में फ़ंक्शन स्कीमा परिभाषित कर सकते हैं, और मॉडल आपके स्कीमा से मेल खाने वाले संरचित JSON आउटपुट लौटाएगा। यह आपके एप्लिकेशन फ्लो में बाहरी डेटा स्रोतों या एक्शन को इंटीग्रेट करना आसान बनाता है बिना कच्चे टेक्स्ट को पार्स किए।

स्ट्रीमिंग प्रतिक्रियाएं सक्षम करें

अपने अनुरोध में stream: true सेट करें ताकि सर्वर-सेंट इवेंट्स (SSE) प्राप्त हों। यह आपको टेक्स्ट को जनरेट होते ही उपयोगकर्ताओं को प्रदर्शित करने की अनुमति देता है, जिससे संकीर्ण विलंबता में सुधार होता है। API टेक्स्ट के चंक लौटाता है, जिसे आपके क्लाइंट को संयोजित या क्रमिक रूप से रेंडर करना चाहिए।

स्ट्रीमिंग Python और Node SDKs दोनों के लिए समर्थित है। यह उन चैट इंटरफेस के लिए विशेष रूप से उपयोगी है जहाँ उपयोगकर्ता तत्काल प्रतिक्रिया की उम्मीद करते हैं। प्रत्येक चंक में प्रतिक्रिया का एक हिस्सा होता है। मॉडल तब तक जनरेट करता रहता है जब तक कि यह समाप्त नहीं हो जाता या कॉन्टेक्स्ट विंडो सीमा पर नहीं पहुंच जाता। स्ट्रीमिंग के साथ फ़ंक्शन कॉलिंग का उपयोग करते समय सुनिश्चित करें कि आपका क्लाइंट आंशिक JSON संरचनाओं को सही से संभालता है।

सीमाएं, त्रुटियां और मॉडल

हमारी API प्रति कुंजी प्रति मिनट 300 अनुरोधों के लिए एक रेट लिमिट लागू करती है। यदि आप इससे अधिक करते हैं, तो आपको 429 त्रुटि मिलेगी। अधिकतम अनुरोध बॉडी आकार 8 MB है। मॉडल खोज के लिए, GET /v1/models एंडपॉइंट का उपयोग करें। यह उपलब्ध मॉडल्स की एक सूची लौटाता है, जिसमें uncensored मॉडल ID शामिल है।

सामान्य त्रुटियों में अमान्य कुंजियों के लिए 401 और अपर्याप्त क्रेडिट के लिए 402 शामिल हैं। क्रेडिट समाप्त नहीं होते, लेकिन मुफ़्त ट्रायल क्रेडिट 7 दिनों के लिए मान्य होते हैं। हम SLA या प्रमाणपत्र प्रदान नहीं करते हैं। मॉडल किशोरों से संबंधित यौन सामग्री को ब्लॉक करता है लेकिन अन्यथा बिना सेंसर है। इन सीमाओं का उपयोग अपनी रीट्राई तर्क और उपयोगकर्ता सूचनाओं को डिज़ाइन करने के लिए उचित रूप से करने के लिए करें।

cURL

curl https://api.glmapikey.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.glmapikey.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.glmapikey.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

स्ट्रीमिंग

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

तकनीकी विवरण

API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।

मदमान
API फ़ॉर्मेटOpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें
प्रमाणीकरणAuthorization: Bearer YOUR_KEY
मॉडल IDuncensored
एंडपॉइंटPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.glmapikey.com/v1
पैरामीटरtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
अधिकतम आउटपुट100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं)
फ़ंक्शन कॉलिंगहाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें
कॉन्टेक्स्ट विंडो100,000 टोकन (इनपुट + आउटपुट मिलाकर)
स्ट्रीमिंगहाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग
JSON मोडresponse_format: {"type": "json_object"}
अनुरोध का आकार8 MB तक
रेट लिमिटप्रति कुंजी प्रति मिनट 300 अनुरोध
समानांतर अनुरोधप्रति कुंजी एक साथ 8 तक
रिस्पॉन्स हेडरX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
बोनस$50 से +5%, $100 से +10%
बिलिंगप्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त
मुफ़्त ट्रायल क्रेडिट$0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300)
वैधताभुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं
कीमतप्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00
टॉप-अपUSDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि
कुंजियाँहर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है
साइन इनGoogle या ईमेल और पासवर्ड
सामग्रीवयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार

त्रुटि कोड

त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।

कोडप्रकारअर्थ
400bad_requestअमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक
401missing_key · invalid_key · key_revokedकुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई
402no_creditक्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू
403content_blockedनाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं
404not_foundअज्ञात एंडपॉइंट
413request_too_largeबॉडी 8 MB से बड़ी
429rate_limited · concurrency300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें
503upstream_busyमॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें

प्रश्न और उत्तर

क्या यह आधिकारिक GLM API है?

नहीं, हम एक स्वतंत्र सेवा हैं। हम एक ओपन-वेट बिना सेंसर मॉडल होस्ट करते हैं और एक OpenAI-कम्पैटिबल एंडपॉइंट प्रदान करते हैं। हम मूल GLM निर्माताओं या किसी अन्य प्रमुख AI विक्रेता से संबद्ध नहीं हैं।

क्या मैं अपना मौजूदा OpenAI कुंजी उपयोग कर सकता हूँ?

नहीं, आपको हमारी साइट से एक कुंजी की आवश्यकता है। हालाँकि, आप अपने क्लाइंट कॉन्फ़िगरेशन में बेस URL और कुंजी को बदलकर OpenAI के लिए उपयोग की जाने वाली उसी SDK कोड का उपयोग कर सकते हैं।

यदि मेरे क्रेडिट समाप्त हो जाएं तो क्या होता है?

अनुरोध 402 त्रुटि लौटाएंगे। आप किसी भी समय क्रिप्टो (USDT या USDC) का उपयोग करके अपने प्रीपेड क्रेडिट को टॉप-अप कर सकते हैं। आपके क्रेडिट कभी समाप्त नहीं होते हैं, इसलिए आप जब भी आवश्यक हो धन जोड़ सकते हैं।

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।

API कुंजी पाएँ