GLM API: wissel je client in drie regels
Koppel je bestaande code binnen minuten aan een ongecensureerde GLM API door twee configuratiewaarden aan te passen. Deze quickstart leidt je door de standaard OpenAI-compatible endpoints met je prepaid tegoed.
Vereisten: haal je sleutel op
Voordat je code schrijft, heb je een API-sleutel nodig. Bezoek de API-sleutel ophalen pagina op deze site om je aan te melden met e-mail en wachtwoord. Er is geen telefoonnummer of creditcard nodig om te beginnen. Bij registratie ontvang je gratis proeftegoed van $0,50 geldig voor 7 dagen, of je kunt opwaarderen met crypto (USDT of USDC). Je sleutel wordt direct na de aanmelding weergegeven. Bewaar deze veilig, want je kunt hem op elk moment opnieuw genereren om de oude te intrekken.
Deze sleutel verifieert alle verzoeken aan onze glm api endpoint. We gebruiken je prompts niet voor training en de sleutel is gekoppeld aan één account. Als je meer volume nodig hebt, kun je prepaid credits kopen die nooit vervallen.
Configureer base URL en sleutel
Om onze dienst als drop-in vervanging voor OpenAI te gebruiken, moet je je SDK naar onze base URL wijzen. Dit is de enige infrastructuurwijziging die nodig is. De base URL is https://api.glmapikey.com/v1. Je moet ook je autorisatieheader of SDK-client sleutel instellen op de waarde die je tijdens de aanmelding hebt ontvangen.
De meeste OpenAI-compatible clients, waaronder de officiële Python en Node SDK's, stellen je in staat de base URL te overschrijven. Hiermee behoud je je bestaande applicatielogica terwijl je het onderliggende model wijzigt. Zorg dat je sleutel correct is ingesteld voordat je verzoeken doet om authenticatiefouten te voorkomen.
Doe je eerste chat completion verzoek
Stuur een POST-verzoek naar /v1/chat/completions om tekst te genereren. Ons model accepteert standaard berichtstructuren met rollen zoals user en assistant. De model-ID die je moet opgeven is uncensored. Dit activeert het open-weight model dat op onze GPUs wordt gehost, welke is afgestemd op antwoorden zonder inhoudelijke weigeringen voor wettelijk volwassen gebruik.
Het antwoord is JSON met de gegenereerde tekst. Als je een 401-fout ziet, controleer dan je sleutel. Als je 402 ziet, is je prepaid tegoed opgebruikt. Je kunt beginnen met opwaarderen vanaf $10. Let op: we ondersteunen geen embeddings, afbeeldingen of fine-tuning in deze endpoint.
Gebruik de Python SDK
De officiële OpenAI Python library werkt direct met onze API. Initialiseer de client met je sleutel en de specifieke base URL. Deze aanpak is ideaal voor backend services of scripts waar je gestructureerde JSON-antwoorden nodig hebt. De client behandelt serialisatie en retry-logica automatisch.
Geef de modelnaam uncensored door om zeker te weten dat je ons specifieke endpoint raakt. Het contextvenster ondersteunt tot 100.000 tokens voor zowel prompt als completion samen. Dit stelt je in staat aanzienlijke invoergegevens te verwerken zonder truncatie, mits je binnen de 8 MB limiet voor request body blijft.
Gebruik de Node SDK
Voor JavaScript- en TypeScript-applicaties is het openai NPM-pakket compatibel. Configureer de client met dezelfde base URL en sleutel als het Python-voorbeeld. Dit stelt je in staat server-side rendering of API-endpoints te gebruiken die ongecensureerde tekstgeneratie vereisen. De SDK streamt gegevens efficiënt als deze correct is geconfigureerd.
Function calling wordt ondersteund in deze SDK. Je kunt functionschemas in het verzoek definiëren en het model retourneert gestructureerde JSON-uitvoer die overeenkomt met je schema. Dit maakt het eenvoudig om externe gegevensbronnen of acties in je applicatieflow te integreren zonder ruwe tekst te parseren.
Schakel streaming responses in
Stel stream: true in je verzoek in om server-sent events (SSE) te ontvangen. Hiermee kun je tekst aan gebruikers tonen terwijl deze wordt gegenereerd, wat de waargenomen latentie verbetert. De API retourneert tekstchunks die je client moet concateneren of incrementeel moet renderen.
Streaming wordt ondersteund voor zowel Python als Node SDK's. Het is vooral nuttig voor chatinterfaces waar gebruikers directe feedback verwachten. Elke chunk bevat een deel van het antwoord. Het model blijft genereren totdat het klaar is of de limiet van het contextvenster bereikt. Zorg dat je client gedeeltelijke JSON-structuren correct verwerkt als je function calling met streaming gebruikt.
Limieten, fouten en modellen
Onze API handhaaft een rate limit van 300 verzoeken per minuut per sleutel. Als je dit overschrijdt, ontvang je een 429-fout. De maximale grootte van de request body is 8 MB. Voor modeldiscoverie gebruik je de GET /v1/models endpoint. Deze retourneert een lijst met beschikbare modellen, waaronder de model-ID uncensored.
Veelvoorkomende fouten zijn 401 voor ongeldige sleutels en 402 voor onvoldoende tegoed. Credits vervallen niet, maar proeftegoed is 7 dagen geldig. We bieden geen SLA's of certificeringen aan. Het model blokkeert seksuele inhoud met minderjarigen, maar is verder ongecensureerd. Gebruik deze limieten om je retry-logica en gebruikersmeldingen passend in te richten.
cURL
curl https://api.glmapikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.glmapikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.glmapikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Model-ID | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.glmapikey.com/v1 |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| JSON-modus | response_format: {"type": "json_object"} |
| Verzoekgrootte | tot 8 MB |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inloggen | Google of e-mail en wachtwoord |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is dit de officiële GLM API?
Nee, wij zijn een onafhankelijke dienst. We hosten een open-weight ongecensureerd model en bieden een OpenAI-compatible endpoint. We zijn niet gelieerd aan de oorspronkelijke GLM-makers of andere grote AI-leveranciers.
Kan ik mijn bestaande OpenAI-sleutel gebruiken?
Nee, je hebt een sleutel van onze site nodig. Je kunt echter dezelfde SDK-code gebruiken die je voor OpenAI gebruikt door simpelweg de base URL en sleutel in je clientconfiguratie aan te passen.
Wat gebeurt er als ik geen tegoed meer heb?
Verzoeken retourneren een 402-fout. Je kunt je prepaid tegoed op elk moment opwaarderen met crypto (USDT of USDC). Je tegoed vervalt nooit, dus je kunt geld toevoegen wanneer je maar wilt.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.