GLM-API: Wechsle deinen Client in drei Zeilen
Verbinde deinen bestehenden Code in Minuten mit einer unzensierten GLM-API, indem du zwei Konfigurationswerte aktualisierst. Diese Schnellstartanleitung führt dich durch die Standard-Endpunkte im OpenAI-Kompatibilitätsmodus unter Verwendung deines Prepaid-Guthabens.
Voraussetzungen: Hole deinen Schlüssel
Bevor du Code schreibst, benötigst du einen API-Schlüssel. Besuche die Seite API-Schlüssel erhalten auf dieser Website, um dich mit E-Mail und Passwort anzumelden. Es werden keine Telefonnummer oder Kreditkarte benötigt. Nach der Registrierung erhältst du ein Testguthaben von 0,50 $, das 7 Tage gültig ist, oder du kannst mit Krypto (USDT oder USDC) aufladen. Dein Schlüssel wird direkt nach der Anmeldung angezeigt. Speichere ihn sicher, da du ihn jederzeit neu generieren kannst, um den alten zu widerrufen.
Dieser Schlüssel authentifiziert alle Anfragen an unseren glm api Endpunkt. Wir verwenden deine Prompts nicht zum Training, und der Schlüssel ist an ein einzelnes Konto gebunden. Wenn du höheres Volumen benötigst, kannst du Prepaid-Guthaben kaufen, das nie verfällt.
Konfiguriere Basis-URL und Schlüssel
Um unseren Dienst als sofort einsetzbare Alternative zu OpenAI zu nutzen, musst du dein SDK auf unsere Basis-URL verweisen. Dies ist die einzige Infrastrukturänderung. Die Basis-URL lautet https://api.glmapikey.com/v1. Du musst außerdem deinen Autorisierungsheader oder den SDK-Client-Schlüssel auf den Wert setzen, den du bei der Anmeldung erhalten hast.
Die meisten OpenAI-kompatiblen Clients, einschließlich der offiziellen Python- und Node-SDKs, ermöglichen es dir, die Basis-URL zu überschreiben. So kannst du deine bestehende Anwendungslogik beibehalten und gleichzeitig das zugrunde liegende Modell wechseln. Stelle sicher, dass dein Schlüssel korrekt gesetzt ist, bevor du Anfragen stellst, um Authentifizierungsfehler zu vermeiden.
Stelle deine erste Chat-Vervollständigungsanfrage
Sende eine POST-Anfrage an /v1/chat/completions, um Text zu generieren. Unser Modell akzeptiert Standard-Nachrichtenstrukturen mit Rollen wie user und assistant. Die Modell-ID, die du angeben musst, ist uncensored. Dies löst das Open-Weight-Modell aus, das auf unseren GPUs gehostet wird und darauf abgestimmt ist, ohne Inhaltsablehnungen für die legale erwachsene Nutzung zu antworten.
Die Antwort ist JSON, das den generierten Text enthält. Wenn du einen 401-Fehler siehst, überprüfe deinen Schlüssel. Wenn du 402 siehst, ist dein Prepaid-Guthaben aufgebraucht. Du kannst ab 10 $ aufladen. Beachte, dass wir in diesem Endpunkt keine Embeddings, Bilder oder Fine-Tuning unterstützen.
Verwende das Python-SDK
Die offizielle OpenAI-Python-Bibliothek funktioniert direkt mit unserer API. Initialisiere den Client mit deinem Schlüssel und der spezifischen Basis-URL. Dieser Ansatz ist ideal für Backend-Dienste oder Skripte, bei denen du strukturierte JSON-Antworten benötigst. Der Client übernimmt die Serialisierung und Wiederholungslogik automatisch.
Gib den Modellnamen uncensored an, um sicherzustellen, dass du unseren spezifischen Endpunkt triffst. Das Kontextfenster unterstützt bis zu 100.000 Token für Prompt und Vervollständigung zusammen. Dies ermöglicht umfangreiche Eingabedaten ohne Kürzung, solange du innerhalb der 8-MB-Anfragekörpergrenze bleibst.
Verwende das Node-SDK
Für JavaScript- und TypeScript-Anwendungen ist das openai NPM-Paket kompatibel. Konfiguriere den Client mit derselben Basis-URL und demselben Schlüssel wie im Python-Beispiel. Dies ermöglicht serverseitiges Rendering oder API-Endpunkte, die unzensierte Textgenerierung erfordern. Das SDK streamt Daten effizient, wenn es korrekt konfiguriert ist.
Function Calling wird in diesem SDK unterstützt. Du kannst Funktionsschemata in der Anfrage definieren, und das Modell gibt strukturierte JSON-Ausgaben zurück, die deinem Schema entsprechen. Dies macht es einfach, externe Datenquellen oder Aktionen in deinen Anwendungsablauf zu integrieren, ohne Rohdaten analysieren zu müssen.
Aktiviere Streaming-Antworten
Setze stream: true in deiner Anfrage, um Server-Sent Events (SSE) zu erhalten. So kannst du Text an Benutzer anzeigen, während er generiert wird, was die wahrgenommene Latenz verbessert. Die API gibt Text-Chunks zurück, die dein Client verketten oder inkrementell rendern muss.
Streaming wird für Python- und Node-SDKs unterstützt. Es ist besonders nützlich für Chat-Schnittstellen, bei denen Benutzer sofortiges Feedback erwarten. Jeder Chunk enthält einen Teil der Antwort. Das Modell generiert weiter, bis es abgeschlossen ist oder die Kontextfenstergrenze erreicht. Stelle sicher, dass dein Client partielle JSON-Strukturen korrekt verarbeitet, wenn du Function Calling mit Streaming verwendest.
Limits, Fehler und Modelle
Unsere API legt ein Ratenlimit von 300 Anfragen pro Minute pro Schlüssel fest. Wird dieses überschritten, erhältst du einen 429-Fehler. Die maximale Größe des Anfragekörpers beträgt 8 MB. Zur Modellsuche nutze den Endpunkt GET /v1/models. Er gibt eine Liste verfügbarer Modelle zurück, einschließlich der Modell-ID uncensored.
Häufige Fehler sind 401 für ungültige Schlüssel und 402 für unzureichendes Guthaben. Guthaben verfallen nicht, aber Testguthaben sind 7 Tage gültig. Wir bieten keine SLAs oder Zertifizierungen an. Das Modell blockiert sexuelle Inhalte, die Minderjährige betreffen, ist aber sonst unzensiert. Nutze diese Limits, um deine Wiederholungslogik und Benutzernachrichten angemessen zu gestalten.
cURL
curl https://api.glmapikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.glmapikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.glmapikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Funktionen und Limits
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.glmapikey.com/v1 |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| JSON-Modus | response_format: {"type": "json_object"} |
| Anfragegröße | bis 8 MB |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist dies die offizielle GLM-API?
Nein, wir sind ein unabhängiger Dienst. Wir hosten ein Open-Weight-Modell ohne Inhaltsfilter und bieten einen OpenAI-kompatiblen Endpunkt. Wir stehen in keiner Verbindung zu den ursprünglichen GLM-Erstellern oder anderen großen KI-Anbietern.
Kann ich meinen bestehenden OpenAI-Schlüssel verwenden?
Nein, du benötigst einen Schlüssel von unserer Seite. Du kannst jedoch denselben SDK-Code wie für OpenAI verwenden, indem du einfach die Basis-URL und den Schlüssel in deiner Client-Konfiguration änderst.
Was passiert, wenn mir die Guthaben ausgehen?
Anfragen geben einen 402-Fehler zurück. Du kannst dein Prepaid-Guthaben jederzeit per Krypto (USDT oder USDC) aufladen. Deine Guthaben verfallen nie, sodass du Geld hinzufügen kannst, wann immer du es brauchst.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.