DE ▾
API-Schlüssel erhalten

GLM-API: Wechsle deinen Client in drei Zeilen

Verbinde deinen bestehenden Code in Minuten mit einer unzensierten GLM-API, indem du zwei Konfigurationswerte aktualisierst. Diese Schnellstartanleitung führt dich durch die Standard-Endpunkte im OpenAI-Kompatibilitätsmodus unter Verwendung deines Prepaid-Guthabens.

Voraussetzungen: Hole deinen Schlüssel

Bevor du Code schreibst, benötigst du einen API-Schlüssel. Besuche die Seite API-Schlüssel erhalten auf dieser Website, um dich mit E-Mail und Passwort anzumelden. Es werden keine Telefonnummer oder Kreditkarte benötigt. Nach der Registrierung erhältst du ein Testguthaben von 0,50 $, das 7 Tage gültig ist, oder du kannst mit Krypto (USDT oder USDC) aufladen. Dein Schlüssel wird direkt nach der Anmeldung angezeigt. Speichere ihn sicher, da du ihn jederzeit neu generieren kannst, um den alten zu widerrufen.

Dieser Schlüssel authentifiziert alle Anfragen an unseren glm api Endpunkt. Wir verwenden deine Prompts nicht zum Training, und der Schlüssel ist an ein einzelnes Konto gebunden. Wenn du höheres Volumen benötigst, kannst du Prepaid-Guthaben kaufen, das nie verfällt.

Konfiguriere Basis-URL und Schlüssel

Um unseren Dienst als sofort einsetzbare Alternative zu OpenAI zu nutzen, musst du dein SDK auf unsere Basis-URL verweisen. Dies ist die einzige Infrastrukturänderung. Die Basis-URL lautet https://api.glmapikey.com/v1. Du musst außerdem deinen Autorisierungsheader oder den SDK-Client-Schlüssel auf den Wert setzen, den du bei der Anmeldung erhalten hast.

Die meisten OpenAI-kompatiblen Clients, einschließlich der offiziellen Python- und Node-SDKs, ermöglichen es dir, die Basis-URL zu überschreiben. So kannst du deine bestehende Anwendungslogik beibehalten und gleichzeitig das zugrunde liegende Modell wechseln. Stelle sicher, dass dein Schlüssel korrekt gesetzt ist, bevor du Anfragen stellst, um Authentifizierungsfehler zu vermeiden.

Stelle deine erste Chat-Vervollständigungsanfrage

Sende eine POST-Anfrage an /v1/chat/completions, um Text zu generieren. Unser Modell akzeptiert Standard-Nachrichtenstrukturen mit Rollen wie user und assistant. Die Modell-ID, die du angeben musst, ist uncensored. Dies löst das Open-Weight-Modell aus, das auf unseren GPUs gehostet wird und darauf abgestimmt ist, ohne Inhaltsablehnungen für die legale erwachsene Nutzung zu antworten.

Die Antwort ist JSON, das den generierten Text enthält. Wenn du einen 401-Fehler siehst, überprüfe deinen Schlüssel. Wenn du 402 siehst, ist dein Prepaid-Guthaben aufgebraucht. Du kannst ab 10 $ aufladen. Beachte, dass wir in diesem Endpunkt keine Embeddings, Bilder oder Fine-Tuning unterstützen.

Verwende das Python-SDK

Die offizielle OpenAI-Python-Bibliothek funktioniert direkt mit unserer API. Initialisiere den Client mit deinem Schlüssel und der spezifischen Basis-URL. Dieser Ansatz ist ideal für Backend-Dienste oder Skripte, bei denen du strukturierte JSON-Antworten benötigst. Der Client übernimmt die Serialisierung und Wiederholungslogik automatisch.

Gib den Modellnamen uncensored an, um sicherzustellen, dass du unseren spezifischen Endpunkt triffst. Das Kontextfenster unterstützt bis zu 100.000 Token für Prompt und Vervollständigung zusammen. Dies ermöglicht umfangreiche Eingabedaten ohne Kürzung, solange du innerhalb der 8-MB-Anfragekörpergrenze bleibst.

Verwende das Node-SDK

Für JavaScript- und TypeScript-Anwendungen ist das openai NPM-Paket kompatibel. Konfiguriere den Client mit derselben Basis-URL und demselben Schlüssel wie im Python-Beispiel. Dies ermöglicht serverseitiges Rendering oder API-Endpunkte, die unzensierte Textgenerierung erfordern. Das SDK streamt Daten effizient, wenn es korrekt konfiguriert ist.

Function Calling wird in diesem SDK unterstützt. Du kannst Funktionsschemata in der Anfrage definieren, und das Modell gibt strukturierte JSON-Ausgaben zurück, die deinem Schema entsprechen. Dies macht es einfach, externe Datenquellen oder Aktionen in deinen Anwendungsablauf zu integrieren, ohne Rohdaten analysieren zu müssen.

Aktiviere Streaming-Antworten

Setze stream: true in deiner Anfrage, um Server-Sent Events (SSE) zu erhalten. So kannst du Text an Benutzer anzeigen, während er generiert wird, was die wahrgenommene Latenz verbessert. Die API gibt Text-Chunks zurück, die dein Client verketten oder inkrementell rendern muss.

Streaming wird für Python- und Node-SDKs unterstützt. Es ist besonders nützlich für Chat-Schnittstellen, bei denen Benutzer sofortiges Feedback erwarten. Jeder Chunk enthält einen Teil der Antwort. Das Modell generiert weiter, bis es abgeschlossen ist oder die Kontextfenstergrenze erreicht. Stelle sicher, dass dein Client partielle JSON-Strukturen korrekt verarbeitet, wenn du Function Calling mit Streaming verwendest.

Limits, Fehler und Modelle

Unsere API legt ein Ratenlimit von 300 Anfragen pro Minute pro Schlüssel fest. Wird dieses überschritten, erhältst du einen 429-Fehler. Die maximale Größe des Anfragekörpers beträgt 8 MB. Zur Modellsuche nutze den Endpunkt GET /v1/models. Er gibt eine Liste verfügbarer Modelle zurück, einschließlich der Modell-ID uncensored.

Häufige Fehler sind 401 für ungültige Schlüssel und 402 für unzureichendes Guthaben. Guthaben verfallen nicht, aber Testguthaben sind 7 Tage gültig. Wir bieten keine SLAs oder Zertifizierungen an. Das Modell blockiert sexuelle Inhalte, die Minderjährige betreffen, ist aber sonst unzensiert. Nutze diese Limits, um deine Wiederholungslogik und Benutzernachrichten angemessen zu gestalten.

cURL

curl https://api.glmapikey.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.glmapikey.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.glmapikey.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Funktionen und Limits

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
AuthentifizierungAuthorization: Bearer YOUR_KEY
Modell-IDuncensored
EndpunktePOST /v1/chat/completions · GET /v1/models
Base-URLhttps://api.glmapikey.com/v1
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
JSON-Modusresponse_format: {"type": "json_object"}
Anfragegrößebis 8 MB
Ratenlimit300 Anfragen pro Minute und Schlüssel
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Bonus+5 % ab $50, +10 % ab $100
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
AnmeldungGoogle oder E-Mail und Passwort
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehler und Lösungen

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Ist dies die offizielle GLM-API?

Nein, wir sind ein unabhängiger Dienst. Wir hosten ein Open-Weight-Modell ohne Inhaltsfilter und bieten einen OpenAI-kompatiblen Endpunkt. Wir stehen in keiner Verbindung zu den ursprünglichen GLM-Erstellern oder anderen großen KI-Anbietern.

Kann ich meinen bestehenden OpenAI-Schlüssel verwenden?

Nein, du benötigst einen Schlüssel von unserer Seite. Du kannst jedoch denselben SDK-Code wie für OpenAI verwenden, indem du einfach die Basis-URL und den Schlüssel in deiner Client-Konfiguration änderst.

Was passiert, wenn mir die Guthaben ausgehen?

Anfragen geben einen 402-Fehler zurück. Du kannst dein Prepaid-Guthaben jederzeit per Krypto (USDT oder USDC) aufladen. Deine Guthaben verfallen nie, sodass du Geld hinzufügen kannst, wann immer du es brauchst.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten