FR ▾
Obtenir une clé API

API GLM : Changez de client en trois lignes

Connectez votre code existant à une API GLM sans censure en quelques minutes en mettant à jour deux valeurs de configuration. Ce guide rapide vous accompagne dans l’utilisation des endpoints compatibles OpenAI standard avec votre crédit prépayé.

Prérequis : Obtenez votre clé

Avant d'écrire du code, vous avez besoin d'une clé API. Visitez la page Obtenir la clé API de ce site pour vous inscrire avec un e-mail et un mot de passe. Aucun numéro de téléphone ni carte bancaire n'est requis pour commencer. À l'inscription, vous recevez un crédit d'essai gratuit de 0,50 $ valable 7 jours, ou vous pouvez recharger avec des cryptomonnaies (USDT ou USDC). Votre clé s'affiche immédiatement après l'inscription. Stockez-la en toute sécurité, car vous pouvez la régénérer à tout moment pour révoquer l'ancienne.

Cette clé authentifie toutes les requêtes vers notre endpoint glm api. Nous n'utilisons pas vos prompts pour l'entraînement, et la clé est liée à un seul compte. Si vous avez besoin de plus de volume, vous pouvez acheter des crédits prépayés qui n'expirent jamais.

Configurez l'URL de base et la clé

Pour utiliser notre service comme solution de remplacement prêt à l’emploi pour OpenAI, vous devez pointer votre SDK vers notre URL de base. C'est le seul changement d'infrastructure requis. L'URL de base est https://api.glmapikey.com/v1. Vous devez également définir votre en-tête d'autorisation ou la clé du client SDK sur la valeur reçue lors de l'inscription.

La plupart des clients compatibles OpenAI, y compris les SDK Python et Node officiels, vous permettent de remplacer l'URL de base. Cela vous permet de conserver la logique de votre application existante tout en changeant le modèle sous-jacent. Assurez-vous que votre clé est définie correctement avant d'effectuer des requêtes pour éviter les erreurs d'authentification.

Effectuez votre première requête de complétion de chat

Envoyez une requête POST vers /v1/chat/completions pour générer du texte. Notre modèle accepte des structures de messages standard avec des rôles comme user et assistant. L'ID de modèle que vous devez spécifier est uncensored. Cela déclenche le modèle à poids ouverts hébergé sur nos GPU, qui est ajusté pour répondre sans refus de contenu pour une utilisation adulte légale.

La réponse sera un JSON contenant le texte généré. Si vous rencontrez une erreur 401, vérifiez votre clé. Si vous voyez 402, votre crédit prépayé est épuisé. Vous pouvez recharger à partir de 10 $. Notez que nous ne prenons pas en charge les embeddings, les images ou le fine-tuning dans cet endpoint.

Utilisez le SDK Python

La bibliothèque Python officielle OpenAI fonctionne directement avec notre API. Initialisez le client avec votre clé et l'URL de base spécifique. Cette approche est idéale pour les services backend ou les scripts où vous avez besoin de réponses JSON structurées. Le client gère la sérialisation et la logique de nouvelle tentative automatiquement.

Transmettez le nom de modèle uncensored pour vous assurer que vous utilisez notre endpoint spécifique. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens pour le prompt et la complétion combinés. Cela permet d'ingérer des données d'entrée substantielles sans troncature, à condition de respecter la limite de corps de requête de 8 MB.

Utilisez le SDK Node

Pour les applications JavaScript et TypeScript, le package NPM openai est compatible. Configurez le client avec la même URL de base et la même clé que l'exemple Python. Cela permet le rendu côté serveur ou les endpoints API qui nécessitent une génération de texte sans censure. Le SDK diffuse les données efficacement si il est configuré correctement.

L'appel de fonctions est pris en charge dans ce SDK. Vous pouvez définir des schémas de fonctions dans la requête, et le modèle retournera des sorties JSON structurées qui correspondent à votre schéma. Cela facilite l'intégration de sources de données ou d'actions externes dans le flux de votre application sans analyser le texte brut.

Activez les réponses en streaming

Définissez stream: true dans votre requête pour recevoir des événements envoyés par le serveur (SSE). Cela vous permet d'afficher le texte aux utilisateurs au fur et à mesure de sa génération, améliorant la latence perçue. L'API retourne des chunks de texte que votre client doit concaténer ou rendre de manière incrémentale.

Le streaming est pris en charge pour les SDK Python et Node. Il est particulièrement utile pour les interfaces de chat où les utilisateurs s'attendent à une réponse immédiate. Chaque chunk contient une partie de la réponse. Le modèle continue de générer jusqu'à ce qu'il ait terminé ou atteint la limite de la fenêtre de contexte. Assurez-vous que votre client gère correctement les structures JSON partielles si vous utilisez l'appel de fonctions avec le streaming.

Limites, erreurs et modèles

Notre API applique une limite de débit de 300 requêtes par minute par clé. Si vous dépassez ce seuil, vous recevrez une erreur 429. La taille maximale du corps de la requête est de 8 MB. Pour la découverte des modèles, utilisez l'endpoint GET /v1/models. Il retourne une liste des modèles disponibles, y compris l'ID de modèle uncensored.

Les erreurs courantes incluent 401 pour les clés invalides et 402 pour un crédit insuffisant. Les crédits n’expirent jamais, mais les crédits d’essai gratuit sont valables 7 jours. Nous ne proposons pas de SLA ni de certifications. Le modèle bloque le contenu sexuel impliquant des mineurs, mais est sinon sans censure. Utilisez ces limites pour concevoir votre logique de nouvelle tentative et vos notifications utilisateur de manière appropriée.

cURL

curl https://api.glmapikey.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.glmapikey.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.glmapikey.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Fonctions et limites

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
AuthentificationAuthorization: Bearer YOUR_KEY
ID du modèleuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.glmapikey.com/v1
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Fenêtre de contexte100 000 tokens (entrée + sortie)
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Mode JSONresponse_format: {"type": "json_object"}
Taillejusqu'à 8 Mo par requête
Limite de débit300 requêtes par minute et par clé
Concurrence8 requêtes simultanées par clé
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Bonus+5 % dès 50 $, +10 % dès 100 $
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Validitéle crédit payé n'expire jamais, sans abonnement
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Clésune clé active par compte ; une nouvelle remplace l'ancienne
ConnexionGoogle ou e-mail et mot de passe
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

S'agit-il de l'API GLM officielle ?

Non, nous sommes un service indépendant. Nous hébergeons un modèle à poids ouverts sans censure et fournissons un endpoint compatible OpenAI. Nous ne sommes pas affiliés aux créateurs originaux de GLM ni à aucun autre grand fournisseur d'IA.

Puis-je utiliser ma clé OpenAI existante ?

Non, vous avez besoin d'une clé depuis notre site. Cependant, vous pouvez utiliser le même code SDK que pour OpenAI en modifiant simplement l'URL de base et la clé dans la configuration de votre client.

Que se passe-t-il si je manque de crédits ?

Les requêtes retourneront une erreur 402. Vous pouvez recharger votre crédit prépayé à tout moment en utilisant des cryptomonnaies (USDT ou USDC). Vos crédits n'expirent jamais, vous pouvez donc ajouter des fonds lorsque vous en avez besoin.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API