IT ▾
Ottieni la chiave API

API GLM: Cambia il tuo client in tre righe

Collega il tuo codice esistente a un'API GLM senza censura in pochi minuti aggiornando due valori di configurazione. Questa guida rapida ti accompagna attraverso gli endpoint standard compatibili con OpenAI utilizzando il tuo credito prepagato.

Prerequisiti: Ottieni la tua chiave

Prima di scrivere codice, hai bisogno di una chiave API. Visita la pagina Ottieni chiave API di questo sito per registrarti con email e password. Non è necessario un numero di telefono o una carta di credito per iniziare. Alla registrazione, ricevi un credito di prova di $0,50 valido per 7 giorni, oppure puoi ricaricare con criptovalute (USDT o USDC). La tua chiave viene visualizzata immediatamente dopo la registrazione. Conservala in modo sicuro, poiché puoi rigenerarla in qualsiasi momento per revocare quella vecchia.

Questa chiave autentica tutte le richieste al nostro endpoint glm api. Non utilizziamo i tuoi prompt per l'addestramento e la chiave è associata a un singolo account. Se hai bisogno di volumi maggiori, puoi acquistare crediti prepagati che non scadono mai.

Configura URL base e chiave

Per utilizzare il nostro servizio come sostituzione drop-in per OpenAI, devi puntare il tuo SDK al nostro URL base. Questa è l'unica modifica all'infrastruttura richiesta. L'URL base è https://api.glmapikey.com/v1. Devi anche impostare l'intestazione di autorizzazione o la chiave del client SDK sul valore ricevuto durante la registrazione.

La maggior parte dei client compatibili con OpenAI, inclusi gli SDK ufficiali Python e Node, ti consente di sovrascrivere l'URL base. Questo ti permette di mantenere la logica della tua applicazione esistente mentre cambi il modello sottostante. Assicurati che la tua chiave sia impostata correttamente prima di effettuare richieste per evitare errori di autenticazione.

Esegui la tua prima richiesta di completamento chat

Invia una richiesta POST a /v1/chat/completions per generare testo. Il nostro modello accetta strutture di messaggio standard con ruoli come user e assistant. L'ID del modello che devi specificare è uncensored. Questo attiva il modello open-weight ospitato sulle nostre GPU, ottimizzato per rispondere senza rifiuti di contenuti per uso adulto legale.

La risposta sarà un JSON contenente il testo generato. Se incontri un errore 401, verifica la tua chiave. Se vedi 402, il tuo credito prepagato è stato esaurito. Puoi ricaricare a partire da $10. Nota che non supportiamo embedding, immagini o fine-tuning in questo endpoint.

Usa l'SDK Python

La libreria ufficiale OpenAI Python funziona direttamente con la nostra API. Inizializza il client con la tua chiave e l'URL base specifico. Questo approccio è ideale per servizi backend o script in cui hai bisogno di risposte JSON strutturate. Il client gestisce la serializzazione e la logica di retry automaticamente.

Passa il nome del modello uncensored per assicurarti di raggiungere il nostro endpoint specifico. La finestra di contesto supporta fino a 100.000 token per prompt e completamento combinati. Questo consente dati di input sostanziali senza troncamento, purché tu rimanga entro il limite di 8 MB del corpo della richiesta.

Usa l'SDK Node

Per applicazioni JavaScript e TypeScript, il pacchetto NPM openai è compatibile. Configura il client con lo stesso URL base e chiave dell'esempio Python. Questo abilita il rendering lato server o gli endpoint API che richiedono generazione di testo senza censura. L'SDK trasmette i dati in modo efficiente se configurato correttamente.

La chiamata di funzioni è supportata in questo SDK. Puoi definire gli schemi delle funzioni nella richiesta e il modello restituirà output JSON strutturati che corrispondono al tuo schema. Questo rende facile integrare fonti di dati o azioni esterne nel flusso della tua applicazione senza analizzare il testo grezzo.

Abilita le risposte in streaming

Imposta stream: true nella tua richiesta per ricevere eventi inviati dal server (SSE). Questo ti permette di visualizzare il testo agli utenti mentre viene generato, migliorando la latenza percepita. L'API restituisce chunk di testo che il tuo client deve concatenare o renderizzare incrementalmente.

Lo streaming è supportato sia per gli SDK Python che Node. È particolarmente utile per le interfacce chat in cui gli utenti si aspettano feedback immediati. Ogni chunk contiene una parte della risposta. Il modello continua la generazione fino al completamento o al raggiungimento del limite della finestra di contesto. Assicurati che il tuo client gestisca correttamente le strutture JSON parziali se utilizzi la chiamata di funzioni con lo streaming.

Limiti, errori e modelli

La nostra API applica un limite di 300 richieste al minuto per chiave. Superato il limite, ricevi un errore 429. La dimensione massima del corpo è 8 MB. Per scoprire i modelli, usa l'endpoint GET /v1/models. Restituisce i modelli disponibili, incluso l'ID del modello uncensored.

Gli errori comuni includono 401 per chiavi non valide e 402 per credito insufficiente. I crediti non scadono mai, ma i crediti di prova sono validi per 7 giorni. Non offriamo SLA o certificazioni. Il modello blocca i contenuti sessuali che coinvolgono minori ma è altrimenti senza censura. Usa questi limiti per progettare la logica di retry e le notifiche utente in modo appropriato.

cURL

curl https://api.glmapikey.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.glmapikey.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.glmapikey.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Specifiche tecniche

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
AutenticazioneAuthorization: Bearer YOUR_KEY
ID modellouncensored
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.glmapikey.com/v1
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Finestra di contesto100.000 token (input + output)
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Modalità JSONresponse_format: {"type": "json_object"}
Dimensionefino a 8 MB per richiesta
Limite di frequenza300 richieste al minuto per chiave
Concorrenza8 richieste contemporanee per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Bonus+5% da $50, +10% da $100
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Scadenzail credito pagato non scade, nessun abbonamento
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
AccessoGoogle oppure e-mail e password
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Questa è l'API GLM ufficiale?

No, siamo un servizio indipendente. Ospitiamo un modello open-weight senza censura e forniamo un endpoint compatibile con OpenAI. Non siamo affiliati con i creatori originali di GLM o con altri grandi fornitori di IA.

Posso usare la mia chiave OpenAI esistente?

No, hai bisogno di una chiave dal nostro sito. Tuttavia, puoi utilizzare lo stesso codice SDK che usi per OpenAI semplicemente modificando l'URL base e la chiave nella configurazione del client.

Cosa succede se rimango senza crediti?

Le richieste restituiranno un errore 402. Puoi ricaricare il tuo credito prepagato in qualsiasi momento utilizzando criptovalute (USDT o USDC). I tuoi crediti non scadono mai, quindi puoi aggiungere fondi quando ne hai bisogno.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL base. È tutta la configurazione.

Ottieni la chiave API