API GLM: Cambia il tuo client in tre righe
Collega il tuo codice esistente a un'API GLM senza censura in pochi minuti aggiornando due valori di configurazione. Questa guida rapida ti accompagna attraverso gli endpoint standard compatibili con OpenAI utilizzando il tuo credito prepagato.
Prerequisiti: Ottieni la tua chiave
Prima di scrivere codice, hai bisogno di una chiave API. Visita la pagina Ottieni chiave API di questo sito per registrarti con email e password. Non è necessario un numero di telefono o una carta di credito per iniziare. Alla registrazione, ricevi un credito di prova di $0,50 valido per 7 giorni, oppure puoi ricaricare con criptovalute (USDT o USDC). La tua chiave viene visualizzata immediatamente dopo la registrazione. Conservala in modo sicuro, poiché puoi rigenerarla in qualsiasi momento per revocare quella vecchia.
Questa chiave autentica tutte le richieste al nostro endpoint glm api. Non utilizziamo i tuoi prompt per l'addestramento e la chiave è associata a un singolo account. Se hai bisogno di volumi maggiori, puoi acquistare crediti prepagati che non scadono mai.
Configura URL base e chiave
Per utilizzare il nostro servizio come sostituzione drop-in per OpenAI, devi puntare il tuo SDK al nostro URL base. Questa è l'unica modifica all'infrastruttura richiesta. L'URL base è https://api.glmapikey.com/v1. Devi anche impostare l'intestazione di autorizzazione o la chiave del client SDK sul valore ricevuto durante la registrazione.
La maggior parte dei client compatibili con OpenAI, inclusi gli SDK ufficiali Python e Node, ti consente di sovrascrivere l'URL base. Questo ti permette di mantenere la logica della tua applicazione esistente mentre cambi il modello sottostante. Assicurati che la tua chiave sia impostata correttamente prima di effettuare richieste per evitare errori di autenticazione.
Esegui la tua prima richiesta di completamento chat
Invia una richiesta POST a /v1/chat/completions per generare testo. Il nostro modello accetta strutture di messaggio standard con ruoli come user e assistant. L'ID del modello che devi specificare è uncensored. Questo attiva il modello open-weight ospitato sulle nostre GPU, ottimizzato per rispondere senza rifiuti di contenuti per uso adulto legale.
La risposta sarà un JSON contenente il testo generato. Se incontri un errore 401, verifica la tua chiave. Se vedi 402, il tuo credito prepagato è stato esaurito. Puoi ricaricare a partire da $10. Nota che non supportiamo embedding, immagini o fine-tuning in questo endpoint.
Usa l'SDK Python
La libreria ufficiale OpenAI Python funziona direttamente con la nostra API. Inizializza il client con la tua chiave e l'URL base specifico. Questo approccio è ideale per servizi backend o script in cui hai bisogno di risposte JSON strutturate. Il client gestisce la serializzazione e la logica di retry automaticamente.
Passa il nome del modello uncensored per assicurarti di raggiungere il nostro endpoint specifico. La finestra di contesto supporta fino a 100.000 token per prompt e completamento combinati. Questo consente dati di input sostanziali senza troncamento, purché tu rimanga entro il limite di 8 MB del corpo della richiesta.
Usa l'SDK Node
Per applicazioni JavaScript e TypeScript, il pacchetto NPM openai è compatibile. Configura il client con lo stesso URL base e chiave dell'esempio Python. Questo abilita il rendering lato server o gli endpoint API che richiedono generazione di testo senza censura. L'SDK trasmette i dati in modo efficiente se configurato correttamente.
La chiamata di funzioni è supportata in questo SDK. Puoi definire gli schemi delle funzioni nella richiesta e il modello restituirà output JSON strutturati che corrispondono al tuo schema. Questo rende facile integrare fonti di dati o azioni esterne nel flusso della tua applicazione senza analizzare il testo grezzo.
Abilita le risposte in streaming
Imposta stream: true nella tua richiesta per ricevere eventi inviati dal server (SSE). Questo ti permette di visualizzare il testo agli utenti mentre viene generato, migliorando la latenza percepita. L'API restituisce chunk di testo che il tuo client deve concatenare o renderizzare incrementalmente.
Lo streaming è supportato sia per gli SDK Python che Node. È particolarmente utile per le interfacce chat in cui gli utenti si aspettano feedback immediati. Ogni chunk contiene una parte della risposta. Il modello continua la generazione fino al completamento o al raggiungimento del limite della finestra di contesto. Assicurati che il tuo client gestisca correttamente le strutture JSON parziali se utilizzi la chiamata di funzioni con lo streaming.
Limiti, errori e modelli
La nostra API applica un limite di 300 richieste al minuto per chiave. Superato il limite, ricevi un errore 429. La dimensione massima del corpo è 8 MB. Per scoprire i modelli, usa l'endpoint GET /v1/models. Restituisce i modelli disponibili, incluso l'ID del modello uncensored.
Gli errori comuni includono 401 per chiavi non valide e 402 per credito insufficiente. I crediti non scadono mai, ma i crediti di prova sono validi per 7 giorni. Non offriamo SLA o certificazioni. Il modello blocca i contenuti sessuali che coinvolgono minori ma è altrimenti senza censura. Usa questi limiti per progettare la logica di retry e le notifiche utente in modo appropriato.
cURL
curl https://api.glmapikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.glmapikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.glmapikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| ID modello | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.glmapikey.com/v1 |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Finestra di contesto | 100.000 token (input + output) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Modalità JSON | response_format: {"type": "json_object"} |
| Dimensione | fino a 8 MB per richiesta |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Bonus | +5% da $50, +10% da $100 |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Questa è l'API GLM ufficiale?
No, siamo un servizio indipendente. Ospitiamo un modello open-weight senza censura e forniamo un endpoint compatibile con OpenAI. Non siamo affiliati con i creatori originali di GLM o con altri grandi fornitori di IA.
Posso usare la mia chiave OpenAI esistente?
No, hai bisogno di una chiave dal nostro sito. Tuttavia, puoi utilizzare lo stesso codice SDK che usi per OpenAI semplicemente modificando l'URL base e la chiave nella configurazione del client.
Cosa succede se rimango senza crediti?
Le richieste restituiranno un errore 402. Puoi ricaricare il tuo credito prepagato in qualsiasi momento utilizzando criptovalute (USDT o USDC). I tuoi crediti non scadono mai, quindi puoi aggiungere fondi quando ne hai bisogno.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL base. È tutta la configurazione.