RU ▾
Получить API-ключ

GLM API: Переключите клиента за три строки

Подключите существующий код к GLM API без цензуры за несколько минут, обновив два значения конфигурации. Это руководство поможет вам использовать стандартные эндпоинты, совместимые с OpenAI, с вашим предоплаченным балансом.

Предварительные требования: Получите ключ

Перед написанием кода вам нужен API-ключ. Перейдите на страницу Получить API-ключ на этом сайте, чтобы войти по электронной почте и паролю. Для начала не требуется номер телефона или кредитная карта. При регистрации вы получаете бесплатный пробный баланс в размере $0.50, действительный в течение 7 дней, или можете пополнить его криптовалютой (USDT или USDC). Ваш ключ отображается сразу после регистрации. Храните его в безопасности, так как вы можете сгенерировать новый ключ в любое время, чтобы отозвать старый.

Этот ключ аутентифицирует все запросы к нашему эндпоинту glm api. Мы не используем ваши промпты для обучения, а ключ привязан к одному аккаунту. Если вам нужен больший объем, вы можете приобрести предоплаченные кредиты, которые не сгорают.

Настройте базовый URL и ключ

Чтобы использовать наш сервис как готовую замену OpenAI, вы должны указать SDK на наш базовый URL. Это единственное изменение инфраструктуры, которое требуется. Базовый URL — https://api.glmapikey.com/v1. Вам также необходимо установить заголовок авторизации или ключ клиента SDK на значение, полученное при регистрации.

Большинство клиентов, совместимых с OpenAI, включая официальные Python и Node SDK, позволяют переопределить базовый URL. Это позволяет сохранить существующую логику приложения, изменив базовую модель. Убедитесь, что ключ установлен правильно перед отправкой запросов, чтобы избежать ошибок аутентификации.

Отправьте свой первый запрос на completion

Отправьте POST-запрос на /v1/chat/completions для генерации текста. Наша модель принимает стандартные структуры сообщений с ролями, такими как user и assistant. Идентификатор модели, который вы должны указать, — uncensored. Это запускает модель с открытыми весами, размещенную на наших GPU, которая настроена на ответы без отказов в контенте для законного использования взрослыми.

Ответ будет содержать JSON с сгенерированным текстом. Если вы получите ошибку 401, проверьте ключ. Если вы видите 402, ваш предоплаченный баланс исчерпан. Вы можете пополнить его начиная с $10. Обратите внимание, что мы не поддерживаем эмбеддинги, изображения или дообучение в этом эндпоинте.

Используйте Python SDK

Официальная библиотека Python OpenAI работает напрямую с нашим API. Инициализируйте клиента с вашим ключом и конкретным базовым URL. Этот подход идеален для бэкенд-сервисов или скриптов, где вам нужны структурированные ответы JSON. Клиент автоматически обрабатывает сериализацию и логику повторных попыток.

Укажите имя модели uncensored, чтобы обратиться к нашему конкретному эндпоинту. Контекстное окно поддерживает до 100 000 токенов для промпта и ответа в сумме. Это позволяет передавать значительные объёмы входных данных без усечения, при условии, что вы не превысите лимит тела запроса в 8 МБ.

Используйте Node SDK

Для приложений на JavaScript и TypeScript пакет NPM openai совместим. Настройте клиента с тем же базовым URL и ключом, что и в примере Python. Это позволяет выполнять серверный рендеринг или API-эндпоинты, требующие генерации текста без цензуры. SDK эффективно передает данные, если настроен правильно.

Вызов функций поддерживается в этом SDK. Вы можете определить схемы функций в запросе, и модель вернет структурированные выходные данные JSON, соответствующие вашей схеме. Это упрощает интеграцию внешних источников данных или действий в поток вашего приложения без разбора необработанного текста.

Включите потоковую передачу ответов

Установите stream: true в вашем запросе для получения событий, отправляемых сервером (SSE). Это позволяет отображать текст пользователям по мере его генерации, улучшая воспринимаемую задержку. API возвращает фрагменты текста, которые ваш клиент должен объединить или отобразить постепенно.

Потоковая передача поддерживается как для Python, так и для Node SDK. Это особенно полезно для интерфейсов чата, где пользователи ожидают немедленной обратной связи. Каждый фрагмент содержит часть ответа. Модель продолжает генерацию, пока не завершится или не достигнет лимита контекстного окна. Убедитесь, что ваш клиент правильно обрабатывает частичные структуры JSON, если вы используете вызов функций с потоковой передачей.

Лимиты, ошибки и модели

Наш API устанавливает лимит запросов в 300 запросов в минуту на ключ. Если вы превысите этот лимит, вы получите ошибку 429. Максимальный размер тела запроса составляет 8 МБ. Для обнаружения моделей используйте эндпоинт GET /v1/models. Он возвращает список доступных моделей, включая идентификатор модели uncensored.

Распространенные ошибки включают 401 для недействительных ключей и 402 для недостаточного кредита. Кредиты не сгорают, но пробные кредиты действительны в течение 7 дней. Мы не предлагаем SLA или сертификаты. Модель блокирует сексуальный контент с участием несовершеннолетних, но в остальном без цензуры. Используйте эти лимиты для проектирования логики повторных попыток и уведомлений пользователей.

cURL

curl https://api.glmapikey.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.glmapikey.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.glmapikey.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Потоковая передача

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Технические характеристики

Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.

ПараметрЗначение
Формат APIсовместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ
АвторизацияAuthorization: Bearer YOUR_KEY
ID моделиuncensored
ЭндпоинтыPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.glmapikey.com/v1
Параметрыtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Максимум ответадо остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет)
Вызов функцийда — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool
Контекстное окно100 000 токенов (вход и ответ вместе)
Потоковая передачада — server-sent events, последний фрагмент содержит расход токенов
JSON-режимresponse_format: {"type": "json_object"}
Размер запросадо 8 МБ
Лимит запросов300 запросов в минуту на ключ
Параллельные запросыдо 8 одновременно на ключ
Заголовки ответаX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Бонус+5% от $50, +10% от $100
Оплатапредоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны
Пробный баланс$0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения
Срок действияоплаченный баланс не сгорает, без подписки
Цена$0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных
ПополнениеUSDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500
Ключиодин активный ключ на аккаунт; новый заменяет старый
ВходGoogle или e-mail и пароль
Контентконтент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён

Коды ошибок

Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.

КодТипЧто значит
400bad_requestневерный JSON, пустые сообщения, неверный параметр или превышено окно контекста
401missing_key · invalid_key · key_revokedнет ключа, ключ неверный или заменён новым
402no_creditбаланс пуст — пополните, работа продолжится сразу
403content_blockedсексуальный контент с несовершеннолетними — отказ, без оплаты
404not_foundнеизвестный эндпоинт
413request_too_largeтело запроса больше 8 МБ
429rate_limited · concurrencyбольше 300/мин или 8 параллельно — подождите и повторите
503upstream_busyмодель занята — повторите через несколько секунд

Вопросы и ответы

Это официальный GLM API?

Нет, мы — независимый сервис. Мы размещаем модель с открытыми весами без цензуры и предоставляем эндпоинт, совместимый с OpenAI. Мы не связаны с создателями оригинального GLM или другими крупными ИИ-вендорами.

Могу ли я использовать свой существующий ключ OpenAI?

Нет, вам нужен ключ с нашего сайта. Однако вы можете использовать тот же код SDK, что и для OpenAI, просто изменив базовый URL и ключ в конфигурации клиента.

Что произойдет, если у меня закончатся кредиты?

Запросы вернут ошибку 402. Вы можете пополнить предоплаченный баланс в любое время с помощью криптовалюты (USDT или USDC). Ваши кредиты не сгорают, поэтому вы можете добавлять средства, когда они вам нужны.

Ваш ключ — в одной форме от вас

Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.

Получить API-ключ