Подключение к Velorai
VELORAI / WORKSPACE

Подключение к Velorai

Выберите приложение и модель. Скопируйте параметры и следуйте инструкции.

Параметры подключения

Текст, изображения и инструменты · вход $0.40 / кеш $0.14 / выход $0.90 за 1 млн токенов.

2. Скопируйте в настройки клиента

Base URLhttps://velorai.lol/v1
Model IDz-ai/glm-5.3-flash-uncensored
Context Window1048576
Max output tokens16384

API Key: ваш ключ из раздела «API-ключи». Ключ одинаков для обеих моделей. Не вставляйте пароль от кабинета.

Формат API: OpenAI / Chat Completions. К Base URL не нужно дописывать /chat/completions.

Основной гайдChat Completions

ZCode · подключение

Выберите модель выше и перенесите параметры в ZCode. Терминал для настройки не нужен.

Показать схему настройки
Схема настройки Значения для вашего клиента
Velorai · подключение
1
https://velorai.lol/v1
2
YOUR_VELORAI_API_KEY
3
z-ai/glm-5.3-flash-uncensored
  1. 1
    Адрес API

    Укажите полный адрес с /v1 на конце.

  2. 2
    Ваш ключ

    Замените YOUR_VELORAI_API_KEY ключом из кабинета.

  3. 3
    Сохраните и выберите GLM

    Откройте новый чат после смены модели.

Z
Velorai + ZCode

Выбранная модель для чата, работы с файлами и инструментами. Управляйте ключами и расходами в этом кабинете.

Установить ZCode

3. Подключите ZCode · подключение

  1. 1

    Создайте ключ в разделе «API-ключи» и убедитесь, что на балансе есть средства. Если ключ уже есть, используйте его.

  2. 2

    В ZCode откройте Settings → Model Settings → Add Provider. Название провайдера: Velorai. Если Velorai уже добавлен, откройте его настройки.

  3. 3

    Вставьте Base URL и свой API Key из блока выше. Используйте OpenAI / Chat Completions; Anthropic Base URL оставьте пустым. Сохраните.

  4. 4

    Нажмите Add Model. Скопируйте Model ID из блока выше. В Advanced задайте Context Window = 1048576 и Max output tokens = 16384. Включите Image Support.

  5. 5

    Включите провайдер и модель через Enable. Сохраните настройки, создайте новую задачу и выберите модель в группе Velorai.

  6. 6

    Напишите «Ответь одним словом: готово». После ответа проверьте запрос и стоимость в разделе «Использование» Velorai.

16 384 — для кода. Меньший бюджет снижает резерв средств.

Контекст — 1 048 576 токенов для входа и ответа вместе. Бюджет выше меняет примеры на этой странице; примените их в своём клиенте. Если ответ завершился с finish_reason: length, увеличьте бюджет или разбейте задачу.

ZCode · Model Settings
Provider name: Velorai
Protocol: OpenAI / Chat Completions
OpenAI Base URL: https://velorai.lol/v1
Anthropic Base URL: (оставить пустым)
API Key: YOUR_VELORAI_API_KEY
Model ID: z-ai/glm-5.3-flash-uncensored
Context Window: 1048576
Max output tokens: 16384
Image support: enabled

После смены модели или окна контекста начните новую задачу. Не добавляйте к Model ID [1m] или другие суффиксы.

Официальная документация

Если что-то не подключается

Модель не появилась в списке

Проверьте Enable у провайдера и модели. Добавьте Model ID вручную, сохраните и заново откройте выбор модели. Выбирайте группу Velorai.

Вижу 200K вместо 1M

В Advanced откройте Context Window и задайте 1048576 для вашей пользовательской модели. После сохранения создайте новую задачу. Раннее сжатие истории может быть нормальным: ZCode оставляет место для ответа.

Ошибка 401 или неверный ключ

Используйте ключ из Velorai, не пароль кабинета. Проверьте отсутствие пробелов и переносов. Если ключ был отозван, создайте новый. Каталог моделей публичный: его загрузка сама по себе не проверяет ключ.

Ошибка 402 или недостаточно средств

Проверьте доступный баланс. До генерации нужен резерв на вход и бюджет ответа; после ответа списывается фактический расход по usage. Уменьшение Max output tokens может снизить резерв.

404, Anthropic или Responses в ошибке

В OpenAI Base URL должен быть https://velorai.lol/v1. Anthropic URL оставьте пустым. Не добавляйте /chat/completions к Base URL — путь дописывает клиент.

Ответ обрывается или долго ждёт

При finish_reason: length увеличьте Max output tokens либо разбейте задачу. Для длинной генерации нужен потоковый режим. При сетевой ошибке проверьте историю запросов перед повтором, чтобы не запускать дубликаты.

Не принимается изображение

Наш API принимает изображения, но возможность прикрепления зависит от клиента и модели, выбранной в ZCode. Начните с одного небольшого PNG или JPEG. При 413 уменьшите размер; HTTP-запрос ограничен 32 МиБ.

Как проверить инструменты и расходы

В отдельном тестовом проекте попросите прочитать README и предложить небольшую правку. Проверяйте план, изменения файлов и разрешения ZCode. В Velorai видны вход, выход, кеш и стоимость каждого запроса.

Можно ли прописать reasoning_effort в options?

Произвольные параметры в options стороннего провайдера ZCode могут игнорироваться. Настраивайте доступные поля через интерфейс. Встроенные инструменты и разрешения ZCode настраиваются отдельно от подключения модели.

Подключение через API Velorai оплачивается с баланса Velorai. Это отдельный доступ, который не использует квоту Coding Plan. Гайд описывает обычную работу с собственными проектами; интерфейс может отличаться между версиями ZCode.

Как проверить подключение

Отправьте короткое сообщение. Ответ модели и запись в разделе «Использование» подтверждают прохождение запроса. Генерация оплачивается по тарифу.

GLM 5.3 Flash Uncensored · стоимость за 1 млн токеновВход $0.40Чтение кеша $0.14Выход $0.90

Кеш — часть входных токенов. Скидка применяется к подтверждённому числу cached_tokens; остальной вход оплачивается по обычной цене. Отдельной платы за запись кеша нет.

Лимиты, ошибки и совместимость

Обе модели поддерживают текст, инструменты и потоковые ответы через Chat Completions. Изображения доступны только для Flash. Стандартные лимиты — 30 запросов в минуту и 3 одновременно; персональные лимиты смотрите в разделе моделей кабинета. HTTP-запрос — до 32 МиБ.

Если бюджет ответа не передан, API использует 16 384 токена. Это значение по умолчанию, а не максимум модели. Для Abliterated максимальный ответ — 131 072 токена. Клиент может передать свой max_tokens или max_completion_tokens; размер входа и допустимый выход проверяет модель.

  • 401: проверьте ключ Velorai. Без ключа /v1/models показывает публичный каталог; с ключом проверяет доступ и показывает ваш тариф.
  • 402: средств не хватает на резерв. Пополните баланс или уменьшите бюджет ответа. Изображения могут требовать большего резерва; итоговое списание определяется usage.
  • 400 / 413: проверьте JSON, размер истории, изображения и бюджет ответа.
  • 404: используйте Base URL с /v1 и Chat Completions. Responses, Anthropic Messages, FIM и embeddings сейчас недоступны.
  • 429: дождитесь завершения запросов и повторите позже.
  • Ответ обрезан: проверьте finish_reason. При length увеличьте бюджет, начните новый чат или разделите задачу.
  • Тайм-аут: используйте streaming, сократите задачу или увеличьте тайм-аут клиента. Не повторяйте оплачиваемые запросы бесконечно.

Гайды основаны на документации клиентов. Названия настроек зависят от версии; полный агентный сценарий каждой IDE отдельно не проверялся.