ZubrIQ
Войти

LLM-платформа в закрытом контуре

ИИ-модели по API.
Данные остаются в закрытом контуре.

Свежие открытые модели — от компактных до флагманских 1,6T параметров — на закрытой инфраструктуре. OpenAI-совместимый API, оплата в BYN за фактически использованные токены, закрывающие документы от белорусского юрлица. Миграция — одна строка кода.

параметров моделей в каталоге
до 1,6T
параметров моделей в каталоге
кода для миграции с OpenAI API
1 строка
кода для миграции с OpenAI API
данных под вашим контролем
100%
данных под вашим контролем
app.py
from openai import OpenAI

client = OpenAI(
-   base_url="https://api.openai.com/v1",+   base_url="https://api.zubriq.by/v1",    api_key=os.environ["ZUBRIQ_API_KEY"],
)  # вся миграция — замена base_url

resp = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "Привет!"}],
)
Сервер: закрытый контур

Почему локальная платформа

Возможности мировых моделей — без вывода данных наружу

Банковская тайна, персональные данные и внутренние политики безопасности не позволяют отправлять корпоративные данные в зарубежные API. ZubrIQ решает это по-другому: инференс происходит в закрытом контуре.

Данные не уходят наружу

Запросы обрабатываются в закрытом контуре и не передаются вендору или во внешние API. Соответствие требованиям к банковской тайне и персональным данным. Ваши данные не используются для обучения моделей.

Оплата в BYN, закрывающие документы

Договор с белорусским юрлицом, счета и акты в белорусских рублях. Никаких зарубежных карт, валютных платежей и санкционных рисков.

Стабильная задержка

Выделенные GPU под вашу нагрузку — отклик стабильный и не зависит от лимитов, блокировок и внешних каналов зарубежных API.

OpenAI-совместимый API

Работает всё, что умеет работать с OpenAI: официальные SDK, LangChain, LlamaIndex, n8n. Миграция сводится к замене base_url — инфраструктуру строить не нужно.

Оплата только за токены

Потокенная тарификация: платите за фактически использованные входные и выходные токены. Без абонентской платы, минимальных объёмов и оплаты простаивающего железа.

Промышленный опыт

Команда развернула и эксплуатирует LLM-платформу в крупном банке Республики Беларусь: RAG, мультиагентные сценарии, контроль доступа, собственный GPU-кластер.

Доступ к моделям

Два режима доступа — один API

Открытые и свои модели в закрытом контуре — или шлюз к 100+ ведущим моделям мира через наши серверы. Один OpenAI-совместимый API, один счёт в BYN; режим выбираете под каждую задачу.

Закрытый контур

для чувствительных данных

Открытые и собственные модели Zubr на выделенных GPU под вашим контролем. Запросы обрабатываются в контуре и не уходят вендору или во внешние API — под банковскую тайну, персональные данные и внутренние политики.

Шлюз к коммерческим ЛЛМ

для флагманских моделей

Доступ к 100+ ведущим моделям мира через наши серверы: оплата в BYN (карта, ЕРИП, счёт), без VPN, иностранного номера и зарубежной карты. Для задач, где нужны топовые проприетарные модели, а данные не под грифом — запросы проксируются к вендору модели.

Один ключ, один OpenAI-совместимый API и общий счёт в BYN на оба режима. Миграция — замена base_url.

Экосистема

Одна платформа, а не зоопарк сервисов

Чат, конструктор ассистентов, кодинг-агент и API работают на одном ядре: собственные модели на выделенных GPU под вашим контролем, единый вход ZubrIQ ID и общий счёт за токены. Начать можно с любого слоя и добавлять остальные по мере роста.

Каталог моделей

От лёгких до флагманских — под каждую задачу

Собственное семейство моделей Zubr на базе Qwen плюс открытые модели ведущих семейств — всё развёрнуто в закрытом контуре. Каталог обновляется по мере выхода новых релизов.

Zubr · собственное семейство

модель платформы

Zubr1.0-35B-A3B — на базе Qwen3.6 (35B MoE, ~3B активных)

Модель платформы по умолчанию: ZubrIQ Chat, Code и агенты. Алиас zubr в API всегда указывает на актуальную версию; доменные файнтюны выходят минорными версиями.

SWE-bench Verified 73.4Terminal-Bench 2.0 51.5MCP-Atlas 62.8

Метрики базовой модели Qwen3.6-35B-A3B

Веса открыты на Hugging Face

Лёгкие · 2–35B

Qwen3.5-9B · Qwen3.5-27B · Qwen3.6-35B-A3B · Gemma 4

Чат-боты, классификация, модерация, простой RAG, массовые высокочастотные запросы.

Средние · 100–300B MoE

рабочая лошадка

Qwen3.5-122B-A10B · DeepSeek-V4-Flash · gpt-oss-120b

Большинство бизнес-задач: RAG, агенты, суммаризация, извлечение данных, аналитика.

Кодинг

Qwen3.6-35B-A3B · Qwen3-Coder-480B

Генерация и ревью кода, ассистенты разработчика, автоматизация DevOps.

Флагманы · 400B–1,6T

MiMo-v2.5-Pro · GLM-5.2 · Kimi K2.6 · DeepSeek-V4-Pro

Сложные рассуждения, юридическая и финансовая аналитика, длинный контекст.

Мультимодальные

MiniMax M3 · Qwen3-VL

Анализ документов, изображений, сканов и форм.

Эмбеддинги

Qwen3-Embedding · bge-m3

Векторный поиск и RAG-пайплайны.

Нужна конкретная модель или выделенное развёртывание под вашу нагрузку — напишите нам.

Тарифы

Потокенная тарификация — как у мировых провайдеров

Цены за 1 млн токенов, раздельно за вход и выход. Счета выставляются в BYN по договору; USD — для сопоставимости с рынком.

Класс моделиВход, $ / 1MВыход, $ / 1M
Лёгкие (2–35B)$0.10$0.30
Средние (100–300B MoE)$0.30$0.80
Топовые (GLM-5.2, DeepSeek-V4)$0.40$1.50
Топовые в reasoning-режиме$0.55$2.00

Тарифы предварительные и фиксируются в договоре в BYN. Для пилотных проектов — тестовый лимит токенов бесплатно.

Запросить пилотный доступ

Калькулятор

Оцените стоимость под вашу нагрузку

Выберите класс модели и примерный объём токенов в месяц — калькулятор покажет ориентировочный счёт.

≈ 1 млн токенов — это примерно 2 000 страниц текста

Ориентировочно в месяц
0BYN / мес
≈ $0 долл. США

Предварительная оценка по курсу ~3,0 BYN/USD. Точная стоимость фиксируется в договоре.

ZubrIQ Chat

Готовый ИИ-чат для команды — без единой строки кода

Не нужна интеграция по API? Веб-чат со всеми моделями каталога уже работает: диалоги, работа с документами, база знаний компании (RAG), поиск. Доступ по корпоративным учёткам, данные — в том же закрытом контуре.

  • База знаний: загрузите документы — модель отвечает по ним
  • Корпоративный вход (SSO) и разграничение доступа
  • Все модели каталога в одном интерфейсе
Открыть chat.zubriq.by

Android:скачать приложение (APK); iPhone: откройте chat.zubriq.by в Safari → «Поделиться» → «На экран “Домой”».

ZubrIQ Builder

Соберите ИИ-помощника под свою задачу — без программирования

Конструктор ассистентов и рабочих процессов для бизнеса. Загружаете свои документы, собираете логику мышкой из блоков, публикуете как страницу, виджет на сайт или API. Всё на закрытой модели во внутреннем контуре — данные не уходят наружу.

📚

Бот по документам

Загрузите регламенты, договоры, базу знаний — ассистент отвечает сотрудникам со ссылкой на источник.

💬

Поддержка клиентов

Автоответы на типовые вопросы на сайте и в чатах — на ваших материалах, а не на общих данных.

⚙️

Обработка заявок

Приём и разбор заявок, извлечение данных, занесение в таблицы, уведомления — рабочий процесс из блоков.

🧑‍💼

HR и найм

Скрининг резюме по вакансии, ответы кандидатам, онбординг-бот по внутренним правилам.

ZubrIQ Code

Кодинг-агент в терминале — код не уходит наружу

Открытый CLI-агент для разработчиков (форк Qwen Code): пишет и рефакторит код, гоняет тесты, работает с git — на моделях платформы ZubrIQ. Один ключ из кабинета — и всё настроено.

  • Работает с закрытой моделью — код не уезжает в зарубежные API
  • Телеметрия вырезана на уровне кода — наружу не уходит ничего
  • Полноценный агент: читает и правит файлы, запускает команды, работает с git

Скрипт, Homebrew или npm — инструкция на zubriq.by/code.

Как начать

Три шага до работающей интеграции

  1. 1

    Оставьте заявку

    Расскажите о задаче — согласуем модель, объёмы и договор. Для пилота выдадим тестовый лимит токенов бесплатно.

  2. 2

    Получите API-ключ

    Выдаём ключ и панель со статистикой потребления токенов по дням и моделям.

  3. 3

    Замените base_url

    Ваш код на OpenAI SDK продолжает работать как есть. В конце месяца — счёт и акт в BYN.

FAQ

Частые вопросы

Где физически обрабатываются наши данные?

На выделенной закрытой инфраструктуре под вашим контролем. Запросы и ответы не уходят вендору и во внешние API, не логируются для сторонних целей и не используются для обучения моделей. Возможно on-premise развёртывание в вашем контуре.

С чем совместим API?

API реализует спецификацию OpenAI (chat completions, embeddings, streaming). Работают официальные SDK OpenAI для Python/JS, LangChain, LlamaIndex, n8n и любые инструменты с настраиваемым base_url.

Как происходит оплата?

По договору с белорусским юрлицом: постоплата по фактическому потреблению токенов, счета и акты в BYN. Для юрлиц доступен пилотный период с бесплатным лимитом.

Насколько открытые модели хуже GPT/Claude?

Для большинства прикладных задач (RAG по вашим документам, извлечение данных, суммаризация, чат-боты, кодинг) свежие открытые модели (GLM-5.2, DeepSeek-V4, Qwen3.5) дают сопоставимое качество. Мы поможем подобрать модель под вашу задачу и прогнать пилот на реальных данных.

Можно ли выделенную модель или дообучение?

Да. Разворачиваем выделенные инстансы под вашу нагрузку, дообучаем модели на ваших данных (fine-tuning) и делаем on-premise развёртывания в вашем контуре.

Какие гарантии и поддержка?

SLA фиксируется в договоре. Поддержка — инженеры платформы напрямую (не колл-центр), каналы: Telegram, почта, телефон.

Партнёрам

Строим экосистему вместе

ZubrIQ — это инфраструктурный слой: закрытые LLM, OpenAI-совместимый API и оплата в BYN. Стройте на нём свои продукты и решения — модели, GPU-контур и биллинг мы берём на себя.

Интеграторам и внедренцам

IT-студии и подрядчики строят на API ZubrIQ решения для клиентов: RAG, ассистенты, автоматизации. Партнёрские тарифы, поддержка инженеров платформы напрямую, передача входящих лидов и совместные проекты.

White-label и OEM

SaaS-вендоры встраивают модели ZubrIQ в свой продукт под собственным брендом — там, где нужен LLM в закрытом контуре Республики Беларусь. Оптовые цены, выделенные квоты и отдельный контур под нагрузку.

Технологическим партнёрам

Провайдеры GPU-мощностей, авторы моделей и датасетов, интеграции экосистемы (n8n, Dify, LangChain). Со-маркетинг, совместная разработка и развитие каталога моделей.

Контакты

Обсудим вашу задачу

Оставьте заявку — вернёмся в течение рабочего дня, поможем выбрать модель и посчитаем экономику под ваш объём.

Или напрямую:info@artcloud.by