Модели и цены

Каталог нейросетей и цены

Каталог нейросетей, доступных в Беларуси: топ-модели мира — GPT, Claude, Gemini, Grok, DeepSeek, Qwen — через единый шлюз и собственная модель Zubr на выделенных GPU в Минске, в контуре РБ. Все модели в одном аккаунте, без VPN.

Цены — в белорусских рублях за миллион токенов, отдельно за входные (ваш запрос) и выходные (ответ модели). Платите только за использованное: ни подписки, ни минимального платежа. Закрывающие документы — актом на юрлицо.

Колонка «кеш» — про повторно отправляемый контекст (системный промпт, документ, история переписки). Первая отправка стоит как запись в кеш, дальше тот же кусок читается в разы дешевле обычного запроса — у моделей Claude в 10 раз. Прочерк означает, что модель кеширование не поддерживает.

Колонка «контекст» — сколько текста модель удерживает в одном разговоре: вопрос, история переписки и приложенные документы вместе. 1M токенов — это примерно 3 млн знаков, то есть несколько книг; 128k — увесистый договор с приложениями. Числа берём из каталога вендора.

Метки у названия: «🧠 думает» — модель показывает ход рассуждений отдельным блоком (они тарифицируются как ответ, поэтому дороже); «👁 видит фото» — можно приложить картинку, скриншот или скан, и модель их прочитает; «🎨 рисует» — создаёт и правит изображения по описанию.

Загружаем актуальные цены…

Каталог моделей

От лёгких до флагманских — под каждую задачу

Zubr — на наших GPU в Минске, запрос не покидает РБ. Zubr Coder, GPT, Claude, Gemini и остальные модели каталога работают у внешних провайдеров — через шлюз, тем же ключом. Каталог обновляется по мере выхода новых релизов.

Zubr · собственное семейство

zubr — в контуре РБ

zubr · zubr-coder

Наши модели: zubr — универсальная, работает на наших GPU в Минске, читает текст, документы и изображения; zubr-coder — код, работает у внешнего провайдера. Алиас без версии всегда указывает на актуальную: интеграции не переписываются при обновлении. Стоят столько же, сколько те же веса у внешнего провайдера, — цены в таблице ниже.

Контекст 262kПечать ответа 99,7 мс/токПропускная способность 221 ток/с

Наш замер 18.09.2026: 4× Tesla V100, 24 параллельных запроса

Лёгкие · 2–35B

Qwen3.5-9B · Qwen3.5-27B · Qwen3.8-27B · Gemma 4

Чат-боты, классификация, модерация, простой RAG, массовые высокочастотные запросы.

Средние · 100–300B MoE

рабочая лошадка

Qwen3.5-122B-A10B · DeepSeek-V4-Flash · gpt-oss-120b

Большинство бизнес-задач: RAG, агенты, суммаризация, извлечение данных, аналитика.

Кодинг · zubr-coder

открытые веса

zubr-coder · Qwen3-Coder · gpt-oss-120b

Разбор и ревью кода, правки, ассистент разработчика. Под именем zubr-coder — модель на ОТКРЫТЫХ весах: её при желании можно поднять в вашем периметре, в отличие от закрытых моделей. Запросы уходят только на площадки с нулевым хранением: они не учатся на вашем коде и не сохраняют его. Если площадка недоступна, запрос уходит в резерв — ревью не встаёт.

Флагманы · 400B–1,6T

MiMo-v2.5-Pro · GLM-5.2 · Kimi K2.6 · DeepSeek-V4-Pro

Сложные рассуждения, юридическая и финансовая аналитика, длинный контекст.

Мультимодальные

MiniMax M3 · Qwen3-VL

Анализ документов, изображений, сканов и форм.

Эмбеддинги

Qwen3-Embedding · bge-m3

Векторный поиск и RAG-пайплайны.

Нужна конкретная модель или выделенное развёртывание под вашу нагрузку — напишите нам.→

Подключим в общий API — напишите на info@artcloud.by.