ИИ-КОМФОРТ
Более 10 ИИ-моделей

ИИ-моделиИИ-КОМФОРТ

Встроенный каталог актуальных моделей ИИ-КОМФОРТ с прозрачной тарификацией в рублях. Свои модели и квоты можно подключить через BYOK-ключ.

Актуальный курс ЦБ РФ: 1 USD = 86.59 ₽

Экономия на повторяющемся контексте

Модели с поддержкой кэширования повторно используют уже обработанную часть контекста — например, системные настройки, историю диалога и документы, — поэтому такие входные токены стоят дешевле. ИИ-КОМФОРТ получает от провайдера фактический объём кэшированных токенов и применяет к ним сниженный тариф: экономия отражается в списании клиента, а цена указана в карточке модели.

Рекомендуем
DeepSeek V4 Flash 0731 284B (DeepSeek)

DeepSeek V4 Flash 0731 284B (DeepSeek)

Быстрая

Официальный релиз DeepSeek V4 Flash для текста, кода и агентных сценариев. • Возможности: Текст, код и рассуждения • Лучше всего подходит для: Корпоративного чата, написания и разбора кода, обработки больших документов, подготовки черновиков, автоматизированных рабочих сценариев. • Сильные стороны: 284B параметров (13B активных), контекст до 1M токенов, гибридное внимание для эффективной работы с длинным контекстом и высокий throughput. • Чем отличается от DeepSeek V4 Flash: это стабильная официальная версия (релиз) 0731, которая заменяет preview-версию; у неё заметно сильнее агентные и инструментальные сценарии, а speculative decoding ускоряет получение ответа. • Практическая польза: Удобна как основной быстрый вариант для массовых задач: от писем и резюме до генерации кода, планов и структурированных рабочих материалов. • Ограничения: Не работает с изображениями; для задач со скриншотами, сканами и фото документов выбирайте Gemma. • Когда выбирать: Когда важны скорость, низкая стоимость и уверенная работа с текстом или кодом. • Контекст: 1M токенов.

Входящие / 1K токенов$0.000200 / ≈ 0.02 ₽ / 1K
Кэшированные входящие / 1K$0.000040 / ≈ 0.0035 ₽ / 1K
Исходящие / 1K токенов$0.000600 / ≈ 0.05 ₽ / 1K
👁️‍🗨 GLM 5.3 Flash 320B (Z.ai)

👁️‍🗨 GLM 5.3 Flash 320B (Z.ai)

Быстрая

Нативная мультимодальная модель Z.ai для текста, кода и понимания изображений. • Возможности: Текст + Зрение • Лучше всего подходит для: Скриншотов, сканов и фото документов, таблиц на изображениях, написания и разбора кода, длинных агентных сценариев и обработки больших документов. • Сильные стороны: 320B параметров (18B активных), контекст до 1M токенов, гибридная архитектура sparse + linear attention для точной работы с длинным контекстом при низкой стоимости инференса, нативный вызов функций и рассуждения. • Практическая польза: Может превратить визуальный документ или скриншот в структурированный текст, таблицу, план действий или основу для кода, сохраняя высокую скорость и экономичность. • Ограничения: Выводит текст, а не генерирует изображения; для создания и редактирования визуалов используйте одну из графических моделей. • Когда выбирать: Когда в рабочем запросе есть и текст, и изображения либо нужен длинный контекст и высокая скорость с низкой стоимостью. • Контекст: 1M токенов.

Входящие / 1K токенов$0.000300 / ≈ 0.03 ₽ / 1K
Кэшированные входящие / 1K$0.000060 / ≈ 0.0052 ₽ / 1K
Исходящие / 1K токенов$0.001000 / ≈ 0.09 ₽ / 1K
👁️‍🗨 Gemma 4 31B (Google)

👁️‍🗨 Gemma 4 31B (Google)

Быстрая

Мультимодальная модель Google для текста, кода и понимания изображений. • Возможности: Текст + Зрение • Лучше всего подходит для: Скриншотов, сканов и фото документов, таблиц на изображениях, многоязычных материалов, анализа текста и кода. • Сильные стороны: Плотная модель на 30,7B параметров с поддержкой изображений, рассуждений, нативного вызова функций и более 140 языков. • Практическая польза: Может превратить визуальный документ или скриншот в структурированный текст, таблицу, план действий, описание процесса или основу для кода. • Ограничения: Выводит текст, а не генерирует изображения; для создания и редактирования визуалов используйте одну из графических моделей ниже. • Когда выбирать: Когда в рабочем запросе есть и текст, и изображения либо нужен многоязычный результат. • Контекст: 262K токенов.

Входящие / 1K токенов$0.000300 / ≈ 0.03 ₽ / 1K
Исходящие / 1K токенов$0.000800 / ≈ 0.07 ₽ / 1K
👁️‍🗨 Gemma 4 26B (Google)

👁️‍🗨 Gemma 4 26B (Google)

Быстрая

Более компактная мультимодальная модель Google для текста, кода и понимания изображений. • Возможности: Текст + Зрение • Лучше всего подходит для: Скриншотов, сканов, фото документов и повседневных рабочих задач. • Сильные стороны: MoE-модель 26B с 4B активных параметров, нативным вызовом функций и контекстом до 256K токенов. • Практическая польза: Резервный мультимодальный вариант для анализа визуальных документов, таблиц на изображениях, многоязычных материалов, текста и кода, когда Gemma 4 31B временно недоступна. • Ограничения: Выводит текст, а не генерирует изображения; для создания и редактирования визуалов используйте одну из графических моделей ниже. • Когда выбирать: Когда в запросе есть текст и изображения, но Gemma 4 31B недоступна либо для задачи достаточно более компактной модели. • Контекст: 262K токенов.

Входящие / 1K токенов$0.000200 / ≈ 0.02 ₽ / 1K
Исходящие / 1K токенов$0.000700 / ≈ 0.06 ₽ / 1K
🖼️ Riverflow V2.5 Fast (Sourceful)

🖼️ Riverflow V2.5 Fast (Sourceful)

Быстрая

Быстрая модель Sourceful для управляемой генерации и редактирования изображений. • Возможности: Генерация изображений + редактирование изображений • Лучше всего подходит для: Быстрых production-визуалов, рекламных креативов, вариантов продукта, серийных макетов и задач с жёсткими требованиями к композиции. • Сильные стороны: Встроенное рассуждение планирует многошаговые правки и оценивает кандидаты; можно выбирать уровень рассуждений low, medium или high. • Управление: Генерирует 1K и 2K, принимает до 4 исходных изображений; поддерживает пользовательские шрифты, критерии оценки результата и управление фоном. • Ограничения: 4K не поддерживается. Стоимость зависит от разрешения, сложности редактирования и уровня рассуждений; запросы ограничены 4,5 МБ, поэтому для исходников лучше передавать URL. • Когда выбирать: Когда нужна скорость и больше управляемости, чем при обычной генерации по одному промпту.

За 1 изображение$0.05 / ≈ 4.33 ₽
🖼️ Grok Imagine Image 2.0 (xAI)

🖼️ Grok Imagine Image 2.0 (xAI)

Быстрая

Новая графическая модель xAI для генерации и редактирования изображений. • Возможности: Генерация изображений из текста + редактирование по изображениям-референсам. • Формат: Вывод в разрешении 1K или 2K, поддержка разных соотношений сторон и качества рендеринга. • Референсы: Можно передать до 3 исходных изображений для image-to-image задач. • Ограничения: Не предназначена для текстовых ответов и анализа документов; выдаёт по одному изображению за запрос. • Когда выбирать: Когда нужна универсальная модель xAI для генерации и редактирования изображений.

За 1 изображение$0.10 / ≈ 8.66 ₽

Значки в названиях моделей

👁️‍🗨️Поддерживает зрение (OCR)

Зрение (OCR) — возможность распознавать и анализировать изображения: фотографии, скриншоты, документы, чертежи. Модель «видит» картинку и может описать её содержимое, извлечь текст или ответить на вопросы.

Как тарифицируются токены

Минимальная сумма списания — 1 копейка (0.01 ₽). Даже если стоимость запроса меньше — например, 500 токенов по цене 0.000001 ₽ за токен (итого 0.0005 ₽) — с баланса всё равно спишется 0.01 ₽. Это правило действует отдельно для входящих и исходящих токенов.

Абонплата + pay-as-you-go

На этой странице показан встроенный каталог ИИ-КОМФОРТ с прозрачной тарификацией и оплатой в рублях. Свои модели и квоты другого провайдера можно подключить через BYOK-ключ — после подключения они получают тот же корпоративный рабочий профиль.

Смотреть тарифные планы
Как считаются токены

Особенностиценообразования

Входящие токены всегда дешевле исходящих.

Это специфика обработки информации внутри серверов ИИ-моделей: чтение и анализ текста требуют меньше вычислительных ресурсов, чем генерация нового ответа.

Входящие токены включают корпоративные настройки.

Помимо ваших промптов, модель получает около 10 000–11 000 дополнительных токенов с корпоративными настройками — это делает модели «корпоративными» и обеспечивает корректную работу внутри ИИ-КОМФОРТ.

Исходящие токены зависят от глубины рассуждений.

В ИИ-КОМФОРТ модели настроены на высокий уровень рассуждений (reasoning high), чтобы качественнее выполнять сложные и многошаговые задачи.

Разные модели — разное число токенов.

Один и тот же текст у разных моделей превращается в разное число токенов. Чем лучше модель обучена на русском, тем меньше токенов она тратит.

Корпоративные настройки моделей

Встроенные и подключённые через BYOK модели не остаются «голыми» API. ИИ-КОМФОРТ добавляет к ним корпоративный системный промпт, высокий уровень рассуждений (reasoning high), рабочую температуру и доступные инструменты. Благодаря этому модель понимает правила платформы, удерживает требования, связи и промежуточные результаты в длинном диалоге и надёжнее выполняет сложные многошаговые задачи.

Высокий уровень reasoning и рабочие настройки — более вдумчивые и устойчивые ответы

Температура 0.3 — меньше выдумок и случайных отклонений

Системный промпт и инструменты помогают модели работать в корпоративном контексте

Удержание контекста помогает вести сложные многошаговые задачи до результата

Контроль использования и расходов

Руководитель задаёт правила использования моделей, чтобы команда получала нужные возможности, а бюджет оставался предсказуемым.

Общий бюджет команды

Для встроенных моделей можно установить общий предел расходов в рублях на календарный день, неделю или месяц. После достижения предела новые обращения к встроенным моделям приостанавливаются до начала следующего периода.

Лимиты для сотрудников

Для каждого сотрудника администратор может назначить суточный предел использования конкретной доступной модели — встроенной или подключённой через BYOK. Это помогает распределять более затратные модели по рабочим задачам.

Общий лимит расходов в кабинете относится к встроенным моделям. BYOK-модели оплачиваются напрямую подключённому провайдеру, но для них также можно задавать индивидуальные лимиты сотрудникам.

Без VPN. Оплата в рублях

НачнитеиспользоватьИИужесегодня

Разверните рабочую платформу за 24 часа и дайте команде доступ к актуальному каталогу моделей или подключите свои через BYOK.