Доступные модели (Nexuses)
Список моделей и маршрутов обновляется по мере добавления новых моделей в платформу. Актуальную информацию всегда проверяйте на этой странице.
Расчёт A-токенов
Коэффициенты актуальны на 10 сентября 2026 года.
Для chat-моделей A-токены рассчитываются отдельно по входящим и исходящим токенам:
A-токены = входящие токены × K входа + исходящие токены × K выхода.
Для специализированных сервисов:
A-токены = объём потребления × коэффициент.
В таблицах указано, в чем измеряется объем потребления: в токенах, байтах или символах.
Локальные модели (ITGLOBAL.COM)
| Маршрут | API-путь | Backend | Вендор | Сильные стороны | K входа | K выхода |
|---|---|---|---|---|---|---|
| itg.qwen_local_latest.chat_completions | /chat/completions | Qwen 3.8 | Alibaba Qwen | Текущая локальная модель Qwen, маршрут не меняется при смене версии | 0.0137 | 0.0948 |
| itg.gemma-4-26b-a4b.chat_completions | /chat/completions | Gemma 4 26B | Google DeepMind | Локальная модель общего назначения | 0.0029 | 0.0112 |
Внешние модели
Chat-модели
Все chat-модели используют API-путь /chat/completions.
Колонка «Сильные стороны» — краткий ориентир под задачу, а не исчерпывающее описание возможностей. Подробнее о подборе модели — в разделе Как выбрать модель.
| Маршрут | Базовая модель | Вендор | Сильные стороны | K входа | K выхода |
|---|---|---|---|---|---|
| opr.qwen-3.7-max.chat_completions | Qwen 3.7 Max | Alibaba Qwen | Универсальная модель для рабочих задач | 0.0332 | 0.0996 |
| opr.qwen-3.8-max.chat_completions | Qwen 3.8 Max | Alibaba Qwen | Флагманская модель общего назначения | 0.045 | 0.135 |
| opr.qwen-3.8-2.4t.chat_completions | Qwen 3.8 2.4T | Alibaba Qwen | Разреженная архитектура, сложные задачи | 0.0473 | 0.1418 |
| opr.qwen-3.8-27b.chat_completions | Qwen 3.8 27B | Alibaba Qwen | Компактная модель для типовых задач | 0.0078 | 0.0619 |
| opr.qwen-3.8-flash.chat_completions | Qwen 3.8 Flash | Alibaba Qwen | Быстрые ответы при низкой стоимости | 0.0034 | 0.0106 |
| opr.qwen3.6-35b-a3b.chat_completions | Qwen 3.6 35B A3B | Alibaba Qwen | Компактная модель, низкая стоимость обращения | 0.0022 | 0.0225 |
| opr.qwen-3.7-plus.chat_completions | Qwen 3.7 Plus | Alibaba Qwen | Экономичная модель, текст и изображения на входе | 0.0072 | 0.0288 |
| opr.qwen-3.7-flash.chat_completions | Qwen 3.7 Flash | Alibaba Qwen | Визуальные агенты и работа с интерфейсами | 0.0007 | 0.0029 |
| opr.gemini-3-flash-preview.chat_completions | Gemini 3 Flash Preview | Google DeepMind | Быстрая модель с большим контекстом | 0.0112 | 0.0675 |
| opr.gemini-2.5-flash.chat_completions | Gemini 2.5 Flash | Google DeepMind | Быстрая модель для массовых задач | 0.0067 | 0.0563 |
| opr.gemini-2.5-flash-lite.chat_completions | Gemini 2.5 Flash Lite | Google DeepMind | Минимальная стоимость запроса | 0.0022 | 0.009 |
| opr.gemini-3.5-flash.chat_completions | Gemini 3.5 Flash | Google DeepMind | Быстрая мультимодальная модель | 0.0338 | 0.2025 |
| opr.gemini-3.5-flash-lite.chat_completions | Gemini 3.5 Flash Lite | Google DeepMind | Высокая частота запросов при низкой цене | 0.0067 | 0.0563 |
| opr.gemini-3.6-flash.chat_completions | Gemini 3.6 Flash | Google DeepMind | Быстрая модель с большим контекстом | 0.0085 | 0.0423 |
| opr.gemini-3.7-flash.chat_completions | Gemini 3.7 Flash | Google DeepMind | Быстрая модель с невысокой стоимостью | 0.0169 | 0.0844 |
| opr.gemini-3.8-flash.chat_completions | Gemini 3.8 Flash | Google DeepMind | Быстрая модель с большим контекстом | 0.0206 | 0.103 |
| opr.gemini-3.1-flash-lite.chat_completions | Gemini 3.1 Flash Lite | Google DeepMind | Мультимодальный вход: текст, изображения, видео, аудио, PDF | 0.0059 | 0.0354 |
| opr.mimo-v2.5-pro.chat_completions | MiMo V2.5 Pro | Xiaomi | Недорогая модель общего назначения | 0.0098 | 0.0196 |
| opr.glm5.1.chat_completions | GLM 5.1 | Z.ai | Универсальная модель для диалогов и текстов | 0.0315 | 0.099 |
| opr.glm-5.2.chat_completions | GLM 5.2 | Z.ai | Универсальная модель для диалогов и текстов | 0.0247 | 0.0785 |
| opr.glm-5.3.chat_completions | GLM 5.3 | Z.ai | Универсальная модель для диалогов и текстов | 0.0315 | 0.099 |
| opr.glm-5.3-flash.chat_completions | GLM 5.3 Flash | Z.ai | Быстрая модель, низкая стоимость обращения | 0.0034 | 0.0112 |
| opr.gpt5.1.chat_completions | GPT-5.1 | OpenAI | Универсальная модель общего назначения | 0.0281 | 0.225 |
| opr.gpt5.4.chat_completions | GPT-5.4 | OpenAI | Рассуждения на широком круге задач | 0.0281 | 0.1688 |
| opr.gpt5.4_pro.chat_completions | GPT-5.4 Pro | OpenAI | Максимальное качество рассуждений | 0.675 | 4.05 |
| opr.gpt-6-astra.chat_completions | GPT-6 Astra | OpenAI | Универсальная модель для сложных задач | 0.2626 | 1.3129 |
| opr.gpt-6-astra-pro.chat_completions | GPT-6 Astra Pro | OpenAI | Углублённые рассуждения; на каждый запрос около 1450 входных токенов служебной части | 0.2626 | 1.3129 |
| opr.gpt-5.5.chat_completions | GPT-5.5 | OpenAI | Сложная аналитика и длинные рассуждения | 0.1125 | 0.675 |
| opr.gpt5.3_codex.chat_completions | GPT-5.3 Codex | OpenAI | Написание и разбор кода | 0.0394 | 0.315 |
| opr.gpt-5.6-luna.chat_completions | GPT-5.6 Luna | OpenAI | Быстрые ответы при большом потоке | 0.0045 | 0.027 |
| opr.gpt-5.6-luna-pro.chat_completions | GPT-5.6 Luna Pro | OpenAI | Быстрые ответы с повышенным качеством | 0.0022 | 0.0135 |
| opr.gpt-5.6-terra.chat_completions | GPT-5.6 Terra | OpenAI | Основная рабочая нагрузка | 0.0423 | 0.2539 |
| opr.gpt-5.6-terra-pro.chat_completions | GPT-5.6 Terra Pro | OpenAI | Рабочая нагрузка с упором на качество | 0.0504 | 0.3025 |
| opr.gpt-5.6-sol.chat_completions | GPT-5.6 Sol | OpenAI | Сложные задачи и агентные сценарии | 0.09 | 0.45 |
| opr.gpt-5.6-sol-pro.chat_completions | GPT-5.6 Sol Pro | OpenAI | Наиболее требовательные сценарии | 0.18 | 0.9 |
| opr.deepseek4_pro.chat_completions | DeepSeek 4 Pro | DeepSeek | Код и математика | 0.0323 | 0.0731 |
| opr.deepseek-v4-pro-0813.chat_completions | DeepSeek V4 Pro 0813 | DeepSeek | Рассуждающая модель, невысокая стоимость | 0.0267 | 0.08 |
| opr.deepseek4_flash.chat_completions | DeepSeek 4 Flash | DeepSeek | Быстрая экономичная модель | 0.0023 | 0.0049 |
| opr.deepseek-v4-flash-0731.chat_completions | DeepSeek V4 Flash 0731 | DeepSeek | Быстрая экономичная модель с закреплённой сборкой | 0.0024 | 0.0064 |
| opr.kimi_k2.6.chat_competions | Kimi K2.6 | Moonshot AI | Длинный контекст и работа с документами | 0.0145 | 0.0788 |
| opr.kimi-2.7-code.chat_completions | Kimi 2.7 Code | Moonshot AI | Написание и рефакторинг кода | 0.0158 | 0.0784 |
| opr.kimi-k3.chat_completions | Kimi K3 | Moonshot AI | Длинный контекст и работа с документами | 0.0635 | 0.3173 |
| opr.minimax-m2.7.chat.completions | MiniMax M2.7 | MiniMax | Недорогая модель для диалогов | 0.0068 | 0.027 |
| opr.minimax-m3.chat_completions | MiniMax M3 | MiniMax | Недорогая модель для диалогов | 0.0067 | 0.0269 |
| opr.nemotron-3-ultra.chat_completions | Nemotron 3 Ultra | NVIDIA | Открытая модель для сложных задач | 0.0135 | 0.0699 |
| opr.nex-n2-pro.chat_completions | Nex N2 Pro | Nex AGI | Агентные сценарии и вызов инструментов | 0.0056 | 0.0225 |
| opr.nex-n2-mini.chat_completions | Nex N2 Mini | Nex AGI | Компактная агентная модель, минимальная цена | 0.0006 | 0.0022 |
| opr.inkling.chat_completions | Inkling | Thinking Machines | Открытая мультимодальная модель | 0.0214 | 0.0911 |
| opr.inkling-small.chat_completions | Inkling Small | Thinking Machines | Компактная открытая мультимодальная модель | 0.0109 | 0.027 |
| opr.claude-haiku-4.5.chat_completions | Claude Haiku 4.5 | Anthropic | Быстрые ответы при большом потоке | 0.0236 | 0.1181 |
| opr.claude-sonnet4.6.chat_completions | Claude Sonnet 4.6 | Anthropic | Универсальная модель для рабочих задач | 0.0702 | 0.351 |
| opr.claude-sonnet5.chat_completions | Claude Sonnet 5 | Anthropic | Работа с документами и длинным контекстом | 0.045 | 0.225 |
| opr.claude-opus4.7.chat_completions | Claude Opus 4.7 | Anthropic | Сложные рассуждения | 0.117 | 0.585 |
| opr.claude-opus-4.8.chat_completions | Claude Opus 4.8 | Anthropic | Сложные рассуждения и агентные сценарии | 0.117 | 0.585 |
| opr.claude-opus-5.chat_completions | Claude Opus 5 | Anthropic | Требовательные аналитические задачи | 0.1125 | 0.5625 |
| opr.claude-opus-5-fast.chat_completions | Claude Opus 5 Fast | Anthropic | Сложные рассуждения с приоритетной обработкой | 0.225 | 1.125 |
| opr.claude-fable-latest.chat_completions | Claude Fable | Anthropic | Работа с текстом и стилем изложения | 0.2295 | 1.1475 |
| opr.claude-fable-5.1.chat_completions | Claude Fable 5.1 | Anthropic | Работа с текстом и стилем изложения | 0.2251 | 1.1253 |
| opr.grok-4.5.chat_completions | Grok 4.5 | xAI | Универсальная модель с широкой эрудицией | 0.0675 | 0.2026 |
| opr.grok-4.6.chat_completions | Grok 4.6 | xAI | Универсальная модель с широкой эрудицией | 0.045 | 0.135 |
| opr.grok-build-0.1.chat_completions | Grok Build 0.1 | xAI | Агентная разработка ПО | 0.045 | 0.09 |
| opr.hy3.chat_completions | HY3 | Tencent | Экономичная модель для массовых задач | 0.0031 | 0.0129 |
| opr.mistral-large-2512.chat_completions | Mistral Large 2512 | Mistral AI | Европейская модель общего назначения | 0.0124 | 0.0371 |
| opr.mercury-2.5.chat_completions | Mercury 2.5 | Inception | Быстрая модель; часть выхода уходит на размышления, нужен запас по max_tokens | 0.0045 | 0.0169 |
| opr.llama-3.1.chat_completions | Llama 3.1 | — | Лёгкая открытая модель, минимальная стоимость | 0.0004 | 0.0009 |
| opr.sonar.chat_completions | Perplexity Sonar | Perplexity | Ответы с опорой на актуальные веб-данные | 0.0225 | 0.0225 |
| opr.sonar-pro.chat_completions | Perplexity Sonar Pro | Perplexity | Веб-поиск с более глубокой проработкой | 0.0675 | 0.3375 |
| opr.aion-3.0.chat_completions | Aion 3.0 | Aion Labs | Повествование и ролевые сценарии | 0.0675 | 0.135 |
| opr.aion-3.0-mini.chat_completions | Aion 3.0 Mini | Aion Labs | Повествование и ролевые сценарии, экономичный вариант | 0.0158 | 0.0315 |
| opr.kat-coder-pro-v2.5.chat_completions | KAT-Coder Pro V2.5 | Kwaipilot | Агентная работа с кодом целыми задачами | 0.0167 | 0.0666 |
| opr.kat-coder-air-v2.5.chat_completions | KAT-Coder Air V2.5 | Kwaipilot | Агентная работа с кодом, экономичный вариант | 0.0034 | 0.0135 |
| opr.laguna-s-2.1.chat_completions | Laguna S 2.1 | Poolside | Кодовый агент с очень длинным контекстом | 0.0022 | 0.0045 |
| opr.laguna-xs-2.1.chat_completions | Laguna XS 2.1 | Poolside | Компактный кодовый агент | 0.0022 | 0.0045 |
| opr.longcat-2.0.chat_completions | LongCat 2.0 | Meituan | Изменения на уровне репозитория | 0.0169 | 0.0675 |
| opr.ling-3.0-flash.chat_completions | Ling 3.0 Flash | InclusionAI | Экономный расход токенов в агентных сценариях | 0.0014 | 0.004 |
| opr.step-3.7-flash.chat_completions | Step 3.7 Flash | StepFun | Мультимодальная модель, разбор изображений и видео | 0.0045 | 0.0259 |
| opr.perceptron-mk1.chat_completions | Perceptron Mk1 | Perceptron | Разбор видео и визуальных сцен | 0.0034 | 0.0338 |
| opr.muse-spark-1.1.chat_completions | Muse Spark 1.1 | — | Мультимодальный вход, очень длинный контекст | 0.0281 | 0.0956 |
| opr.muse-spark-1.2.chat_completions | Muse Spark 1.2 | — | Агентные задачи, очень длинный контекст | 0.0281 | 0.0956 |
| opr.muse-spark-1.3.chat_completions | Muse Spark 1.3 | — | Агентные задачи, очень длинный контекст | 0.0281 | 0.0957 |
| opr.muse-glimmer-30b.chat_completions | Muse Glimmer 30B | — | Компактная модель, невысокая стоимость | 0.0073 | 0.0298 |
| opr.seed-2.1-turbo.chat_completions | Seed 2.1 Turbo | ByteDance | Быстрые ответы при низкой стоимости | 0.0112 | 0.0563 |
| opr.seed-2.0-code.chat_completions | Seed 2.0 Code | ByteDance | Генерация и правка кода | 0.0112 | 0.0675 |
У моделей Perplexity Sonar в K выхода уже включена фиксированная плата за веб-поиск, распределённая на среднюю длину ответа.
Российские модели
| Маршрут | API-путь | Модель | Вендор | Сильные стороны | K входа | K выхода |
|---|---|---|---|---|---|---|
| sbr.gigachat-lite.chat_completions | /chat/completions | GigaChat 2 Lite | Сбер | Российская модель, простые задачи | 0.0128 | 0.0128 |
| sbr.gigachat-pro.chat_completions | /chat/completions | GigaChat 2 Pro | Сбер | Российская модель, рабочие задачи | 0.0984 | 0.0984 |
| sbr.gigachat-max.chat_completions | /chat/completions | GigaChat 2 Max | Сбер | Российская модель, сложные задачи | 0.1279 | 0.1279 |
| yndx.yandex-gpt-5-lite.chat_completions | /chat/completions | YandexGPT 5 Lite | Яндекс | Российская модель, массовые задачи | 0.0393 | 0.0393 |
| yndx.yandex-gpt-5-pro.chat_completions | /chat/completions | YandexGPT 5 Pro | Яндекс | Российская модель, рабочие задачи | 0.2361 | 0.2361 |
| yndx.yandex-gpt-5.1-pro.chat_completions | /chat/completions | YandexGPT 5.1 Pro | Яндекс | Российская модель, рабочие задачи | 0.1574 | 0.1574 |
| yndx.alice-ai-llm.chat_completions | /chat/completions | Alice AI LLM | Яндекс | Диалоговая модель | 0.0984 | 0.2361 |
Маршруты Yandex переведены на API-путь /chat/completions. Прежние маршруты
с суффиксом .responses выведены из эксплуатации — обновите вызовы.
Генерация изображений
Модели с маршрутом .chat_completions вызываются как обычные chat-модели — изображение возвращается в ответе. Модели с маршрутом .images используют отдельный API-путь /images. Исходящий объём тарифицируется в токенах изображения.
Исключение: opr.nano-banana-2.images вызывается по пути /images/generations,
а не /images. Обращение по общему пути вернёт ошибку маршрутизации.
| Маршрут | API-путь | Модель | Вендор | Сильные стороны | K входа | K выхода |
|---|---|---|---|---|---|---|
| opr.nano-banana-2.chat_completions | /chat/completions | Nano Banana 2 | Google DeepMind | Генерация и редактирование изображений | 0.0112 | 0.0675 |
| opr.nano-banana-2-lite.chat_completions | /chat/completions | Nano Banana 2 Lite | Google DeepMind | Экономичная генерация изображений | 0.0056 | 0.0338 |
| opr.gemini-3-pro-image.chat_completions | /chat/completions | Nano Banana Pro | Google DeepMind | Редактирование и работа с текстом на изображении | 0.045 | 0.27 |
| opr.nano-banana-2.images | /images/generations | Nano Banana 2 | Google DeepMind | Генерация и редактирование изображений | 0.0113 | 1.3504 |
| opr.gpt-image-2.images | /images | GPT Image 2 | OpenAI | Генерация изображений по описанию | 0.1801 | 0.6752 |
| opr.gpt-image-2.5-flare.images | /images | GPT Image 2.5 Flare | OpenAI | Генерация изображений по описанию | 0.1801 | 0.6752 |
| opr.gpt-image-2.5-sunburst.images | /images | GPT Image 2.5 Sunburst | OpenAI | Генерация изображений по описанию | 0.1801 | 0.6752 |
| opr.flux-2-pro.images | /images | FLUX.2 Pro | Black Forest Labs | Фотореалистичная генерация | - | 0.1648 |
| opr.flux-2-klein-4b.images | /images | FLUX.2 Klein 4B | Black Forest Labs | Быстрая и дешёвая генерация | - | 0.0769 |
| opr.seedream-4.5.images | /images | Seedream 4.5 | ByteDance | Низкая стоимость кадра | - | 0.0549 |
| opr.recraft-v4.images | /images | Recraft V4 | Recraft | Дизайн-макеты и иллюстрации | - | 0.2156 |
| opr.recraft-v4-vector.images | /images | Recraft V4 Vector | Recraft | Векторная графика | - | 0.4313 |
Генерация видео
Генерация асинхронная: задание отправляется на маршрут .videos, статус запрашивается на .videos_status, готовый файл забирается с .videos_content.
| Маршрут | API-путь | Модель | Вендор | Сильные стороны | Коэффициент | Расчет по |
|---|---|---|---|---|---|---|
| opr.seedance-2.0-fast.videos | /videos | Seedance 2.0 Fast | ByteDance | Короткие ролики, низкая стоимость | 40.0 | байтам |
| opr.seedance-2.0-fast.videos_status | /videos/{job_id} | Seedance 2.0 Fast | ByteDance | Проверка статуса задания | 0.0001 | байтам |
| opr.seedance-2.0-fast.videos_content | /videos/{job_id}/content | Seedance 2.0 Fast | ByteDance | Скачивание готового ролика | 0.0001 | байтам |
| opr.flux-3-video.videos | /videos | FLUX.3 Video | Black Forest Labs | Короткие ролики, качество изображения | 158.1 | байтам |
| opr.flux-3-video.videos_status | /videos/{job_id} | FLUX.3 Video | Black Forest Labs | Проверка статуса задания | 0.0001 | байтам |
| opr.flux-3-video.videos_content | /videos/{job_id}/content | FLUX.3 Video | Black Forest Labs | Скачивание готового ролика | 0.0001 | байтам |
| opr.wan-3.0.videos | /videos | Wan 3.0 | Wan AI | Короткие ролики по описанию | 79.1 | байтам |
| opr.wan-3.0.videos_status | /videos/{job_id} | Wan 3.0 | Wan AI | Проверка статуса задания | 0.0001 | байтам |
| opr.wan-3.0.videos_content | /videos/{job_id}/content | Wan 3.0 | Wan AI | Скачивание готового ролика | 0.0001 | байтам |
| opr.heygen-avatar-iv.videos | /videos | HeyGen Avatar IV | HeyGen | Говорящий аватар по фото и тексту | 139.5 | байтам |
| opr.heygen-avatar-iv.videos_status | /videos/{job_id} | HeyGen Avatar IV | HeyGen | Проверка статуса задания | 0.0001 | байтам |
| opr.heygen-avatar-iv.videos_content | /videos/{job_id}/content | HeyGen Avatar IV | HeyGen | Скачивание готового ролика | 0.0001 | байтам |
Списание происходит один раз — на маршруте отправки задания, по фиксированному тарифу за генерацию. Опрос статуса и скачивание результата тарифицируются символически.
Параметры генерации зафиксированы на стороне платформы:
- Seedance 2.0 Fast — 4 секунды, 480×480, без звука: примерно 4 840 A-токенов за генерацию;
- FLUX.3 Video — 5 секунд, 720p: примерно 19 130 A-токенов за генерацию;
- Wan 3.0 — 5 секунд, 720p;
- HeyGen Avatar IV — 720p, длительность зависит от объёма текста.
Для Wan 3.0 и HeyGen Avatar IV расход за генерацию не замерялся — ориентируйтесь на коэффициент и фактический объём ответа.
TTS (Audio Speech)
| Маршрут | API-путь | Модель | Вендор | Сильные стороны | K входа | K выхода | Расчет по |
|---|---|---|---|---|---|---|---|
| opr.gemini-3.1-flash-tts-preview.audio_speech | /audio/speech | Gemini 3.1 Flash TTS | Google DeepMind | Синтез речи | - | 0.0001 | байтам |
| itg.omnivoice.audio_generate | /audio/generate | OmniVoice | ITGLOBAL.COM | Локальный синтез речи | - | 0.0035 | байтам |
TTS тарифицируется по объёму сгенерированного аудио. Коэффициент 0.0001 — это примерно 100 A-токенов за мегабайт аудио.
Protected-эндпоинты
Для большинства моделей доступны protected-варианты — они проходят через дополнительный слой фильтрации контента. Protected-эндпоинт имеет тот же API-путь (/chat/completions), но содержит .protected в имени маршрута. Коэффициенты protected-маршрута совпадают с коэффициентами соответствующей базовой модели из таблицы выше.
| Маршрут | Базовая модель |
|---|---|
| opr.qwen-3.7-max.chat_completions.protected | Qwen 3.7 Max |
| opr.glm5.1.chat_completions.protected | GLM 5.1 |
| opr.glm-5.2.chat_completions.protected | GLM 5.2 |
| opr.gpt5.4.chat_completions.protected | GPT-5.4 |
| opr.gpt5.4_pro.chat_completions.protected | GPT-5.4 Pro |
| opr.gpt-5.5.chat_completions.protected | GPT-5.5 |
| opr.gpt5.3_codex.chat_completions.protected | GPT-5.3 Codex |
| opr.gpt-5.6-luna.chat_completions.protected | GPT-5.6 Luna |
| opr.gpt-5.6-luna-pro.chat_completions.protected | GPT-5.6 Luna Pro |
| opr.gpt-5.6-terra.chat_completions.protected | GPT-5.6 Terra |
| opr.gpt-5.6-terra-pro.chat_completions.protected | GPT-5.6 Terra Pro |
| opr.gpt-5.6-sol.chat_completions.protected | GPT-5.6 Sol |
| opr.gpt-5.6-sol-pro.chat_completions.protected | GPT-5.6 Sol Pro |
| opr.deepseek4_pro.chat_completions.protected | DeepSeek 4 Pro |
| opr.deepseek4_flash.chat_completions.protected | DeepSeek 4 Flash |
| opr.kimi_k2.6.chat_competions.protected | Kimi K2.6 |
| opr.kimi-2.7-code.chat_completions.protected | Kimi 2.7 Code |
| opr.kimi-k3.chat_completions.protected | Kimi K3 |
| opr.minimax-m2.7.chat.completions.protected | MiniMax M2.7 |
| opr.minimax-m3.chat_completions.protected | MiniMax M3 |
| opr.nemotron-3-ultra.chat_completions.protected | Nemotron 3 Ultra |
| opr.claude-sonnet4.6.chat_completions.protected | Claude Sonnet 4.6 |
| opr.claude-sonnet5.chat_completions.protected | Claude Sonnet 5 |
| opr.claude-opus4.7.chat_completions.protected | Claude Opus 4.7 |
| opr.claude-opus-4.8.chat_completions.protected | Claude Opus 4.8 |
| opr.claude-opus-5-fast.chat_completions.protected | Claude Opus 5 Fast |
| opr.claude-fable-latest.chat_completions.protected | Claude Fable (latest) |
| opr.grok-4.5.chat_completions.protected | Grok 4.5 |
| opr.hy3.chat_completions.protected | HY3 |
| opr.llama-3.1.chat_completions.protected | Llama 3.1 |
| opr.sonar.chat_completions.protected | Perplexity Sonar |
| opr.sonar-pro.chat_completions.protected | Perplexity Sonar Pro |
| opr.claude-opus-5.chat_completions.protected | Claude Opus 5 |
| opr.claude-haiku-4.5.chat_completions.protected | Claude Haiku 4.5 |
| opr.gemini-3.6-flash.chat_completions.protected | Gemini 3.6 Flash |
| opr.gemini-3.5-flash-lite.chat_completions.protected | Gemini 3.5 Flash Lite |
| opr.qwen-3.8-max.chat_completions.protected | Qwen 3.8 Max |
| opr.inkling.chat_completions.protected | Inkling |
| itg.qwen_local_latest.chat_completions.protected | Qwen 3.8 (локальная) |
Специализированные сервисы
OCR
| Маршрут | API-путь | Вендор | Сильные стороны | Коэффициент | Расчет по |
|---|---|---|---|---|---|
| itg.ocr.v2.doc-to-text | /v2/doc-to-text | ITGLOBAL.COM | Извлечение текста из документов | 0.0035 | байтам |
| itg.ocr.v2.process-document | /v2/process-document | ITGLOBAL.COM | Распознавание документов | 0.0035 | байтам |
| itg.ocr.v2.custom-process-document | /v2/custom/process-document | ITGLOBAL.COM | Распознавание документов по своей конфигурации | 0.0035 | байтам |
| itg.ocr.v2.process-text | /v2/process-text | ITGLOBAL.COM | Распознавание текста | 0.0035 | байтам |
| itg.ocr.v2.custom-process-text | /v2/custom/process-text | ITGLOBAL.COM | Распознавание текста по своей конфигурации | 0.0035 | байтам |
| itg.ocr.v2.vlm-process | /v2/vlm-process | ITGLOBAL.COM | Распознавание с моделью зрения | 0.0035 | байтам |
Аудио (транскрипция / WhisperX)
| Маршрут | API-путь | Backend | Вендор | Сильные стороны | Коэффициент | Расчет по |
|---|---|---|---|---|---|---|
| itg.whisperx-prod.audio_transcriptions | /audio/transcriptions | whisper-1 | WhisperX | Транскрипция аудио в текст | 0.0035 | байтам |
PII Detection
| Маршрут | API-путь | Вендор | Сильные стороны | Коэффициент | Расчет по |
|---|---|---|---|---|---|
| itg.pii-detection.ner | /ner | Knowledgator | Поиск персональных данных в тексте | 0.001 | токенам |
| itg.pii-detection.mask | /mask | Knowledgator | Замена персональных данных на плейсхолдеры | 0.001 | токенам |
| itg.pii-detection.unmask | /unmask | Knowledgator | Восстановление исходных значений | 0.001 | токенам |
Embeddings и Reranker
Для embeddings тарифицируются только входящие токены.
| Маршрут | API-путь | Backend | Вендор | Сильные стороны | Коэффициент | Расчет по |
|---|---|---|---|---|---|---|
| itg.qwen3-embedding-4b.embeddings | /embeddings | qwen3_embeddings | Alibaba Qwen | Локальная векторизация текста | 0.001 | токенам |
| itg.qwen3-reranker-4b.rerank | /rerank | qwen3_reranker | Alibaba Qwen | Локальное переранжирование результатов | 0.0035 | байтам |
| opr.qwen3-reranker-8b.rerank | /rerank | qwen/qwen3-reranker-8b | Alibaba Qwen | Переранжирование результатов поиска | 0.0045 | токенам |
| opr.rerank-2.5-lite.rerank | /rerank | voyageai/rerank-2.5-lite | Voyage AI | Экономичное переранжирование | 0.0005 | токенам |
| opr.voyage-4.embeddings | /embeddings | voyageai/voyage-4 | Voyage AI | Векторизация текста | 0.0014 | токенам |
| opr.voyage-code-4.embeddings | /embeddings | voyageai/voyage-code-4 | Voyage AI | Векторизация кода | 0.0027 | токенам |
| opr.bge-m3.embeddings | /embeddings | baai/bge-m3 | BAAI | Многоязычная векторизация | 0.0002 | токенам |
| opr.gemini-embedding-2.embeddings | /embeddings | google/gemini-embedding-2 | Google DeepMind | Векторизация текста | 0.0045 | токенам |
| sbr.embeddings.embeddings | /embeddings | Embeddings | Сбер | Российская векторизация текста | 0.0005 | байтам |
| sbr.embeddings-2.embeddings | /embeddings | Embeddings-2 | Сбер | Российская векторизация текста | 0.0005 | байтам |
| sbr.embeddings-gigar.embeddings | /embeddings | EmbeddingsGigaR | Сбер | Векторизация под поиск и ранжирование | 0.0005 | байтам |
| sbr.giga-embeddings-3b.embeddings | /embeddings | GigaEmbeddings-3B | Сбер | Российская векторизация текста | 0.0005 | байтам |
Идентификация и диаризация
| Маршрут | API-путь | Вендор | Сильные стороны | Коэффициент | Расчет по |
|---|---|---|---|---|---|
| itg.identification.ident_diarize_struct | /ident_diarize_struct | ITGLOBAL.COM | Разделение аудио по говорящим | 0.0035 | байтам |
Конвертация документов (Docling)
| Маршрут | API-путь | Вендор | Сильные стороны | Коэффициент | Расчет по |
|---|---|---|---|---|---|
| itg.docling.convert_sync | /v1/convert/file | Docling | Конвертация документа в структурированный вид | 0.001 | токенам |
| itg.docling.convert_async | /v1/convert/file/async | Docling | Асинхронная конвертация документа | 0.001 | токенам |
| itg.docling.poll_status | /v1/status/poll/{task_id} | Docling | Проверка статуса задания | 0.001 | токенам |
| itg.docling.result | /v1/result/{task_id} | Docling | Получение результата конвертации | 0.001 | токенам |
Проверка на ИИ-генерацию (GigaCheck)
| Маршрут | API-путь | Модель | Вендор | Сильные стороны | Коэффициент | Расчет по |
|---|---|---|---|---|---|---|
| sbr.gigacheck-detection.ai_check | /ai/check | GigaCheckDetection | Сбер | Определение признаков ИИ-генерации в тексте | 0.0984 | токенам |
| sbr.gigacheck-classification.ai_check | /ai/check | GigaCheckClassification | Сбер | Классификация источника текста | 0.0984 | токенам |
Перевод
| Маршрут | API-путь | Вендор | Сильные стороны | Коэффициент | Расчет по |
|---|---|---|---|---|---|
| ain.deepl.translate | /translate | DeepL | Машинный перевод | 0.025 | символам |