Перейти к основному содержимому

Расчёт A-токенов AIaaS

Что такое A-токен

A-токен — универсальная расчётная единица потребления AIaaS.

Один A-токен не равен одному токену конкретной LLM. Разные модели имеют разную стоимость обработки входящего контекста и генерации ответа, поэтому фактические токены модели пересчитываются в A-токены с использованием коэффициентов. Такой подход позволяет использовать единые пакеты для разных моделей и AI-инструментов.

Доступны две независимые категории:

  • Local A-токены — для локальных LLM и AI-инструментов, размещённых на инфраструктуре ITGLOBAL.COM.
  • External A-токены — для внешних LLM и API-провайдеров, размещённых вне инфраструктуры ITGLOBAL.COM.

Local и External A-токены учитываются раздельно.

Как рассчитывается потребление текстовой модели

Для каждой модели устанавливаются два коэффициента:

  • k input — коэффициент для входящих токенов (Request Tokens);
  • k output — коэффициент для исходящих токенов (Response Tokens).

Расчёт выполняется по формуле:

A-токены = Input tokens × k input + Output tokens × k output

К output-токенам относятся:

  • текст ответа модели;
  • reasoning-токены, если провайдер возвращает их отдельно;
  • другие тарифицируемые исходящие токены модели.

Если reasoning-токены уже включены провайдером в общее количество output-токенов, повторно они не учитываются.

Что относится к input-токенам

В input-потребление могут входить:

  • пользовательский запрос;
  • системный промпт;
  • история диалога;
  • RAG-контекст;
  • содержимое документов;
  • результаты предыдущих tool calls;
  • технические инструкции приложения;
  • повторно передаваемый контекст.

Поэтому input-токены могут существенно превышать объём текста, который пользователь вводит вручную.

Пример точного расчёта

Для Claude Sonnet 4.6 применяются коэффициенты:

  • Request: 0,0675
  • Response: 0,3376

За расчётный период потреблено:

  • 1 000 000 input-токенов;
  • 100 000 output-токенов.

Расчёт:

Input: 1 000 000 × 0,0675 = 67 500 A-токенов
Output: 100 000 × 0,3376 = 33 760 A-токенов
Итого: 67 500 + 33 760 = 101 260 A-токенов

Если подключён пакет External XS на 1 000 000 A-токенов, после такого потребления остаток составит:

1 000 000 − 101 260 = 898 740 A-токенов

Быстрая оценка потребления

Если известен только общий объём токенов и примерное соотношение input/output, можно использовать средневзвешенный коэффициент.

Например, при профиле 95% input / 5% output:

k средний = 95% × k input + 5% × k output

Для Claude Sonnet 4.6:

95% × 0,0675 + 5% × 0,3376 = 0,081

Для 10 млн общих токенов примерный расход:

10 000 000 × 0,081 = 810 000 A-токенов

Такой способ подходит для предварительной оценки. Для финального биллинга используются фактические показатели input и output.

Локальные AI-инструменты

Для локальных текстовых LLM применяется аналогичная схема с раздельными коэффициентами input/output.

Для отдельных AI-инструментов единицей измерения могут быть:

  • токены;
  • символы;
  • байты;
  • страницы документов;
  • длительность аудио;
  • токены изображения — для моделей генерации изображений;
  • фиксированный тариф за генерацию — для моделей генерации видео;
  • количество обработанных объектов.

Применяемая формула и коэффициент указываются в таблице коэффициентов соответствующего сервиса.

Категории A-токенов

Доступны две независимые категории пакетов:

Local

Для локальных LLM и AI-инструментов, размещённых на инфраструктуре ITGLOBAL.COM. Включают модели Qwen, Gemma, а также AI-инструменты: OCR, WhisperX, Embedding, Reranker, PII, DeepL.

External

Для внешних LLM и API-провайдеров, размещённых вне инфраструктуры ITGLOBAL.COM. Включают модели Claude, GPT, Gemini, DeepSeek, Kimi, MiniMax, Nemotron, Nex, Xiaomi MiMo, а также российских провайдеров GigaChat и YandexGPT, модели генерации изображений и видео.

Local и External A-токены учитываются раздельно — нельзя использовать остаток Local-пакета для External-моделей и наоборот.

Как подобрать пакет

Для предварительной оценки:

  1. Определите модели и AI-инструменты, которые планируется использовать.
  2. Получите прогноз input- и output-токенов за месяц.
  3. Умножьте их на коэффициенты соответствующей модели.
  4. Сложите результат по всем моделям.
  5. Разделите потребление на Local и External.
  6. Выберите набор пакетов, покрывающий полученный объём.

Важные условия

  • Стоимость External A-токенов и коэффициенты зарубежных моделей рассчитаны исходя из расчётного курса 80 ₽ за 1 доллар США.
  • При изменении курса доллара США к рублю более чем на 10% относительно расчётного значения Поставщик вправе пересмотреть стоимость пакетов External A-токенов и/или коэффициенты списания для зарубежных LLM и API-провайдеров.
  • Состав моделей, их тарифы и коэффициенты могут актуализироваться при изменении цен или условий соответствующих API-провайдеров.

Связанные материалы