Перейти к основному содержимому

AIaaS — AI as a Service

Общие сведения

AIaaS (AI as a Service) — сервис ITGLOBAL.COM, предоставляющий доступ к десяткам языковых моделей и специализированных AI-инструментов через единый API-шлюз. API совместим с OpenAI, что позволяет использовать существующие библиотеки и SDK без изменения кода.

Сервис построен на платформе AInergy — корпоративном AI-оркестраторе, входящем в экосистему ITG. AInergy зарегистрирована в реестре отечественного ПО Министерства цифрового развития РФ.

Для каких задач используется

  • Анализ и обработка документов — суммаризация, классификация, извлечение данных из договоров и отчётов.
  • Генерация текста — деловая переписка, черновики, технические описания.
  • Генерация изображений — иллюстрации, визуальные концепции, изображения для маркетинговых материалов.
  • Генерация видео — короткие видеоролики по текстовому описанию.
  • OCR и конвертация документов — извлечение текста из PDF, изображений, сканов.
  • Транскрипция речи — преобразование аудио в текст (WhisperX), диаризация, синтез речи (TTS).
  • Векторные вычисления и RAG — эмбеддинги, реранкинг, поиск по базе знаний.
  • Поиск в интернете — модели с доступом к актуальным веб-данным.
  • PII-фильтрация — обнаружение и маскирование персональных данных в запросах.
  • Перевод — машинный перевод через DeepL.

Ключевые возможности

  • Единый API — один endpoint, один ключ, доступ ко всем моделям. Смена модели без изменения интеграции.
  • OpenAI-compatible — поддержка /v1/chat/completions, /v1/models, /v1/embeddings, streaming, function calling. Дополнительно доступны /v1/images для генерации изображений, /v1/videos для генерации видео и /v1/responses для российских моделей.
  • Мультимодальность — текст, изображения, видео, аудио и векторные представления в одном контуре и одном биллинге.
  • Российские модели — GigaChat и YandexGPT доступны через тот же шлюз и тот же ключ.
  • Управление доступом — квоты по пользователям и подразделениям, RBAC, SSO (AD/LDAP, OAuth2/SAML).
  • PII Guard — обнаружение, маскирование, блокировка или перенаправление запросов с персональными данными.
  • Мониторинг и аудит — дашборды по потреблению.
  • Маршрутизация — автоматический failover между провайдерами, балансировка нагрузки.
  • Protected-эндпоинты — для большинства моделей доступны защищённые маршруты с дополнительной фильтрацией контента.

Как это работает

Архитектура AIaaS

Клиент отправляет стандартный OpenAI-compatible запрос с API-ключом. Шлюз маршрутизирует запрос к нужной модели, учитывает потребление в A-токенах, применяет квоты и политики PII, возвращает ответ.

Модель или сервис указывается в поле model в теле запроса — шлюз определяет маршрут именно по нему, а не по URL.

Категории моделей

Модели разделены на две категории:

  • Локальные (Local) — размещены на инфраструктуре ITGLOBAL.COM: текстовые LLM (Qwen, Gemma) и AI-инструменты (OCR, WhisperX, OmniVoice, PII, Embeddings, Reranker).
  • Внешние (External) — доступны через внешние API-провайдеры: Anthropic, OpenAI, Google, DeepSeek, Kimi, MiniMax, Perplexity и другие, а также российские GigaChat и YandexGPT. Сюда же относятся модели генерации изображений и видео.

Полный список маршрутов и эндпоинтов — на странице Доступные модели.

Биллинг

Потребление считается в A-токенах — универсальной расчётной единице. Каждая модель имеет коэффициент (мультипликатор) для входных (Request) и выходных (Response) токенов.

A-токены = Request Tokens × k_request + Response Tokens × k_response

Для сервисов, где потребление измеряется не в токенах, применяется та же формула с соответствующей единицей: байты, символы или фиксированный тариф за операцию. Единица измерения указана в таблице коэффициентов для каждого маршрута.

A-токены разделены на две категории:

  • Local — для локальных моделей и AI-инструментов на инфраструктуре ITGLOBAL.COM.
  • External — для внешних LLM и API-провайдеров.

Категории учитываются раздельно: остаток Local-пакета нельзя использовать для External-моделей.

Подробнее о расчёте — на странице Расчёт A-токенов.

Ограничения

  • Состав моделей и коэффициенты могут обновляться при изменении цен провайдеров.
  • Набор маршрутов, доступных конкретному ключу, определяется лицензией. Актуальный перечень всегда возвращает GET /v1/models.

Что дальше