AIaaS — AI as a Service
Общие сведения
AIaaS (AI as a Service) — сервис ITGLOBAL.COM, предоставляющий доступ к десяткам языковых моделей и специализированных AI-инструментов через единый API-шлюз. API совместим с OpenAI, что позволяет использовать существующие библиотеки и SDK без изменения кода.
Сервис построен на платформе AInergy — корпоративном AI-оркестраторе, входящем в экосистему ITG. AInergy зарегистрирована в реестре отечественного ПО Министерства цифрового развития РФ.
Для каких задач используется
- Анализ и обработка документов — суммаризация, классификация, извлечение данных из договоров и отчётов.
- Генерация текста — деловая переписка, черновики, технические описания.
- Генерация изображений — иллюстрации, визуальные концепции, изображения для маркетинговых материалов.
- Генерация видео — короткие видеоролики по текстовому описанию.
- OCR и конвертация документов — извлечение текста из PDF, изображений, сканов.
- Транскрипция речи — преобразование аудио в текст (WhisperX), диаризация, синтез речи (TTS).
- Векторные вычисления и RAG — эмбеддинги, реранкинг, поиск по базе знаний.
- Поиск в интернете — модели с доступом к актуальным веб-данным.
- PII-фильтрация — обнаружение и маскирование персональных данных в запросах.
- Перевод — машинный перевод через DeepL.
Ключевые возможности
- Единый API — один endpoint, один ключ, доступ ко всем моделям. Смена модели без изменения интеграции.
- OpenAI-compatible — поддержка
/v1/chat/completions,/v1/models,/v1/embeddings, streaming, function calling. Дополнительно доступны/v1/imagesдля генерации изображений,/v1/videosдля генерации видео и/v1/responsesдля российских моделей. - Мультимодальность — текст, изображения, видео, аудио и векторные представления в одном контуре и одном биллинге.
- Российские модели — GigaChat и YandexGPT доступны через тот же шлюз и тот же ключ.
- Управление доступом — квоты по пользователям и подразделениям, RBAC, SSO (AD/LDAP, OAuth2/SAML).
- PII Guard — обнаружение, маскирование, блокировка или перенаправление запросов с персональными данными.
- Мониторинг и аудит — дашборды по потреблению.
- Маршрутизация — автоматический failover между провайдерами, балансировка нагрузки.
- Protected-эндпоинты — для большинства моделей доступны защищённые маршруты с дополнительной фильтрацией контента.
Как это работает

Клиент отправляет стандартный OpenAI-compatible запрос с API-ключом. Шлюз маршрутизирует запрос к нужной модели, учитывает потребление в A-токенах, применяет квоты и политики PII, возвращает ответ.
Модель или сервис указывается в поле model в теле запроса — шлюз определяет маршрут именно по нему, а не по URL.
Категории моделей
Модели разделены на две категории:
- Локальные (Local) — размещены на инфраструктуре ITGLOBAL.COM: текстовые LLM (Qwen, Gemma) и AI-инструменты (OCR, WhisperX, OmniVoice, PII, Embeddings, Reranker).
- Внешние (External) — доступны через внешние API-провайдеры: Anthropic, OpenAI, Google, DeepSeek, Kimi, MiniMax, Perplexity и другие, а также российские GigaChat и YandexGPT. Сюда же относятся модели генерации изображений и видео.
Полный список маршрутов и эндпоинтов — на странице Доступные модели.
Биллинг
Потребление считается в A-токенах — универсальной расчётной единице. Каждая модель имеет коэффициент (мультипликатор) для входных (Request) и выходных (Response) токенов.
A-токены = Request Tokens × k_request + Response Tokens × k_response
Для сервисов, где потребление измеряется не в токенах, применяется та же формула с соответствующей единицей: байты, символы или фиксированный тариф за операцию. Единица измерения указана в таблице коэффициентов для каждого маршрута.
A-токены разделены на две категории:
- Local — для локальных моделей и AI-инструментов на инфраструктуре ITGLOBAL.COM.
- External — для внешних LLM и API-провайдеров.
Категории учитываются раздельно: остаток Local-пакета нельзя использовать для External-моделей.
Подробнее о расчёте — на странице Расчёт A-токенов.
Ограничения
- Состав моделей и коэффициенты могут обновляться при изменении цен провайдеров.
- Набор маршрутов, доступных конкретному ключу, определяется лицензией. Актуальный перечень всегда возвращает
GET /v1/models.