

Palatine Speech – российская облачная платформа для комплексной обработки речи с помощью моделей искусственного интеллекта. Продукт предоставляет API для интеграции речевых функций в приложения, контакт-центры, голосовых агентов, корпоративные системы, образовательные сервисы и другие цифровые продукты. Интерфейс совместим с форматом OpenAI Audio API, поэтому существующие интеграции можно адаптировать путем изменения базового адреса и параметров запроса.
Основная функция платформы – преобразование аудио и видео в текст. Сервис поддерживает более 23 файловых форматов, файлы длительностью свыше десяти часов и около 100 языков. Для результата доступны таймкоды каждого слова, автоматическое определение языка, мультиязычный перевод и формирование субтитров SRT и VTT. Обработка может выполняться синхронно, в потоковом режиме или через асинхронный API с получением статуса задачи.
Отдельная модель выполняет диаризацию – разделение записи по говорящим. Она поддерживает многоканальное аудио, определение до пяти дикторов, работу с шумными записями из офиса, улицы или контакт-центра, таймкоды и мультиязычные материалы. Кластеры спикеров можно объединять или разделять в соответствии со сценарием обработки.
Платформа также предоставляет функции анализа тональности речи, суммаризации и анализа текста с использованием языковых моделей. Для специализированной лексики предусмотрены пользовательские словари и термины. API подходит как для проверки гипотез и прототипов, так и для регулярной промышленной обработки больших объемов аудио.
Инфраструктура размещена в четырех географически распределенных российских центрах обработки данных уровня Tier III. Передача запросов защищена TLS. На сайте продукта указано соответствие обработке данных в рамках требований 152-ФЗ, а также отсутствие обучения моделей на данных клиентов. При инцидентах трафик автоматически переключается на резервные узлы.
Для стандартного облачного сценария используется пополняемый баланс без обязательной подписки. Доступны бесплатные минуты для первоначального тестирования. Для среднего бизнеса предусмотрены специальные условия, приоритетная обработка и возможность адаптации моделей под предметную область. Корпоративным заказчикам доступно локальное развертывание On-Premise с работой без доступа к сети, автомасштабированием и интеграцией с внутренними системами.
Palatine Speech применяется для расшифровки переговоров и совещаний, аналитики контакт-центров, голосового ввода, подготовки субтитров, обработки медиаконтента, образовательных решений и речевых интерфейсов. Документация содержит руководство по быстрому старту, описание поддерживаемых языков и форматов, примеры запросов и справочник REST API.
Команда также развивает Palatine Murmur 0.4.0 – локальное приложение для записи, транскрипции и AI-резюмирования встреч на Mac с Apple Silicon. Версии для Windows и Linux находятся в разработке.