
API для распознавания и синтеза речи в реальном времени с потоковым режимом через gRPC и REST. Часть T-API от Т-Банка (бывший Tinkoff VoiceKit). Сервис ООО «ТЦР»: распознавание доступно для ЮЛ и физлиц, синтез — только для ЮЛ.
Tinkoff VoiceKit — российский API распознавания и синтеза речи от Тинькофф. Точность 95% на русском, фокус на финансовый сектор и звонки колл-центра, 20+ голосов синтеза, потоковое распознавание для голосовых ботов. От 8 ₽/мин, документация, SDK для Python, Java, JavaScript.

API для распознавания и синтеза речи в реальном времени с потоковым режимом через gRPC и REST. Часть T-API от Т-Банка (бывший Tinkoff VoiceKit). Сервис ООО «ТЦР»: распознавание доступно для ЮЛ и физлиц, синтез — только для ЮЛ.
| Сервис | Мин. цена | Бесплатная версия | Развёртывание |
|---|---|---|---|
| T-Bank VoiceKit | По запросу | — | Облачный API (developer.tbank.ru) |
Tinkoff VoiceKit — облачный API распознавания и синтеза речи от Тинькофф, работает с 2019 года. Конкурент Yandex SpeechKit с похожим качеством на чистой русской речи (95%+) и более низкой ценой (8 ₽/мин против 10 ₽/мин у Yandex). Главное отличие — специализация на финансовом секторе и колл-центрах. Модели обучены на банковских и юридических разговорах, отлично распознают финансовую терминологию: банковские продукты, юридические термины, бухгалтерские операции, страховые продукты. Используется в собственных продуктах Тинькофф (Олег, голосовые боты, мобильное приложение).
Финансовый сектор: банки, страховые компании, инвестиционные сервисы — VoiceKit лучше распознаёт финансовую терминологию на 5-10% точнее Yandex. Колл-центры с фокусом на финансы и юриспруденцию: качество распознавания специальной лексики важнее средней. Бюджет: цена на 20-30% ниже Yandex для тех же объёмов. Дополнительные функции голосовой биометрии: верификация голоса для безопасной аутентификации в финансовых приложениях. Если используете финтех-стек Тинькофф (Tinkoff Connect API, OpenAPI Banking) — нативная интеграция упрощает разработку. Многие крупные компании используют оба провайдера для резервирования и балансировки нагрузки.
Базовое распознавание речи: 8 ₽/минута, для большинства задач достаточно. Премиум с пользовательскими словарями: 15 ₽/минута, для специальной терминологии. Синтез речи (TTS): 350 ₽ за 1 млн символов (≈12% дешевле Yandex). Бесплатный тариф: 1500 минут в месяц бесплатно для тестов и прототипов. Корпоративный тариф: индивидуальные условия от 100 000 ₽/мес с скидками 30-50% на объёмы. Расчёт для среднего проекта (10 000 минут в месяц): 80 000 ₽/мес базового тарифа. Для крупного проекта (100 000 минут): со скидками 30-40% — 480 000-560 000 ₽/мес против 600 000-700 000 ₽ у Yandex.
SDK для Python, Java, JavaScript/TypeScript, Go. REST API и gRPC для real-time streaming с задержкой 150-300 мс — подходит для голосовых ботов и live-диалогов. Поддержка форматов: PCM, WAV, MP3, FLAC, OPUS. Работает с любой инфраструктурой: Yandex Cloud, AWS, Google Cloud, on-premise серверы. 20+ голосов синтеза с эмоциональными стилями (neutral, good, friendly, evil), скоростью 0,5x-2x, поддержкой SSML. Дополнительные функции: голосовая биометрия (верификация по голосу), определение языка, поиск ключевых слов в потоке.
Колл-центры банков и финансовых компаний для автоматического анализа разговоров операторов. Голосовые боты для банков и страховых: автоматизация типовых запросов клиентов с движком VoiceKit. Транскрибация юридических записей и договоров: точность распознавания юридической терминологии. Бухгалтерские сервисы: голосовой ввод платежей. Голосовая верификация в мобильных приложениях для безопасной аутентификации без паролей. Real-time распознавание для синхронного перевода презентаций. Для российского финтеха VoiceKit — стандарт де-факто.
Каталог обновлён: май 2026