Salute Speech Bot
Преимущества
- Распознавание речи на русском, казахском и английском языках
- Обработка аудиофайлов форматов MP3, WAV, FLAC, OggOpus размером до 20 МБ
- Автоматическое добавление пунктуации в готовый текст
- Бесплатный доступ через Telegram с ежемесячным лимитом 100 минут распознавания
Недостатки
- Обработка запросов на бесплатном тарифе может занимать до 72 часов
- Поддерживает только одноканальное аудио с частотой дискретизации 8-96 кГц
Тарифы
- Freemium: 100 минут распознавания аудио + генерация речи на 200 000 символов в месяц
- Базовый: 0,01₽ за 1 секунду распознавания (минимальный ежемесячный платёж 3999₽)
- Первые 30 дней использования Базового тарифа: бесплатно в пределах 3999₽
Доступность по платформам
-
Веб-приложение Нет
-
iOS приложение Нет
-
Telegram-бот Да
-
Android приложение Нет
-
Расширения Нет
Обзор Salute Speech Bot
Salute Speech Bot — это Telegram-бот, разработанный Сбером для автоматической транскрибации голосовых сообщений и аудиофайлов на русском языке. Сервис использует технологию SaluteSpeech для распознавания речи и работает с популярными аудиоформатами (MP3, WAV, FLAC, OggOpus) размером до 20 МБ. Бот поддерживает одноканальное аудио с частотой дискретизации от 8 до 96 кГц и создаёт текстовые расшифровки прямо в мессенджере. Инструмент доступен в бесплатной версии с ограничениями и платных тарифах с расширенными возможностями.
Основные возможности
- Распознавание речи на русском языке — преобразование голосовых сообщений и аудиофайлов в текст с точностью до 95%. Применяется для быстрой расшифровки записей без необходимости ручного ввода.
- Поддержка казахского и английского языков — расширенная языковая поддержка для многоязычных аудиозаписей, что полезно при работе с международным контентом.
- Автоматическая расстановка знаков препинания — система самостоятельно добавляет пунктуацию в распознанный текст, улучшая читаемость и структурированность расшифровки.
- Фильтрация фоновых шумов — алгоритмы обработки помогают распознавать речь в шумных условиях, выделяя голос из общего звукового фона.
- Интеграция через API — разработчики могут встроить функциональность транскрибации в свои приложения через простой программный интерфейс.
- Прямая работа в Telegram — пользователям не требуются дополнительные приложения; все операции выполняются в знакомом мессенджере.
Для кого подойдёт
Salute Speech Bot востребован у журналистов и исследователей, которым необходимо быстро перевести интервью и записанные разговоры в письменный формат. Аналитики и бизнес-пользователи применяют сервис для документирования совещаний и презентаций, получая готовый текст вместо ручного конспектирования. Преподаватели и студенты используют транскрибацию лекций и семинаров для создания учебных материалов. Контент-креаторы и подкастеры расшифровывают аудиозаписи для подготовки текстов статей, описаний видео и расширения аудитории через поисковую индексацию текстового контента. Компании, работающие с русскоязычным аудио, получают инструмент с минимальными затратами благодаря бесплатному тарифу на начальном этапе.
FAQ по Salute Speech Bot
Какие форматы аудиофайлов поддерживает бот?
Сервис работает с форматами MP3, WAV, FLAC и OggOpus. Максимальный размер файла составляет 20 МБ. Поддерживается одноканальное аудио с частотой дискретизации от 8 до 96 кГц, что обеспечивает совместимость с большинством распространённых источников записей.
Сколько стоит использование платного тарифа?
Базовый платный тариф рассчитывается из расчёта 0,01 рубля за одну секунду распознавания аудио, при минимальной сумме подписки 3999 рублей. Новые пользователи получают первые 30 дней бесплатно в пределах стоимости базового тарифа. Freemium-версия предлагает 100 минут распознавания и 200 000 символов генерации речи в месяц без оплаты.
Как быстро бот обрабатывает аудиофайлы?
На платных тарифах с выделенными серверами транскрибация происходит значительно быстрее. Бесплатная версия характеризуется более длительным временем обработки, которое может доходить до 72 часов ожидания. Скорость обработки напрямую зависит от выбранного тарифного плана.
Может ли бот работать с шумным аудио?
Да, система включает функцию фильтрации фоновых звуков, которая позволяет распознавать речь даже в условиях повышенного шума. Однако качество распознавания может варьироваться в зависимости от уровня и характера помех в исходной записи.