Этнофестиваль "Бирaрия" выходит на международный уровень
19:40
Дальневосточные родители щедрее на "карманные" 
18:30
Кредит наличными в АТБ: деньги на любые цели без залога и поручителей
16:38
На Дальнем Востоке развернулась конкуренция за каждого инвестора — Ольга Курилова
13:25
Число пострадавших при пожаре на Амурском ГХК возросло, есть погибший
00:45
Аэрофлот профинансировал программу "плоских" тарифов уже на 5 млрд рублей за 7 месяцев года
25 августа, 20:25
Владимир Семенчик: Премия Арсеньева это мощный литературный катализатор Дальнего востока
25 августа, 19:05
На Российско-Китайском форуме обсудят нацпроект "Международная кооперация и экспорт"
25 августа, 16:25
В Хабаровске прошел финальный этап Чемпионата "АртМастерс" для основной категории
25 августа, 16:15
Жители Дальнего Востока за 8 месяцев 2026 года накопили 3 млрд рублей
25 августа, 11:00
Статистика ЦБ: Страховая Сбера в I полугодии обеспечила россиянам почти треть всех выплат в стране
24 августа, 22:55
Больше половины россиян взяли на себя управление финансами пожилых родных
24 августа, 22:15
Шедевры природы: как искусство учит нас жить в гармонии с окружающим миром
24 августа, 19:00
Средний чек 766 рублей: общепит Дальнего Востока вырос на 3,7% 
24 августа, 18:30
Даниил Тестов: Региональная литература может стать самостоятельным брендом
24 августа, 17:20

Речевые технологии платформы SaluteSpeech стали ещё доступнее для пользователей

Перевести аудио в текст или синтезировать текст в аудио теперь можно в отдельном приложении — SaluteSpeech App
17 ноября 2023, 13:30
Общество
Нашли опечатку?
Ctrl+Enter

Сбер сообщил о запуске отдельного приложения для работы с речевыми технологиями — SaluteSpeech App (6+). Это новый удобный инструмент для распознавания аудио и озвучивания текста. Приложение доступно для популярных операционных систем, отличается простотой использования и включает в себя возможности GigaChat API (6+), программного интерфейса доступа к сервису GigaChat.

В SaluteSpeech App два раздела, каждый из которых соответствует своей технологии. Раздел "Распознавание" предназначен для текстовой расшифровки встреч, звонков, интервью и любых других голосовых файлов. Раздел "Синтез", наоборот, позволяет озвучить текст, настраивая паузы и ударения, и даёт возможность скачать готовый аудиофайл на своё устройство. Синтезировать текст можно разными голосами из семи общедоступных вариантов на русском и английском языках.

Использование GigaChat API дополнительно упрощает процесс подготовки аудиоконтента. Пользователь может загрузить короткие тезисы и попросить нейросетевую модель на их базе подготовить необходимый текст для последующего синтеза. Например, написать сказку по заданной теме, затем озвучить ее, чтобы полученный аудиофайл включать ребенку в машине или перед сном. Также с помощью GigaChat API в приложении SaluteSpeech App можно сделать короткую выжимку протокола встречи, аналитического отчёта или любого другого текста, а затем озвучить полученный материал. Есть множество и других кейсов, всё зависит от задач и фантазии пользователя.

Новое приложение будет доступно всем без оплаты и подойдёт для решения самых разных задач. Например, журналисты могут быстро расшифровать интервью, авторы книг — озвучить свои произведения, разработчики приложений с голосовыми командами — создавать для них голосовые дорожки, студенты —расшифровывать лекции и многое другое.

Для начала работы с SaluteSpeech App необходимо скачать приложение. Внутри приложения перейти по ссылке для создания проекта SaluteSpeech и GigaChat, далее перенести свои авторизационные данные из соответствующего проекта в приложение SaluteSpeech App. После чего можно приступить к решению задач с использованием передовых технологий Сбера.

16842
83
89