Вахта Победы: японский агрессор будет разгромлен, рабочие трудятся фронтовыми темпами
12:00
Вахта Победы: ставропольцы после объявления войны Японии вышли на митинги
01:31
Аналитика ВТБ: в июле рынок автокредитования продемонстрировал рост на 23%
7 августа, 19:35
Ударным трудом заводчане Уссурийска поддержали бойцов Маньчжурской операции
7 августа, 19:28
Сбер и "Школа 21" проведут кейс-чемпионат по Process Mining
7 августа, 13:30
Карта "СВОи" от ВТБ стала доступна ветеранам МЧС и прокуратуры
6 августа, 19:50
Курс на ЗОЖ: 43% жителей Хабаровска регулярно занимается спортом
6 августа, 19:10
Вахта Победы: ГЭС для колхозов решено строить в Приамурье
6 августа, 13:01
Курсанты кадровой программы "Доблесть Хингана" в ЕАО готовятся к первой стажировке
6 августа, 11:15
Вахта Победы: Колхозы досрочно платили налоги, чтобы приблизить Победу
5 августа, 18:27
Крупный "сухой порт" на Дальнем Востоке построят при финансовой поддержке Сбера и ВЭБ.РФ
5 августа, 14:15
Путь сержанта: от РХБЗ до артиллерии
5 августа, 13:29
ВТБ: в июле выдачи ипотеки в России выросли на 11%
5 августа, 12:45
ВТБ запустил программу стажировок на сезон 2025-2026
4 августа, 19:50
Реконструкция сетей в центре Улан-Удэ завершена на 80%
4 августа, 18:35

Речевые технологии платформы SaluteSpeech стали ещё доступнее для пользователей

Перевести аудио в текст или синтезировать текст в аудио теперь можно в отдельном приложении — SaluteSpeech App
17 ноября 2023, 13:30 Общество
Нашли опечатку?
Ctrl+Enter

Сбер сообщил о запуске отдельного приложения для работы с речевыми технологиями — SaluteSpeech App (6+). Это новый удобный инструмент для распознавания аудио и озвучивания текста. Приложение доступно для популярных операционных систем, отличается простотой использования и включает в себя возможности GigaChat API (6+), программного интерфейса доступа к сервису GigaChat.

В SaluteSpeech App два раздела, каждый из которых соответствует своей технологии. Раздел "Распознавание" предназначен для текстовой расшифровки встреч, звонков, интервью и любых других голосовых файлов. Раздел "Синтез", наоборот, позволяет озвучить текст, настраивая паузы и ударения, и даёт возможность скачать готовый аудиофайл на своё устройство. Синтезировать текст можно разными голосами из семи общедоступных вариантов на русском и английском языках.

Использование GigaChat API дополнительно упрощает процесс подготовки аудиоконтента. Пользователь может загрузить короткие тезисы и попросить нейросетевую модель на их базе подготовить необходимый текст для последующего синтеза. Например, написать сказку по заданной теме, затем озвучить ее, чтобы полученный аудиофайл включать ребенку в машине или перед сном. Также с помощью GigaChat API в приложении SaluteSpeech App можно сделать короткую выжимку протокола встречи, аналитического отчёта или любого другого текста, а затем озвучить полученный материал. Есть множество и других кейсов, всё зависит от задач и фантазии пользователя.

Новое приложение будет доступно всем без оплаты и подойдёт для решения самых разных задач. Например, журналисты могут быстро расшифровать интервью, авторы книг — озвучить свои произведения, разработчики приложений с голосовыми командами — создавать для них голосовые дорожки, студенты —расшифровывать лекции и многое другое.

Для начала работы с SaluteSpeech App необходимо скачать приложение. Внутри приложения перейти по ссылке для создания проекта SaluteSpeech и GigaChat, далее перенести свои авторизационные данные из соответствующего проекта в приложение SaluteSpeech App. После чего можно приступить к решению задач с использованием передовых технологий Сбера.

16842
83
89