ВТБ: в первом полугодии продажи кредитов наличными в России выросли на 68%
13:50
Состав жюри восьмого сезона Премии им. Арсеньева объявили 1 июля в Москве
1 июля, 20:45
Более 30 трупов, кости и зловоние: адом и пыточной стал для собак дом заводчицы из ЕАО
1 июля, 19:50
Виктор Пинский принял участие в заседании совета Всеобщей конфедерации профсоюзов
1 июля, 19:00
Опрос ВТБ: страх "не угадать" мешает росту популярности подписок в качестве подарка
1 июля, 18:25
Владимир Касютин: Медиа, которые занимаются проблемами людей, будут востребованы
1 июля, 17:40
Виктор Пинский встретился с депутатами парламента Таджикистана
1 июля, 17:40
ВТБ представил основные направления стратегии на 2027–2029 годы
1 июля, 17:30
А7А5: Российскому крипторынку важно найти баланс между контролем и развитием инноваций
1 июля, 01:24
СберСтрахование назвала регионы, где припаркованные автомобили чаще всего повреждаются
30 июня, 20:40
ИИнвестиции: каждый пятый россиянин уже использует искусственный интеллект в финансовых вопросах
30 июня, 20:10
Мотивация и "быстрое касание" — то, что нужно начинающему предпринимателю на старте
30 июня, 17:15
Практическое применение технологии Physical AI в ретейле
30 июня, 17:10
Коллаборации и переобучение укрепляют малый бизнес в условиях неопределённости
30 июня, 17:00
СберИнвестиции: у подростков-инвесторов растет интерес к облигациям
30 июня, 15:50

Речевые технологии платформы SaluteSpeech стали ещё доступнее для пользователей

Перевести аудио в текст или синтезировать текст в аудио теперь можно в отдельном приложении — SaluteSpeech App
17 ноября 2023, 13:30
Общество
Нашли опечатку?
Ctrl+Enter

Сбер сообщил о запуске отдельного приложения для работы с речевыми технологиями — SaluteSpeech App (6+). Это новый удобный инструмент для распознавания аудио и озвучивания текста. Приложение доступно для популярных операционных систем, отличается простотой использования и включает в себя возможности GigaChat API (6+), программного интерфейса доступа к сервису GigaChat.

В SaluteSpeech App два раздела, каждый из которых соответствует своей технологии. Раздел "Распознавание" предназначен для текстовой расшифровки встреч, звонков, интервью и любых других голосовых файлов. Раздел "Синтез", наоборот, позволяет озвучить текст, настраивая паузы и ударения, и даёт возможность скачать готовый аудиофайл на своё устройство. Синтезировать текст можно разными голосами из семи общедоступных вариантов на русском и английском языках.

Использование GigaChat API дополнительно упрощает процесс подготовки аудиоконтента. Пользователь может загрузить короткие тезисы и попросить нейросетевую модель на их базе подготовить необходимый текст для последующего синтеза. Например, написать сказку по заданной теме, затем озвучить ее, чтобы полученный аудиофайл включать ребенку в машине или перед сном. Также с помощью GigaChat API в приложении SaluteSpeech App можно сделать короткую выжимку протокола встречи, аналитического отчёта или любого другого текста, а затем озвучить полученный материал. Есть множество и других кейсов, всё зависит от задач и фантазии пользователя.

Новое приложение будет доступно всем без оплаты и подойдёт для решения самых разных задач. Например, журналисты могут быстро расшифровать интервью, авторы книг — озвучить свои произведения, разработчики приложений с голосовыми командами — создавать для них голосовые дорожки, студенты —расшифровывать лекции и многое другое.

Для начала работы с SaluteSpeech App необходимо скачать приложение. Внутри приложения перейти по ссылке для создания проекта SaluteSpeech и GigaChat, далее перенести свои авторизационные данные из соответствующего проекта в приложение SaluteSpeech App. После чего можно приступить к решению задач с использованием передовых технологий Сбера.

16842
83
89