Особый опыт работы с близкими участников СВО показал проект "Бирария" в ЕАО
19:50
И кинооктябрь впереди: Wink.ru представляет премьеры середины осени
18:30
Мария Костюк: У ЕАО появляются колоссальные возможности стать землей обетованной
13:05
От выучки до результата — будни гранатомётного расчёта
30 сентября, 21:21
В Улан-Удэ откроются две новые современные библиотеки в 2026 году
30 сентября, 21:15
Проект "Рокот над Амуром" обучил сотни школьников основам НВП и VR в Хабаровском крае
30 сентября, 20:45
Книжная ярмарка будет работать все три дня фестиваля "Литература Тихоокеанской России"
30 сентября, 19:05
Виктор Пинский принял участие в заседании Совета глав правительств СНГ
30 сентября, 16:30
Анна Гончарова: Книги номинантов Премии имени Арсеньева пишутся с душой и не для славы
30 сентября, 14:20
СберСтрахование прорабатывает продукты для беспилотных авто
29 сентября, 18:40
Необыкновенный диктант пройдет во Владивостоке в дни фестиваля "ЛиТР"
29 сентября, 17:35
Михаил Самойлов: Снимаю шляпу перед организаторами Премии имени Арсеньева
29 сентября, 11:50
Kia Rio, Lada Granta и Hyundai Solaris стали самыми востребованными авто прошедшего лета
26 сентября, 22:20
Улан-Удэ вошел в число лучших в стране по интеллектуальным транспортным системам
26 сентября, 18:50
"ЛиТР" — один из самых важных литературных фестивалей в России на данный момент"
26 сентября, 18:10

Речевые технологии платформы SaluteSpeech стали ещё доступнее для пользователей

Перевести аудио в текст или синтезировать текст в аудио теперь можно в отдельном приложении — SaluteSpeech App
17 ноября 2023, 13:30 Общество
Нашли опечатку?
Ctrl+Enter

Сбер сообщил о запуске отдельного приложения для работы с речевыми технологиями — SaluteSpeech App (6+). Это новый удобный инструмент для распознавания аудио и озвучивания текста. Приложение доступно для популярных операционных систем, отличается простотой использования и включает в себя возможности GigaChat API (6+), программного интерфейса доступа к сервису GigaChat.

В SaluteSpeech App два раздела, каждый из которых соответствует своей технологии. Раздел "Распознавание" предназначен для текстовой расшифровки встреч, звонков, интервью и любых других голосовых файлов. Раздел "Синтез", наоборот, позволяет озвучить текст, настраивая паузы и ударения, и даёт возможность скачать готовый аудиофайл на своё устройство. Синтезировать текст можно разными голосами из семи общедоступных вариантов на русском и английском языках.

Использование GigaChat API дополнительно упрощает процесс подготовки аудиоконтента. Пользователь может загрузить короткие тезисы и попросить нейросетевую модель на их базе подготовить необходимый текст для последующего синтеза. Например, написать сказку по заданной теме, затем озвучить ее, чтобы полученный аудиофайл включать ребенку в машине или перед сном. Также с помощью GigaChat API в приложении SaluteSpeech App можно сделать короткую выжимку протокола встречи, аналитического отчёта или любого другого текста, а затем озвучить полученный материал. Есть множество и других кейсов, всё зависит от задач и фантазии пользователя.

Новое приложение будет доступно всем без оплаты и подойдёт для решения самых разных задач. Например, журналисты могут быстро расшифровать интервью, авторы книг — озвучить свои произведения, разработчики приложений с голосовыми командами — создавать для них голосовые дорожки, студенты —расшифровывать лекции и многое другое.

Для начала работы с SaluteSpeech App необходимо скачать приложение. Внутри приложения перейти по ссылке для создания проекта SaluteSpeech и GigaChat, далее перенести свои авторизационные данные из соответствующего проекта в приложение SaluteSpeech App. После чего можно приступить к решению задач с использованием передовых технологий Сбера.

16842
83
89