ВТБ завершил перевод розничных кредитов Почта Банка
24 апреля, 19:50
Бизнес получил от СберСтрахования 1,8 млрд рублей выплат в I квартале 2026 года
24 апреля, 19:20
C рабочим визитом ЕАО посетили эксперты НМИЦ терапии и профилактики Минздрава РФ
24 апреля, 11:25
Toyota в онлайн-продажах поднялась на второе место, а Hyundai вылетел из топ-3 с пробегом
23 апреля, 20:40
Резидентам префрежимов ужесточили получение налоговых льгот — разбор новых правил
23 апреля, 19:00
Глава ВТБ Андрей Костин: экономика и предприятия выстаивают
23 апреля, 18:45
Сбер повысил уровень обслуживания для людей с особенностями речи в контактном центре
23 апреля, 18:10
"А хорошо жить ещё лучше": Дальнему Востоку подготовили Стратегию развития
23 апреля, 15:30
"Продолжайте писать о Дальнем Востоке"
23 апреля, 14:40
Все граждане России влияют на формирование законодательства страны – Виктор Пинский
23 апреля, 12:00
"Что будет написано сейчас – останется на века" - Владек Дарман о Премии им. Арсеньева
22 апреля, 20:30
Дальневосточный бизнес за месяц провёл через А7 платежи почти на 1,5 млрд рублей
22 апреля, 19:55
ВТБ дал прогноз о росте популярности биометрии в России
22 апреля, 14:50
В ВТБ рассказали об "уберизации" банков в ближайшем будущем
21 апреля, 21:00
Ольга Скоробогатова: "Партнерство – это все-таки не кикбоксинг, а, скорее, танго"
21 апреля, 19:55

Речевые технологии платформы SaluteSpeech стали ещё доступнее для пользователей

Перевести аудио в текст или синтезировать текст в аудио теперь можно в отдельном приложении — SaluteSpeech App
17 ноября 2023, 13:30
Общество
Нашли опечатку?
Ctrl+Enter

Сбер сообщил о запуске отдельного приложения для работы с речевыми технологиями — SaluteSpeech App (6+). Это новый удобный инструмент для распознавания аудио и озвучивания текста. Приложение доступно для популярных операционных систем, отличается простотой использования и включает в себя возможности GigaChat API (6+), программного интерфейса доступа к сервису GigaChat.

В SaluteSpeech App два раздела, каждый из которых соответствует своей технологии. Раздел "Распознавание" предназначен для текстовой расшифровки встреч, звонков, интервью и любых других голосовых файлов. Раздел "Синтез", наоборот, позволяет озвучить текст, настраивая паузы и ударения, и даёт возможность скачать готовый аудиофайл на своё устройство. Синтезировать текст можно разными голосами из семи общедоступных вариантов на русском и английском языках.

Использование GigaChat API дополнительно упрощает процесс подготовки аудиоконтента. Пользователь может загрузить короткие тезисы и попросить нейросетевую модель на их базе подготовить необходимый текст для последующего синтеза. Например, написать сказку по заданной теме, затем озвучить ее, чтобы полученный аудиофайл включать ребенку в машине или перед сном. Также с помощью GigaChat API в приложении SaluteSpeech App можно сделать короткую выжимку протокола встречи, аналитического отчёта или любого другого текста, а затем озвучить полученный материал. Есть множество и других кейсов, всё зависит от задач и фантазии пользователя.

Новое приложение будет доступно всем без оплаты и подойдёт для решения самых разных задач. Например, журналисты могут быстро расшифровать интервью, авторы книг — озвучить свои произведения, разработчики приложений с голосовыми командами — создавать для них голосовые дорожки, студенты —расшифровывать лекции и многое другое.

Для начала работы с SaluteSpeech App необходимо скачать приложение. Внутри приложения перейти по ссылке для создания проекта SaluteSpeech и GigaChat, далее перенести свои авторизационные данные из соответствующего проекта в приложение SaluteSpeech App. После чего можно приступить к решению задач с использованием передовых технологий Сбера.

16842
83
89