ВТБ завершил перевод розничных кредитов Почта Банка
24 апреля, 19:50
Бизнес получил от СберСтрахования 1,8 млрд рублей выплат в I квартале 2026 года
24 апреля, 19:20
C рабочим визитом ЕАО посетили эксперты НМИЦ терапии и профилактики Минздрава РФ
24 апреля, 11:25
Toyota в онлайн-продажах поднялась на второе место, а Hyundai вылетел из топ-3 с пробегом
23 апреля, 20:40
Резидентам префрежимов ужесточили получение налоговых льгот — разбор новых правил
23 апреля, 19:00
Глава ВТБ Андрей Костин: экономика и предприятия выстаивают
23 апреля, 18:45
Сбер повысил уровень обслуживания для людей с особенностями речи в контактном центре
23 апреля, 18:10
"А хорошо жить ещё лучше": Дальнему Востоку подготовили Стратегию развития
23 апреля, 15:30
"Продолжайте писать о Дальнем Востоке"
23 апреля, 14:40
Все граждане России влияют на формирование законодательства страны – Виктор Пинский
23 апреля, 12:00
"Что будет написано сейчас – останется на века" - Владек Дарман о Премии им. Арсеньева
22 апреля, 20:30
Дальневосточный бизнес за месяц провёл через А7 платежи почти на 1,5 млрд рублей
22 апреля, 19:55
ВТБ дал прогноз о росте популярности биометрии в России
22 апреля, 14:50
В ВТБ рассказали об "уберизации" банков в ближайшем будущем
21 апреля, 21:00
Ольга Скоробогатова: "Партнерство – это все-таки не кикбоксинг, а, скорее, танго"
21 апреля, 19:55

AI Journey 2023: пользователи GigaChat смогут генерировать музыку по текстовому запросу

Сбер расширит возможности своего сервиса благодаря интеграции в GigaChat нейросетей CLaMP и SymFormer
24 ноября 2023, 17:10
Общество
Нашли опечатку?
Ctrl+Enter

Скоро GigaChat сможет генерировать музыкальные треки по произвольным текстовым запросам пользователей. Об этом рассказал вице-президент по цифровым поверхностям "Салют" (18+) Сбербанка Денис Филиппов в рамках международной конференции по искусственному интеллекту AI Journey 2023 (16+).

Для генерации музыки человеку будет достаточно сформулировать задачу, например, "Сочини весёлую музыку в стиле кантри" или "Напиши трек для лаундж-зоны бизнес-центра". В ответ GigaChat будет выдавать аудиофайл с уникальной музыкальной композицией и нотную партитуру в формате MIDI, который понимает любая DAW (Digital Audio Workstation). Пользователь сможет прослушать и скачать получившийся трек, а MIDI-файл использовать в собственных творческих проектах (редактировать гармонии, изменять аранжировку и получать разнообразные варианты звучания трека) и даже в музыкальном продакшене.

Генерация музыки в GigaChat (6+) возможна благодаря интеграции нейросетей CLaMP (6+) и SymFormer (6+). Для обучения SymFormer использовались платформа ML Space на базе суперкомпьютера Christofari (18+) и датасет из более 200 тысяч композиций разных стилей: от классики до современной электронной музыки и рока. Модель для генерации треков основана на принципе рассмотрения музыки в качестве нотного текста — в этом помогла адаптация подхода text-2-image к нотному домену.

Создание музыкальных треков происходит в несколько этапов:

Первый этап. С помощью модели CLaMP текстовый запрос пользователя обрабатывается и конвертируется на понятный для генератора мелодий язык.

Второй этап. Полученные данные, включая информацию о стиле, попадают в SymFormer, где происходит генерация нескольких вариантов мультидорожечного трека, из которых нейросеть выбирает наиболее удачные варианты по стилю и композиции.

Третий этап. На финальном этапе механизм рендеринга формирует аудиофайл и передаёт результат пользователю.

Денис Филиппов, вице-президент по Цифровым поверхностям "Салют" Сбербанка:

"Новые возможности GigaChat будут полезны не только музыкальным энтузиастам и представителям творческих профессий. Одним из сегментов целевой аудитории сервиса мы видим представителей среднего и малого предпринимательства. Благодаря GigaChat они смогут быстро, качественно и, что важно, абсолютно легально решать задачи бизнеса: создавать фоновое музыкальное сопровождение для кафе, салонов красоты и залов ожидания, генерировать треки для рекламных видеороликов и соцсетей".

Ранее этой осенью в рамках культурной программы Восточного экономического форума (ВЭФ) (12+) во Владивостоке состоялся один из первых в мире симфонических концертов с импровизациями от искусственного интеллекта. Вместе с оркестром Мариинского театра Приморской сцены выступила нейросеть SymFormer. В первой части симфонии "Космос" (6+), написанной композитором Петром Дранга, нейросеть управляла экспрессивностью исполнения, а в третьей и четвертой частях симфонии импровизировала в режиме реального времени на основе той информации, которую получила от партитуры музыканта.

16842
83
89