Чукотка развивается лучше, чем в среднем по РФ, но и пить продолжает - Трутнев
29 апреля, 23:25
Трутнев попросил Минвостокразвития объяснить цену яблок на Чукотке по 1000 рублей
29 апреля, 23:15
ВТБ: массовых рисков в жилищном строительстве нет
29 апреля, 20:00
Чистая прибыль ВТБ в 1 квартале составила 132,6 млрд рублей, план на год - не менее 600 млрд рублей
29 апреля, 19:30
Большинство россиян предпочитают покупать отечественные овощи и фрукты
29 апреля, 19:15
ВТБ рассчитывает на смягчение риторики ЦБ по ставке
29 апреля, 19:10
ВТБ: комфортный для строительного бизнеса уровень ставок – 11-12% годовых
29 апреля, 18:45
Шесть горняков погибли под лавиной на руднике в Бурятии: что известно
29 апреля, 18:40
Хирурги ЕАО активно используют новое оборудование, переданное онкологическому диспансеру
29 апреля, 16:55
Сбер передал инновационное медицинское оборудование больнице Чукотки
29 апреля, 14:36
Социальное партнерство в СНГ должно выйти на межстрановой уровень – Виктор Пинский
29 апреля, 12:00
Сильный ветер и снегопад: какие угрозы несёт непогода для автомобилей
29 апреля, 00:05
Продлен прием заявок на VII сезон Чемпионата "АртМастерс"
28 апреля, 19:15
Житель Магадана осужден за продажу свыше тонны красной икры без маркировки
28 апреля, 18:25
Виртуальная книжная полка Премии Арсеньева на "Литресе" пополнилась новинками
28 апреля, 17:15

Бизнесу теперь доступен сервис Сбера для проверки и корректуры текстов с помощью ИИ

Решение может быть использовано в копирайтинге и редактуре, при создании маркетинговых и рекламных материалов, в работе редакций СМИ
9 октября 2023, 12:30
Общество
Нашли опечатку?
Ctrl+Enter

Новый ИИ-сервис (6+) представляет собой инструмент для проверки орфографии в текстах на русском языке, работающий на основе нейросетевой генеративной модели. Решение может быть использовано бизнесом для корректуры текста любой длины и формата — в копирайтинге и редактуре, при создании маркетинговых и рекламных материалов, в работе редакций СМИ. Сервис разработан партнёром Сбера компанией SberDevices и доступен в каталоге AI Services на платформе ML Space для зарегистрированных пользователей.

Денис Филиппов, вице-президент по цифровым поверхностям "Салют" Сбербанка:

"Современные модели на основе искусственного интеллекта предоставляют всё больше возможностей для текстовой редактуры. С помощью представленного решения можно обработать любой текст, переписав его без ошибок, использовать генеративные возможности моделей для коррекции правописания в текстах различных доменов. Инструмент может стать ИИ-помощником в различных информационных проектах и поможет быстро и качественно исключить орфографические ошибки в текстах, сэкономив время и ресурсы".

Перед командой разработчиков стояла задача изучить и решить проблемы корректуры правописания с помощью генеративных моделей. Результатом стала разработанная методология генеративной коррекции орфографии для русского языка, которая показывает качество уровня SOTA на задаче проверки орфографии. По итогам работы выпущены: библиотека SAGE с открытым исходным кодом (лицензия MIT), семейство предобученных генеративных моделей (ruM2M100-1.2BruM2M100-418MFredT5-large-spellT5-large-spell) для корректуры правописания на русском и английском языках и хаб с размеченными данными для задачи коррекции орфографии в текстах разных доменов.

На данный момент представленный инструмент опережает по качеству открытые решения для русского языка и проприетарные модели конкурентов. Существенный прирост в метриках относительно других решений является следствием разработанной методологии. Было предложено два метода аугментации ошибок для воспроизведения естественных человеческих опечаток и орфографических ошибок в текстах. С помощью этих модулей был создан корпус текстов с ошибками (около 7 Гб), на котором обучались генеративные модели M2M100 и FredT5-large. Второй этап заключался в дообучении моделей на комбинации собранных параллельных датасетов для исправления орфографии. Лучшая конфигурация полученного решения представлена в виде AI-сервиса на платформе ML Space.

16842
83
89