Новости компаний
Бизнесу теперь доступен сервис Сбера для проверки и корректуры текстов с помощью технологий искусственного интеллекта
Новый ИИ-сервис представляет собой инструмент для проверки орфографии в текстах на русском языке, работающий на основе нейросетевой генеративной модели. Решение может быть использовано бизнесом для корректуры текста любой длины и формата — в копирайтинге и редактуре, при создании маркетинговых и рекламных материалов, в работе редакций СМИ. Сервис разработан партнёром Сбера компанией SberDevices и доступен в каталоге AI Services на платформе ML Space для зарегистрированных пользователей.
9.10.2023, 16:09

Денис Филиппов, вице-президент по цифровым поверхностям «Салют» Сбербанка:

«Современные модели на основе искусственного интеллекта предоставляют всё больше возможностей для текстовой редактуры. С помощью представленного решения можно обработать любой текст, переписав его без ошибок, использовать генеративные возможности моделей для коррекции правописания в текстах различных доменов. Инструмент может стать ИИ-помощником в различных информационных проектах и поможет быстро и качественно исключить орфографические ошибки в текстах, сэкономив время и ресурсы».

Перед командой разработчиков стояла задача изучить и решить проблемы корректуры правописания с помощью генеративных моделей. Результатом стала разработанная методология генеративной коррекции орфографии для русского языка, которая показывает качество уровня SOTA на задаче проверки орфографии. По итогам работы выпущены: библиотека SAGE с открытым исходным кодом (лицензия MIT), семейство предобученных генеративных моделей (ruM2M100-1.2B, ruM2M100-418M, FredT5-large-spell, T5-large-spell) для корректуры правописания на русском и английском языках и хаб с размеченными данными для задачи коррекции орфографии в текстах разных доменов.

На данный момент представленный инструмент опережает по качеству открытые решения для русского языка и проприетарные модели конкурентов. Существенный прирост в метриках относительно других решений является следствием разработанной методологии. Было предложено два метода аугментации ошибок для воспроизведения естественных человеческих опечаток и орфографических ошибок в текстах. С помощью этих модулей был создан корпус текстов с ошибками (около 7 Гб), на котором обучались генеративные модели M2M100 и FredT5-large. Второй этап заключался в дообучении моделей на комбинации собранных параллельных датасетов для исправления орфографии. Лучшая конфигурация полученного решения представлена в виде AI-сервиса на платформе ML Space.

Другие новости рубрики
ВТБ: мошенники стали представляться сотрудниками налоговой службы
Новости компаний
ВТБ: мошенники стали представляться сотрудниками налоговой службы
22.02.2024, 13:10
Сбер: телефонные мошенники начали вербовать своих жертв для преступных схем
Новости компаний
Сбер: телефонные мошенники начали вербовать своих жертв для преступных схем
Сбербанк выявил новую схему мошенничества, связанную с вовлечением жертв социальной инженерии в новые махинации...
21.02.2024, 16:50
Сбер: В 2023 году средний чек в интернет-магазинах оказался выше, чем в рознице
Новости компаний
Сбер: В 2023 году средний чек в интернет-магазинах оказался выше, чем в рознице
20.02.2024, 17:13
Новости компаний
Сбербанк изменил условия субсидирования для ряда застройщиков
19.02.2024, 16:05
Новости компаний
На самое важное: 1 млн юных клиентов Сбера уже открыли детские «Копилки» 
Дети копят на подарки, домашних питомцев, путешествия, поездки, учёбу и даже недвижимость...
16.02.2024, 16:12
Новости компаний
ВТБ выяснил, кто и когда покупает больше всего книг
Чаще всего россияне покупают книги в качестве подарков на Новый год и детям к началу учебного года.
16.02.2024, 10:16
GigaChat сдал экзамен на врача
Новости компаний
GigaChat сдал экзамен на врача
15.02.2024, 17:33
Стартовала регистрация на конференцию Data Fusion 2024
Новости компаний
Стартовала регистрация на конференцию Data Fusion 2024
14.02.2024, 17:45
ВТБ: портфель классических сбережений физлиц превысил 7 трлн рублей
Новости компаний
ВТБ: портфель классических сбережений физлиц превысил 7 трлн рублей
14.02.2024, 17:21