Магаданцу грозит реальный срок за изготовление и хранение оружия
Читать
4 дня осталось до завершения приема снимков на конкурс "Корюшка, я люблю тебя"
Читать
Восстановлено движение по ледовой переправе через Яну
Читать
К 80-летию Великой Победы в России запущен официальный сайт may9.ru
Читать
Лишь тот, кто родился и вырос в СССР, даст 8 верных ответов — ТЕСТ
Читать
Любой гражданин СССР запросто пройдет на 7/7, а вы сможете? — ТЕСТ
Читать
Ваш кругозор с грецкий орех, если вам не под силу хотя бы 5/7 — ТЕСТ на эрудицию
Читать
В Магадане подвели итоги регионального конкурса "Живое слово о войне"
16:31
Магаданцу грозит реальный срок за изготовление и хранение оружия
16:13
В Магадане на Пролетарской, 81, 81к2 отключат холодную воду 20 февраля
15:53
Брутальный романтик: смотрим фильм с номинантом на "Оскар" Юрой Борисовым (ОБЗОР)
15:35
Ведущие ученые и отраслевые лидеры примут участие в форуме будущих технологий
15:35
Колымчанам рассказали о возвращении к прежним условиям "Дальневосточной ипотеки"
15:28
Колымчан предупреждают: кибермошенники взламывают аккаунты и просят деньги
15:23
В Холодном продолжаются аварийно-восстановительные работы
14:48
Магаданцев старшего возраста приглашают на курсы информационной грамотности
14:28
Жительница Олы может получить два года колонии за избиение мужчины скейтбордом
14:16
Жителю Ягоднинского района грозит срок за угрозу убийством охотничьим ружьем
14:13
Колымчан приглашают принять участие в конкурсе "Колыма в живописи и литературе"
14:07
Участковые полиции ОМВД России по Магадану продолжают отчитываться о работе
13:40
На Колыме стало больше доноров костного мозга
13:13
4 дня осталось до завершения приема снимков на конкурс "Корюшка, я люблю тебя"
12:45

Бизнесу теперь доступен сервис Сбера для проверки и корректуры текстов с помощью ИИ

Решение может быть использовано в копирайтинге и редактуре, при создании маркетинговых и рекламных материалов, в работе редакций СМИ
9 октября 2023, 12:30 Общество
Тематическая иллюстрация https://ru.freepik.com/
Тематическая иллюстрация
Фото: https://ru.freepik.com/
Нашли опечатку?
Ctrl+Enter

Новый ИИ-сервис (6+) представляет собой инструмент для проверки орфографии в текстах на русском языке, работающий на основе нейросетевой генеративной модели. Решение может быть использовано бизнесом для корректуры текста любой длины и формата — в копирайтинге и редактуре, при создании маркетинговых и рекламных материалов, в работе редакций СМИ. Сервис разработан партнёром Сбера компанией SberDevices и доступен в каталоге AI Services на платформе ML Space для зарегистрированных пользователей.

Денис Филиппов, вице-президент по цифровым поверхностям "Салют" Сбербанка:

"Современные модели на основе искусственного интеллекта предоставляют всё больше возможностей для текстовой редактуры. С помощью представленного решения можно обработать любой текст, переписав его без ошибок, использовать генеративные возможности моделей для коррекции правописания в текстах различных доменов. Инструмент может стать ИИ-помощником в различных информационных проектах и поможет быстро и качественно исключить орфографические ошибки в текстах, сэкономив время и ресурсы".

Перед командой разработчиков стояла задача изучить и решить проблемы корректуры правописания с помощью генеративных моделей. Результатом стала разработанная методология генеративной коррекции орфографии для русского языка, которая показывает качество уровня SOTA на задаче проверки орфографии. По итогам работы выпущены: библиотека SAGE с открытым исходным кодом (лицензия MIT), семейство предобученных генеративных моделей (ruM2M100-1.2BruM2M100-418MFredT5-large-spellT5-large-spell) для корректуры правописания на русском и английском языках и хаб с размеченными данными для задачи коррекции орфографии в текстах разных доменов.

На данный момент представленный инструмент опережает по качеству открытые решения для русского языка и проприетарные модели конкурентов. Существенный прирост в метриках относительно других решений является следствием разработанной методологии. Было предложено два метода аугментации ошибок для воспроизведения естественных человеческих опечаток и орфографических ошибок в текстах. С помощью этих модулей был создан корпус текстов с ошибками (около 7 Гб), на котором обучались генеративные модели M2M100 и FredT5-large. Второй этап заключался в дообучении моделей на комбинации собранных параллельных датасетов для исправления орфографии. Лучшая конфигурация полученного решения представлена в виде AI-сервиса на платформе ML Space.

16842
31
60