В России разработана инновационная интеллектуальная система, предназначенная для выявления потенциально опасной, недостоверной и нежелательной информации в онлайн-публикациях. Об этом сообщает Газета Бийский рабочий со ссылкой на Московский технический университет связи и информатики (МТУСИ).
Ученые из МТУСИ представили сервис, который использует современные технологии машинного обучения и методы обработки текстов для автоматической классификации нежелательного контента. Ключевым преимуществом новой разработки является высокая точность анализа текстовых данных, что позволяет более эффективно выявлять ненадежные источники информации.
В рамках проекта были созданы важнейшие элементы системы, среди которых механизмы аутентификации и авторизации пользователей, модули для работы с лексиконом и функции аналитики. Это позволяет не только осуществлять мониторинг, но и вести журналы для дальнейшего анализа.
Как отмечает профессор МТУСИ Юрий Леохин, поиск по словарю обеспечивает начальный уровень анализа благодаря сопоставлению текста с ключевыми словами. Для более точного анализа применяется морфологический подход, который учитывает различные словоформы через лемматизацию. Кроме того, система использует предобученные модели на основе трансформеров для интеллектуального анализа текстов.
Специалисты планируют в будущем продолжать совершенствовать алгоритмы машинного обучения, расширять объем анализируемого словаря и повышать точность категоризации информации. Эти шаги позволят еще более эффективно бороться с распространением недостоверных данных в интернете и обеспечивать пользователей качественной информацией.