Институт AIRI представил на конференции ACL 2024 в Таиланде результаты исследования, в ходе которого команда ученых проанализировала взаимодействие между 189 языками, охватив около 5 тысяч языковых пар. При участии коллег из Сколтеха исследователи определили «супердоноров» и «суперреципиентов» — языки, которые наиболее эффективно передают или усваивают знания. В мире существует более 7100 разговорных языков, однако лишь небольшая их часть поддерживается современными технологическими сервисами: электронными словарями, системами автоматического перевода, голосовыми и ИИ-ассистентами. Большинство языков относится к малоресурсным (МРЯ) — им свойственны малое распространение в сети, нехватка переводчиков и ряд других особенностей, которые затрудняют их цифровую обработку и обучение ИИ-моделей, усиливая языковой разрыв. Большинство работ опирается на английский как на основной источник, но доказательств того, что этот выбор наиболее оптимален на данный момент нет. Понять, какие языки могут б
Названы языки, которые лучше всего передают или усваивают знания для ИИ
5 сентября 20245 сен 2024
81
2 мин