Больше новостей об IT в Telegram канале «Код Дурова» Яндекс запустил сервис «Поиск по архивам» в котором собрано более 2,5 млн страниц исторических рукописных документов с текстовой расшифровкой. Об этом «Коду Дурова» сообщили в пресс-службе компании. Новый алгоритм, построенный на основе системы оптического распознавания символов, учитывает особенности почерка, узнаёт утратившие актуальность буквы и понимает особую структуру архивных документов. Нейросеть была обучена при помощи сотен тысяч рукописных строк в реальных архивных документах, датированных с XVIII по XIX век, а также десятков миллионов примеров, которые были сгенерированы. Для расшифровки одной страницы архивного рукописного текста профессионалу может потребоваться до получаса времени. Наш сервис справляется с этим за несколько секунд. В перспективе технологию можно использовать и для решения других задач в продуктах Яндекса, – отметили в Яндексе. Пользователи могут протестировать технологию в действии в сервисе «Поиск по
Яндекс представил нейросеть для расшифровки архивных документов с дореволюционной орфографией
25 января 202325 янв 2023
14
1 мин