Лента новостей 1135 Публикация  

Технологии ABBYY помогают Институту востоковедения РАН в лингвистических исследованиях

Российская компания ABBYY – мировой разработчик программного обеспечения и поставщик услуг в области распознавания и ввода документов, лингвистики и перевода.
 

© Издание 12NEWS (ИП Маринин А.Л.) 12news.ru, 2010

С помощью ABBYY FineReader Engine быстро и корректно оцифровываются тексты на японском и китайском языках

Компания ABBYY, ведущий мировой разработчик программного обеспечения и поставщик услуг в области лингвистики, распознавания документов и ввода данных, объявляет об интеграции инструментария разработчика ABBYY FineReader Engine 9.0 с приложением, разработанным специалистами Института востоковедения РАН для внутренних нужд учреждения. Приложение используется для перевода в электронный вид бумажных документов на японском и китайском языках с целью их последующей лингвистической обработки. Технология ABBYY автоматизировала оцифровку текстов, избавив специалистов ИВ РАН от трудоёмкой работы по ручному вводу, и повысила точность вводимых данных.

Институт востоковедения РАН – академическое научное учреждение, ведущее фундаментальные исследования в области востоковедения. Научные изыскания института охватывают различные отрасли знания: историю, политику, экономику, религию, языки стран Ближнего и Дальнего Востока. Для решения ежедневных исследовательских задач ИВ РАН была необходима удобная встраиваемая технология распознавания, которая бы обеспечила тесную интеграцию процессов распознавания и верификации текстов с оригинальными процедурами лингвистического анализа, разработанными специалистами института. Решение ABBYY FineReader Engine 9.0 было выбрано как наиболее отвечающее потребностям ИВ РАН.

Теперь при обработке текстов на японском и китайском языках специалистам учреждения доступна широкая функциональность технологии ABBYY, в том числе инструменты коррекции отсканированного изображения для более качественного распознавания, функции анализа расположения блоков текста на странице и определения его ориентации. Также с помощью ABBYY FineReader Engineразработчикам ИВ РАН удалось реализовать удобный интерфейс верификации результатов распознавания. В процессе обработки текстов приложение строит гипотезы для неуверенно распознанных символов и предлагает их пользователю в виде контекстно-оптимизированных списков. Эта функция оказалась особенно полезна, учитывая сложность японского и китайского языков, отличающихся большим количеством символов, графической вариативностью, отсутствием чётко выраженных межсловных границ. В результате специалисты ИВ РАН добились заметного повышения точности распознавания текстов, при этом процесс оцифровки документов ускорился в несколько раз.

«Точное воспроизведение исходного документа в электронном виде необходимо для его корректного лингвистического анализа. Это особенно важно при оцифровке текстов, написанных идеографическим письмом, в котором отдельные символы обозначают не звуки, а целые слова или их значимые части. В таких случаях любая ошибка в распознавании может существенно исказить исходный смысл текста. С технологией ABBYYмы смогли перевести процесс оцифровки документов на японском и китайском языках на качественно новый уровень», – говорит Александр Костыркин, специалист Отдела языков и народов Азии ИВ РАН.     


Опубликовано 21.12.10 14:45
Просмотров 893
Разместил xbox
Как я за год победил откаты на предприятии. И теперь экономлю 15 млн рублей в год
Как я за год победил откаты на предприятии. И теперь экономлю 15 млн рублей в год
Откровенная история пользователя программ «АЛТИУС».
Мировые таланты на расстоянии клика: как продолжать культурную жизнь, не выходя из дома
Мировые таланты на расстоянии клика: как продолжать культурную жизнь, не выходя из дома
Вынужденная социальная дистанция вовсе не повод ставить жизнь на паузу — благодаря возможностям интернет-ресурсов легко не только работать и оставаться в курсе новостей, но и делать свой досуг по-настоящему интересным и разнообразным.
Мода на книги: как модельные библиотеки стали местом для увлекательного досуга
Мода на книги: как модельные библиотеки стали местом для увлекательного досуга
Более 130 модельных библиотек появились по всей России. Открытый доступ к книжному фонду, пространство для свободного общения, лектории, возможность найти редкие памятники литературы в цифровом виде – все это стало доступным благодаря библиотекам «нового поколения».