Интеллектуальное распознавание рукописного текста: ICR и IWR технологии.
Intelligent character recognition
Распознавание рукописного текста (ICR): извлечение данных из отсканированных документов и форм. Автоматизация, аналитика, интеграция с бизнес-процессами.
Сравнивайте с английским: нажмите на абзац — оригинал откроется в окне. Кнопка EN под абзацем показывает его прямо в тексте.
Содержание
Введение
Интеллектуальное распознавание рукописного текста (ICR) используется для извлечения рукописного текста из изображений. Это более продвинутый тип технологии оптического распознавания символов (OCR), который распознает различные стили и шрифты рукописного текста для интеллектуальной интерпретации данных на формах и бумажных документах. Бумажные документы сканируются, информация извлекается, а затем данные цифровым способом сохраняются в базе данных с использованием технологии ICR. Эти данные используются для аналитической отчетности и интегрируются в бизнес-процессы. Предприятия используют технологию ICR для организации неструктурированных данных и получения актуальной информации из этих документов. Пользователи могут быстро считывать рукописные данные на бумаге с помощью ICR и преобразовывать их в цифровой формат. Алгоритмы ICR работают совместно с OCR для автоматизации ввода данных из форм, исключая необходимость ручного ввода. Технология обеспечивает высокую точность и является надежным способом быстрой обработки различных документов.
Intelligent character recognition (ICR) is used to extract handwritten text from images. It is a more sophisticated type of OCR technology that recognizes different handwriting styles and fonts to intelligently interpret data on forms and physical documents. These paper based papers are scanned, the information is extracted, and the data is then digitally stored in a database program using ICR technology. The data is utilized for analytical reporting and is integrated with business processes. ICR technology is used by businesses to organize unstructured data and obtain current information from these reports. Users can rapidly read handwritten data on paper using ICR, then convert it to a digital format. ICR algorithms collaborate with OCR to automate data entry from forms by removing the need for keystrokes. It has a high degree of accuracy and is a dependable method for processing various papers quickly.
ICR
Интеллектуальное распознавание символов (ICR) использует постоянно совершенствующиеся алгоритмы для сбора большего объема информации о вариациях в рукописных символах и их более точной идентификации. ICR, разработанный в начале 1990-х годов для автоматизации обработки форм, позволяет преобразовывать данные, введенные вручную, в текст, который легко читать, искать и редактировать. Наилучшие результаты достигаются при использовании ICR для чтения символов, четко разделенных на отдельные области или зоны, например, фиксированные поля на многих структурированных формах. Как OCR, так и ICR могут быть настроены для распознавания различных языков, однако ограничение ожидаемого набора символов меньшим числом языков повысит точность распознавания. ICR не способен распознавать связный рукописный текст, поскольку требует оценки каждого символа по отдельности. В связном тексте бывает сложно определить границы между символами, и различия между образцами более значительны, чем при обычном написании. Более новый метод, называемый интеллектуальным распознаванием слов (IWR), ориентирован на чтение слова в контексте, а не на распознавание отдельных символов.
Intelligent character recognition (ICR) makes use of continuously improving algorithms to collect more information about the variances in hand printed characters and more precisely identify them. ICR, which was created in the early 1990s to aid in the automation of forms processing, enables the conversion of manually entered data into text that is simple to read, search for, and change. When used to read characters that are obviously divided into distinct areas or zones, such as fixed fields seen on many structured forms, it works best. Both OCR and ICR can be configured to read a variety of languages; however, limiting the expected character set to a smaller number of languages will produce better recognition outcomes. ICR cannot read cursive handwriting since it must still be able to assess each character individually. While writing in cursive, it might be difficult to tell where one character ends and another one begins, and there are more differences across samples than when hand printing text. A more recent method called intelligent word recognition (IWR) focuses on reading a word in context rather than recognizing individual characters.
Интеллектуальное распознавание слов
Интеллектуальное распознавание слов (IWR) способно распознавать и извлекать не только печатный рукописный текст, но и курсивный почерк. ICR распознает информацию на уровне отдельных символов, в то время как IWR работает с целыми словами или фразами. Благодаря возможности захвата неструктурированной информации из повседневных документов, IWR считается более продвинутой технологией, чем ICR для распознавания рукописного текста. IWR не предназначен для замены традиционных систем ICR и OCR, а оптимизирован для обработки реальных документов, содержащих преимущественно данные в свободной форме, которые сложно распознать и которые изначально не подходят для обработки с помощью ICR. Это означает, что наиболее эффективное применение IWR – сократить объем ручного ввода рукописных данных и автоматизировать обработку полей рукописного текста на документах, которые в противном случае пришлось бы вводить вручную.
Intelligent word recognition (IWR) can recognize and extract not only printed handwritten information, cursive handwriting as well. ICR recognizes on the character level, whereas IWR works with full words or phrases. Capable of capturing unstructured information from every day pages, IWR is said to be more evolved than hand print ICR. Not meant to replace conventional ICR and OCR systems, IWR is optimized for processing real world documents that contain mostly free form, hard to recognize data fields that are inherently unsuitable for ICR. This means that the highest and best use of IWR is to eliminate a high percentage of the manual entry of handwritten data and run on hand print fields on documents that otherwise could be keyed only by humans.