Введение

Средство извлечения информации из визуальной сцены. Визуальная рутина – это средство извлечения информации из визуальной сцены. Шимон Уллман, в своих исследованиях когнитивных процессов зрения человека, предположил, что задача зрительной системы человека по восприятию свойств формы и пространственных отношений разделена на два последовательных этапа: ранний этап "снизу вверх", в течение которого генерируются базовые представления на основе визуального ввода, и последующий этап "сверху вниз", в течение которого примитивы высокого уровня, названные "визуальными рутинами", извлекают необходимую информацию из базовых представлений. У людей базовые представления, формирующиеся на этапе "снизу вверх", соответствуют ретинотопным картам (в коре существует более 15 таких карт) для свойств, таких как цвет, ориентация границ, скорость и направление движения. Эти базовые представления основаны на фиксированных операциях, выполняемых равномерно по всему полю зрения и не использующих специфические знания об объектах, знания, специфичные для задачи, или другую информацию более высокого уровня. Визуальные рутины, предложенные Уллманом, являются примитивами высокого уровня, которые анализируют структуру сцены, извлекая пространственную информацию из базовых представлений. Эти визуальные рутины состоят из последовательности элементарных визуальных операторов, специфичных для решаемой задачи. Визуальные рутины отличаются от фиксированных операций базовых представлений тем, что они не применяются равномерно ко всему полю зрения, а лишь к объектам или областям, определяемым рутиной. Исследователи также применяли подход визуальных рутин к искусственным представлениям карт для игр в 2D видеоигры в реальном времени. Однако в этих случаях карта видеоигры предоставлялась напрямую, что упрощало необходимость решения задач восприятия реального мира, таких как распознавание объектов и компенсация перекрытий.