Визуалдық қабылдау: көру қабілетінің негізгі кезеңдері – бастапқы өңдеу және визуалдық әдістер арқылы ақпаратты алу. Көзбен көру, ми қабылдауы, визуалдық жүйе.
Ағылшыншамен салыстырыңыз: абзацты басыңыз — түпнұсқа терезеде ашылады. Абзац астындағы EN түймесі оны мәтін ішінде көрсетеді.
Кіріспе
Визуалды сахнадан ақпаратты алу құралдары. Көрнекілік – визуалды сахнадан ақпаратты алу тәсілі. Шимон Ульман адамның визуалды танымын зерттеу барысында, адамның визуалды жүйесінің пішін қасиеттері мен кеңістіктік қатынастарды қабылдау міндеті екі кезеңге бөлінеді деп ұсынды: бастапқы "төменнен жоғары" сатысы, онда визуалды кірістен негізгі бейнелер жасалады, және кейінгі "жоғарыдан төмен" сатысы, онда жоғары деңгейдегі элементарлық құрылымдар, "көрнекілік әрекеттері" деп аталатындар, негізгі бейнелерден қажетті ақпаратты шығарады. Адамдарда, төменнен жоғары сатысында жасалған негізгі бейнелер ретинотоптық карталарға сәйкес келеді (қоршақта олардың 15-тен астамы бар), олар түс, жиектің бағыты, қозғалыс жылдамдығы және қозғалыс бағыты сияқты қасиеттер үшін қолданылады. Бұл негізгі бейнелер визуалды кіріс өрісінің барлық бөлігінде біркелкі орындалатын тұрақты операцияларға негізделген, және объектіге қатысты білімді, міндетке қатысты білімді немесе басқа жоғары деңгейдегі ақпаратты пайдаланбайды. Ульман ұсынған көрнекілік әрекеттері – бұл сахнаның құрылымын талдайтын және негізгі бейнелерден кеңістіктік ақпаратты шығаратын жоғары деңгейдегі элементарлық құрылымдар. Бұл көрнекілік әрекеттері қолданылып жатқан міндетке тән элементарлық визуалды операторлар тізбегінен тұрады. Көрнекілік әрекеттері негізгі бейнелердің тұрақты операцияларынан өзгеше, себебі олар визуалды өрістің барлық бөлігіне біркелкі қолданылмайды, олар тек әрекеттермен белгіленген объектілерге немесе аймақтарға қолданылады. Зерттеушілер сондай-ақ, нақты уақытты 2D бейне ойындарын ойнау үшін жасанды карта бейнелеулеріне көрнекілік әрекеттері тәсілін қолданды. Алайда, осы жағдайларда бейне ойын картасы тікелей ұсынылды, бұл нақты әлемдегі қабылдау міндеттерін, мысалы, объектіні тану және жабылуды толықтыру сияқты міндеттерді шешу қажеттілігін жеңілдетті.
Means of extracting information from a visual scene. A visual routine is a means of extracting information from a visual scene. Shimon Ullman, in his studies on human visual cognition, proposed that the human visual system's task of perceiving shape properties and spatial relations is split into two successive stages: an early "bottom up" state during which base representations are generated from the visual input, and a later "top down" stage during which high level primitives dubbed "visual routines" extract the desired information from the base representations. In humans, the base representations generated during the bottom up stage correspond to retinotopic maps (more than 15 of which exist in the cortex) for properties like color, edge orientation, speed of motion, and direction of motion. These base representations rely on fixed operations performed uniformly over the entire field of visual input, and do not make use of object specific knowledge, task specific knowledge, or other higher level information. The visual routines proposed by Ullman are high level primitives which parse the structure of a scene, extracting spatial information from the base representations. These visual routines are composed of a sequence of elementary visual operators specific to the task at hand. Visual routines differ from the fixed operations of the base representations in that they are not applied uniformly over the entire visual field rather, they are only applied to objects or areas specified by the routines. Researchers have also applied the visual routines approach to artificial map representations, for playing real time 2D video games. In those cases, however, the map of the video game was provided directly, alleviating the need to deal with real world perceptual tasks like object recognition and occlusion compensation.