Кіріспе
Минималды интеллектуалды сигнал сынағы немесе MIST – Крис МакКинстри ұсынған Тьюринг сынағының бір түрі, онда сұрақтарға тек қана логикалық (иә/жоқ немесе дұрыс/жалған) жауап беруге рұқсат етіледі. Мұндай сынақтың мақсаты – адамдық қасиеттерді сандық-статистикалық тұрғыдан өлшеу, осы өлшемдерді кейіннен адамның жауап беруін имитациялауға арналған жасанды интеллект жүйелерінің тиімділігін арттыру үшін пайдалануға болады. МакКинстри шамамен 80 000 «иә» немесе «жоқ» деп жауап берілетін мәлімдемелерді жинады, мысалы: Жер планета ма? Ыбырайым Линкольн АҚШ президенті болған кездер болды ма? Күн менің аяғымнан үлкен бе? Адамдар кейде жалған айта ма? Ол осы мәлімдемелерді «Ақыл пиксельдері» деп атады. Бұл сұрақтар мәдениеттің нақты аспектілері туралы білімді, сондай-ақ әртүрлі сөздер мен түсініктердің мағынасы туралы негізгі фактілерді тексереді. Сондықтан оны SAT, интеллект сынақтары және басқа да саналы қабілетті өлшеудің күмәнді әдістерімен салыстыруға болады. МакКинстринің мақсаты – интеллекттің деңгейлерін ажырату емес, компьютерлік бағдарламаны интеллектуалды деп санауға болатынын анықтау болды. МакКинстридің сөзіне сүйенсек, көптеген MIST сұрақтарына кездейсоқ жауап беруден гөрі жақсы нәтижелерді көрсеткен бағдарлама, интеллектуалдық және түсінік деңгейіне ие деп есептеледі. Мысалы, 20 сұрақтан тұратын тестте бағдарлама жауаптарды кездейсоқ таңдаса, орташа есеппен 10 дұрыс жауап беруі күтіледі. Алайда, бағдарламаның 20 сұраққа 20 дұрыс жауап беру ықтималдығы 220-дан 1-ге тең, яғни 1 048 576-дан 1; демек, егер бағдарлама бұл деңгейдегі өнімділікті бірнеше тәуелсіз сынақтарда, бұрыннан мәлімдемелермен таныспай, сақтай алса, оны интеллектуалды деп санау керек.
Is Earth a planet? Was Abraham Lincoln once President of the United States? Is the sun bigger than my foot? Do people sometimes lie? He called these propositions Mindpixels. These questions test both specific knowledge of aspects of culture, and basic facts about the meaning of various words and concepts. It could therefore be compared with the SAT, intelligence testing and other controversial measures of mental ability. McKinstry's aim was not to distinguish between shades of intelligence but to identify whether a computer program could be considered intelligent at all. According to McKinstry, a program able to do much better than chance on a large number of MIST questions would be judged to have some level of intelligence and understanding. For example, on a 20 question test, if a program were guessing the answers at random, it could be expected to score 10 correct on average. But the probability of a program scoring 20 out of 20 correct by guesswork is only one in 220, i. e. one in 1,048,576; so if a program were able to sustain this level of performance over several independent trials, with no prior access to the propositions, it should be considered intelligent.
Талқылау
МакКинстри чатботтар сияқты жасанды интеллектке қатысты қолданыстағы тәсілдерді сынап, оның сұрақтары олардың әлсіз тұстарын жылдам анықтау арқылы АИ бағдарламаларын «жоюға» мүмкін дейді. Ол өзінің әдісін – АИ мүмкіндіктерін бағалайтын тікелей сұрақтар сериясын, Тьюринг тестімен және АИ-ды бағытталмаған мәтіндік әңгімеге тартудың Лобнер жүлдесімен салыстырды. MIST сыншылары МакКинстри стиліндегі АИ-ды «жою» оңай болатынын атап өтті, себебі адам жасаған Mindpixels-тің шектеулі жиынтығы арқылы барлық мүмкін «иә/жоқ» сұрақтарына дұрыс жауап беру мүмкін емес: АИ «Күн менің аяғымнан үлкен бе?» деген сұраққа дұрыс жауап бере алады, бірақ бұл «Күн менің қолымнан үлкен бе?» немесе «Күн менің бауырымнан үлкен бе? | жұмыртқа сарысынан үлкен бе? | Альфа Центавр А-дан үлкен бе?» сияқты сұрақтарға да дұрыс жауап бере алатындығын білдірмейді. Алайда, марқұм МакКинстри, шынымен ақылды, білімді тұлға (адаммен тең деңгейде) аталған нысандардың салыстырмалы өлшемдері туралы білімін қолданып, (иә | иә | иә | білмеймін | ) сияқты жауаптарды таба алатынын айтқан болар. Басқаша айтқанда, MIST АИ-ны жүзеге асыру туралы ұсыныс емес, АИ-ны сынау мақсатында жасалған. Сондай-ақ, MIST Тьюринг тестінен гөрі интеллекттің объективті тестісі болып табылуы мүмкін, ол кейбіреулердің пікірінше, машинаның интеллектуалдығына қарағанда сұрақ қоюшының сенімсіздігін өлшейтін субъективті бағалау. Осы аргумент бойынша, адамның Тьюринг тестіне қатысты пікірі ЭЛИЗА эффектісіне ұшырауы мүмкін, яғни программаны антропоморфтандыру арқылы ақыл-ойдың сыртқы белгілерін нағыз нәрсемен шатастыруға бейімділік. Алан Тьюрингтің «Машиналар ойлай ала ма?» деген мақаласында келтірілген жауап – егер бағдарлама ақылды жанда сенімді имитация жасайтын болса, онда ол шын мәнінде ақылды. Демек, дау бағдарламаның «нағыз» интеллекке ие болу мағынасы мен оны қандай белгілер арқылы анықтауға болатындығы туралы. Ұсаң маймылдардың тіліне қатысты да ұқсас пікірталас бар, онда адам емес приматтар белгілі бір тілдердің кейбір аспектілерін үйренгендігі айтылады, бірақ осы оқудың маңыздылығы күмәнді.