Введение

Минимальный тест интеллектуального сигнала, или MIST, является вариацией теста Тьюринга, предложенной Крисом Маккинстри, в котором на вопросы допускаются только булевы ответы (да/нет или истина/ложь). Цель такого теста – получить количественную статистическую меру человечности, которую впоследствии можно использовать для оптимизации работы систем искусственного интеллекта, предназначенных для имитации человеческих ответов. Маккинстри собрал около 80 000 утверждений, на которые можно ответить «да» или «нет», например:

Является ли Земля планетой? Был ли Авраам Линкольн когда-либо президентом Соединенных Штатов? Больше ли Солнце моей стопы? Иногда ли люди лгут? Он назвал эти утверждения «мыслепикселями» (Mindpixels). Эти вопросы проверяют как конкретные знания об аспектах культуры, так и базовые факты о значении различных слов и понятий. Таким образом, его можно сравнить с тестом SAT, тестами на интеллект и другими спорными измерениями умственных способностей. Цель Маккинстри заключалась не в том, чтобы различать оттенки интеллекта, а в том, чтобы определить, можно ли вообще считать компьютерную программу интеллектуальной. По мнению Маккинстри, программа, способная значительно превосходить случайный выбор ответов на большом количестве вопросов MIST, будет считаться обладающей определенным уровнем интеллекта и понимания. Например, в тесте из 20 вопросов, если программа будет угадывать ответы случайным образом, можно ожидать, что она в среднем даст 10 правильных ответов. Но вероятность того, что программа случайно угадает все 20 ответов правильно, составляет всего один случай из 220, то есть один случай из 1 048 576; следовательно, если программа сможет поддерживать такой уровень производительности в нескольких независимых испытаниях, без предварительного доступа к утверждениям, её следует считать интеллектуальной.

Обсуждение

Маккинстри раскритиковал существующие подходы к искусственному интеллекту, такие как чат-боты, заявив, что его вопросы могут "вывести из строя" программы ИИ, быстро выявив их слабые места. Он противопоставил свой подход – серию прямых вопросов, оценивающих возможности ИИ, – методу теста Тьюринга и методу премии Лобнера, заключающимся во взаимодействии с ИИ посредством свободной текстовой беседы. Критики MIST отметили, что ИИ в стиле Маккинстри тоже было бы легко "вывести из строя" из-за невозможности обеспечить его правильными ответами на все возможные вопросы типа "да/нет" с помощью конечного набора Mindpixels, созданных человеком. Тот факт, что ИИ может правильно ответить на вопрос "Солнце больше моей ноги?", не означает, что он также сможет правильно ответить на варианты вроде "Солнце больше, чем (моя рука | моя печень | яичный желток | Альфа Центавра А | )". Однако, покойный Маккинстри мог бы возразить, что действительно разумная и обладающая знаниями сущность (сопоставимая с человеком) смогла бы вывести ответы, такие как (да | да | да | не знаю | ), опираясь на свои знания об относительных размерах упомянутых объектов. Иными словами, MIST задумывался как тест для ИИ, а не как предложение по его реализации. Можно также утверждать, что MIST является более объективным тестом интеллекта, чем тест Тьюринга – субъективная оценка, которую некоторые могут считать скорее мерой доверчивости спрашивающего, чем интеллекта машины. Согласно этому аргументу, человеческое суждение в тесте Тьюринга подвержено эффекту ЭЛИЗА – тенденции ошибочно принимать поверхностные признаки интеллекта за реальные, очеловечивая программу. В ответ на это, как предлагалось в эссе Алана Тьюринга "Могут ли машины думать?", можно сказать, что если программа является убедительной имитацией разумного существа, то она, по сути, разумна. Таким образом, спор сводится к тому, что значит для программы обладать "настоящим" интеллектом и по каким признакам его можно определить. Схожие дебаты ведутся вокруг изучения языка у высших приматов, где утверждается, что они освоили некоторые аспекты языка жестов, но значимость этого обучения остаётся спорной.