Введение
Онлайн-игра с использованием человеческих вычислений. Игра ESP (Extrasensory Perception Game) – это игра, основанная на вычислениях, выполняемых людьми, разработанная для решения проблемы создания сложных метаданных. Идея игры заключается в использовании вычислительной мощности людей для выполнения задачи, которая не под силу компьютерам (первоначально – распознавание изображений), представляя эту задачу в игровой форме. Игра была первоначально разработана Луисом фон Аном из Университета Карнеги-Меллон и впервые опубликована в интернете в 2003 году. В 2006 году Google приобрела лицензию на создание собственной версии игры (Google Image Labeler) для улучшения результатов поиска изображений в интернете. Правовой статус данных, собранных игрой ESP, разработанной фон Аном, или её версией от Google, остаётся неясным. Версия Google была закрыта 16 сентября 2011 года в рамках закрытия Google Labs в сентябре 2011 года.
The ESP game (extrasensory perception game) is a human based computation game developed to address the problem of creating difficult metadata. The idea behind the game is to use the computational power of humans to perform a task that computers cannot (originally, image recognition) by packaging the task as a game. It was originally conceived by Luis von Ahn of Carnegie Mellon University and first posted online in 2003. Google bought a license to create its own version of the game (Google Image Labeler) in 2006 in order to return better search results for its online images. The license of the data acquired by Ahn's ESP game, or the Google version, is not clear. Google's version was shut down on September 16, 2011, as part of the Google Labs closure in September 2011.
Концепция
Распознавание изображений исторически было задачей, которую компьютерам было сложно выполнять самостоятельно. Люди вполне способны на это, но не всегда готовы к этому. Превратив задачу распознавания в "игру", можно повысить мотивацию людей к участию. Данные, собранные от пользователей, показали крайне положительную оценку игрового процесса. Возможности и применение такого большого количества размеченных изображений значительны; например, более точный поиск изображений и обеспечение доступности для людей с нарушениями зрения путем озвучивания описаний изображений. Совместная разметка изображений двумя людьми повышает точность вводимых слов. Поскольку единственное, что объединяет партнеров – это одинаковое изображение, им необходимо вводить разумные описания, чтобы иметь шанс прийти к согласию. Реализация игры ESP в текущем виде стимулирует игроков выбирать "очевидные" описания, которые с наибольшей вероятностью приведут к соглашению с партнером. Однако эти описания часто можно вывести из уже существующих, используя подходящую языковую модель, и, следовательно, они добавляют в систему немного новой информации. В рамках исследовательского проекта Microsoft присваиваются вероятности следующим добавляемым описаниям. Эта модель затем используется в программе, которая играет в ESP, не просматривая изображение. Авторы игры ESP предоставили доказательства того, что описания, полученные с помощью игры, действительно являются полезными характеристиками изображений. Результаты поиска по случайным ключевым словам показали, что доля релевантных изображений при поиске с использованием описаний, сгенерированных игрой, чрезвычайно высока. Дополнительная оценка была проведена путем сравнения описаний, сгенерированных игрой, с описаниями, созданными участниками, которым было предложено описать изображения.
Правила игры
После входа в систему пользователь автоматически подбирается к случайному партнеру. Партнеры не знают личностей друг друга и не могут общаться. После подбора им обоим показывается одно и то же изображение. Их задача — договориться о слове, которое будет подходящим названием для изображения. Они оба вводят возможные слова, и как только слово введено обоими партнерами (не обязательно одновременно), это слово считается согласованным и становится названием изображения. Как только они согласуют слово, им показывается другое изображение. На то, чтобы назвать 15 изображений, им отводится две с половиной минуты. У обоих партнеров есть возможность пропустить изображение, то есть отказаться от его названия. Если один из партнеров пропускает, другому партнеру отображается сообщение о том, что его партнер хочет пропустить. Для показа нового изображения необходимо, чтобы оба партнера пропустили изображение. Некоторые изображения имеют "запрещенные" слова, то есть слова, которые нельзя использовать в качестве возможных названий. Эти слова обычно связаны с изображением и усложняют игру, поскольку не позволяют использовать распространенные слова для его названия. Запрещенные слова генерируются самой игрой. В первый раз, когда изображение используется в игре, у него нет запрещенных слов. Если изображение используется повторно, у него появляется одно запрещенное слово: слово, которое стало результатом предыдущего соглашения. В следующий раз, когда изображение используется, у него будет два запрещенных слова, и так далее. Добавление "запрещенных" слов происходит автоматически: как только изображение было названо достаточное количество раз одним и тем же словом, это слово становится запрещенным, чтобы изображение получило разнообразные названия. Иногда в игру можно играть в одиночку, без партнера, при этом сама игра ESP выступает в роли оппонента, предлагая серию заранее определенных названий единственному игроку (которые были собраны из названий, данных изображению в ходе предыдущих игр, сыгранных реальными людьми). Это необходимо, если количество игроков нечетное. В конце 2008 года игра была переименована в GWAP ("игра с целью") с новым пользовательским интерфейсом. Некоторые другие игры, также созданные Луисом фон Аном, такие как "Peekaboom" и "Phetch", были прекращены в тот момент. Эта игра была использована в качестве важного примера социальной машины с целью (телеологической социальной машины), демонстрируя пример интеллектуальной системы, возникающей из взаимодействия человеческих участников в книге "Ярлык" Нелло Кристианини, где обсуждается интеллект социальных медиа-платформ.
Обман
Ан описал меры противодействия, предотвращающие "читерство" в игре и ввод в систему ложных данных. Предоставляя игрокам периодически тестовые изображения с известными общепринятыми метками, можно проверить, отвечают ли игроки честно, и догадки игрока сохраняются только в случае успешной разметки тестовых изображений. Более того, метка сохраняется только после того, как с ней согласуется определенное количество игроков (N). В этот момент все "стоп-листы" для изображений удаляются, и изображение возвращается в игровой пул, как новое. Если X – вероятность неверной метки, несмотря на успешную разметку тестовых изображений игроком, то после N повторений вероятность искажения составит , при условии, что конечные повторения независимы друг от друга. Случайные изображения были отобраны с помощью "Random Bounce Me" – веб-сайта, случайным образом выбирающего страницу из базы данных Google. "Random Bounce Me" запрашивался многократно, при каждом запросе собирались все JPEG и GIF изображения со случайной страницы, за исключением тех, которые не соответствовали критериям: пустые изображения, изображения, состоящие из одного цвета, изображения с размером менее 20 пикселей по любой из сторон, и изображения с соотношением сторон больше 4,5 или меньше 1/4,5. Этот процесс повторялся до сбора 350 000 изображений. Затем изображения были масштабированы для соответствия дисплею игры. Для каждой игровой сессии из 350 000 выбиралось 15 различных изображений.