Введение
Американский исследователь ИИ и писатель (род. 1979)
Элизер С. Юдковский (,/ɛ//l//i/'/ɛ//z//ər// /,/j//ʌ//d/'/k//aʊ//s//k//i/ EHleeEHzər YUDKOWskee; родился 11 сентября 1979 года) – американский исследователь искусственного интеллекта. Он является основателем и научным сотрудником Института исследований машинного интеллекта (MIRI), частной некоммерческой исследовательской организации, расположенной в Беркли, Калифорния. Его работы, посвященные возможности неконтролируемого взрывного роста интеллекта, оказали влияние на книгу философа Ника Бострома "Суперинтеллект: пути, опасности, стратегии", опубликованную в 2014 году.
Целевое обучение и стимулы в программных системах
Взгляды Юдковского на проблемы безопасности, которые представляют будущие поколения систем ИИ, обсуждаются в учебнике Стюарта Рассела и Питера Норвига "Искусственный интеллект: современный подход". Отмечая сложность формального определения целей общего назначения вручную, Рассел и Норвиг ссылаются на предложение Юдковского о том, что автономные и адаптивные системы должны быть спроектированы таким образом, чтобы обучаться правильному поведению с течением времени: «Юдковский (2008) более подробно описывает, как спроектировать дружественный ИИ. Он утверждает, что дружелюбие (стремление не причинять вреда людям) должно быть заложено с самого начала, но разработчики должны осознавать как возможность ошибок в своих проектах, так и то, что робот будет учиться и развиваться со временем. Таким образом, задача заключается в разработке механизма для эволюции ИИ в рамках системы сдержек и противовесов и в наделении систем полезными функциями, которые останутся дружелюбными даже при таких изменениях. В книге "Искусственный интеллект: современный подход" Рассел и Норвиг высказывают возражение, что существуют известные ограничения интеллектуального решения проблем, обусловленные теорией вычислительной сложности; если существуют строгие ограничения на эффективность, с которой алгоритмы могут решать различные задачи, взрыв интеллекта может оказаться невозможным или даже не позволит "уничтожить несанкционированный центр обработки данных авиаударом". Эта статья способствовала вовлечению широкой общественности в дебаты о согласовании ИИ, в результате чего журналист задал президенту Джо Байдену вопрос о безопасности ИИ на пресс-конференции. С тех пор "Преодоление предубеждений" функционирует как личный блог Хансона. Более 300 записей в блоге Юдковского, посвященных философии и науке (первоначально опубликованных на LessWrong и Overcoming Bias), были выпущены в виде электронной книги "Рациональность: от ИИ до зомби" издательством MIRI в 2015 году. MIRI также опубликовала книгу "Неадекватные равновесия" (Inadequate Equilibria) – электронную книгу Юдковского 2017 года, посвященную социальной неэффективности. Юдковский также является автором нескольких художественных произведений. Его фанфикшн-роман "Гарри Поттер и методы рациональности" использует сюжетные элементы из серии "Гарри Поттер" Дж. К. Роулинг для иллюстрации научных тем. Издание The New Yorker описало "Гарри Поттер и методы рациональности" как пересказ оригинального романа Роулинг "в попытке объяснить волшебство Гарри с помощью научного метода".
quote|text=Yudkowsky (2008) goes into more detail about how to design a Friendly AI. He asserts that friendliness (a desire not to harm humans) should be designed in from the start, but that the designers should recognize both that their own designs may be flawed, and that the robot will learn and evolve over time. Thus the challenge is one of mechanism design—to design a mechanism for evolving AI under a system of checks and balances, and to give the systems utility functions that will remain friendly in the face of such changes. In Artificial Intelligence: A Modern Approach, Russell and Norvig raise the objection that there are known limits to intelligent problem solving from computational complexity theory; if there are strong limits on how efficiently algorithms can solve various tasks, an intelligence explosion may not be possible. or even "destroy[ing] a rogue datacenter by airstrike". The article helped introduce the debate about AI alignment to the mainstream, leading a reporter to ask President Joe Biden a question about AI safety at a press briefing. Overcoming Bias has since functioned as Hanson's personal blog. Over 300 blog posts by Yudkowsky on philosophy and science (originally written on LessWrong and Overcoming Bias) were released as an ebook, Rationality: From AI to Zombies, by MIRI in 2015. MIRI has also published Inadequate Equilibria, Yudkowsky's 2017 ebook on societal inefficiencies. Yudkowsky has also written several works of fiction. His fanfiction novel Harry Potter and the Methods of Rationality uses plot elements from J. K. Rowling's Harry Potter series to illustrate topics in science. The New Yorker described Harry Potter and the Methods of Rationality as a retelling of Rowling's original "in an attempt to explain Harry's wizardry through the scientific method".
Личная жизнь
Юдковский — самообразованный человек и не посещал ни среднюю школу, ни колледж. Он был воспитан в духе современного ортодоксального иудаизма, но не считает себя религиозным евреем.