Кіріспе
Американдық AI зерттеушісі және жазушы (1979 жылы туған)
Элизер С. Юдковский (/ɛ//l//i/'/ɛ//z//ər// /, /j//ʌ//d/'/k//aʊ//s//k//i/ EHleeEHzər YUDKOWskee; 1979 жылдың 11 қыркүйегінде туған) – американдық жасанды интеллект зерттеушісі. Ол Калифорния штатының Беркли қаласында орналасқан Machine Intelligence Research Institute (MIRI) жеке ғылыми-зерттеу ұйымының негізін қалаушы және ғылыми қызметкері. Оның ақыл-ойдың бақылаудан шығу қаупі туралы жұмысы философ Ник Бостромның 2014 жылғы «Суперақыл: жолдар, қауіптер, стратегиялар» кітабына ықпал етті.
Бағдарламалық жүйелерде оқыту мақсаттары мен ынталандырулар
Юдковскийдің болашақ жасанды интеллект жүйелерінің қауіпсіздік сындықтарына қатысты пікірлері Стюарт Рассел мен Питер Норвигтің «Жасанды интеллект: Заманауи тәсіл» атты бакалавриат оқулығында талқыланады. Рассел мен Норвиг жалпы мақсаттарды қолмен анықтаудың қиындығын атап, Юдковскийдің автономды және бейімделмелі жүйелерді уақыт өте келе дұрыс мінез-құлықты үйренуге бағытталған етіп жобалау туралы ұсынысын келтіреді: Юдковский (2008) «Достас жасанды интеллектті қалай жобалауға болады» деген мәселенің толыққанды жазылуын ұсынады. Ол достыққа (адамдарға зиян келтірмеу ниеті) бастапқыда басымдық берілуі керек екенін, бірақ дизайнерлер өз жобаларының кемшіліктері болуы мүмкін екенін, сондай-ақ робот уақыт өте келе үйреніп, дамитынын мойындауы керек екенін айтады. Осылайша, бұл механизмді жобалау мәселесіне айналады – тепе-теңдік және бақылау жүйесінде жасанды интеллектті дамыту механизмін жобалау және жүйелерге осындай өзгерістерге қарамастан, достық болып қалатын пайдалы функцияларды беру. «Жасанды интеллект: Заманауи тәсіл» кітабында Рассел мен Норвиг есептеу күрделілігі теориясынан интеллектуалды мәселелерді шешудің белгілі шектері бар екендігіне қарсылық білдіреді; егер алгоритмдердің әртүрлі міндеттерді тиімді шешу қабілетіне қатаң шектеулер болса, интеллект жарлымы мүмкін емес, тіпті «әуе шабуылы арқылы бұзылған деректер орталығын жою» да мүмкін емес. Бұл мақала АИ-ға сәйкестік туралы пікір-таласты кең жұртшылыққа таныстыруға көмектесті, нәтижесінде журналист президент Джо Байденнен баспасөз брифингінде АИ қауіпсіздігі туралы сұрақ қойды. «Партиялық бейімділікті жеңу» блогы Хансонның жеке блогы ретінде жұмыс істейді. Юдковскийдің философия мен ғылымға арналған 300-ден астам блог жазбалары (алғашқыда LessWrong және Overcoming Bias сайттарында жарияланған) 2015 жылы MIRI-де «Рационалдылық: ИА-дан зомбилерге дейін» атты электрондық кітап ретінде жарық көрді. MIRI сонымен қатар Юдковскийдің 2017 жылғы «Inadequate Equilibria» электрондық кітабын, қоғамдық тиімсіздіктер туралы жариялады. Юдковский бірнеше көркем шығармалардың авторы. Оның фанфик романы «Гарри Поттер және рационалдық әдістер» ғылымдағы тақырыптарды көрсету үшін Дж.К. Роулингтің «Гарри Поттер» сериясынан сюжеттік элементтерді пайдаланады. «The New Yorker» басылымы «Гарри Поттер және рационалдық әдістер» романын Роулингтің түпнұсқасын «Гарридің сиқырлығын ғылыми әдіс арқылы түсіндіруге тырысатын» қайта баяндау ретінде сипаттады.
quote|text=Yudkowsky (2008) goes into more detail about how to design a Friendly AI. He asserts that friendliness (a desire not to harm humans) should be designed in from the start, but that the designers should recognize both that their own designs may be flawed, and that the robot will learn and evolve over time. Thus the challenge is one of mechanism design—to design a mechanism for evolving AI under a system of checks and balances, and to give the systems utility functions that will remain friendly in the face of such changes. In Artificial Intelligence: A Modern Approach, Russell and Norvig raise the objection that there are known limits to intelligent problem solving from computational complexity theory; if there are strong limits on how efficiently algorithms can solve various tasks, an intelligence explosion may not be possible. or even "destroy[ing] a rogue datacenter by airstrike". The article helped introduce the debate about AI alignment to the mainstream, leading a reporter to ask President Joe Biden a question about AI safety at a press briefing. Overcoming Bias has since functioned as Hanson's personal blog. Over 300 blog posts by Yudkowsky on philosophy and science (originally written on LessWrong and Overcoming Bias) were released as an ebook, Rationality: From AI to Zombies, by MIRI in 2015. MIRI has also published Inadequate Equilibria, Yudkowsky's 2017 ebook on societal inefficiencies. Yudkowsky has also written several works of fiction. His fanfiction novel Harry Potter and the Methods of Rationality uses plot elements from J. K. Rowling's Harry Potter series to illustrate topics in science. The New Yorker described Harry Potter and the Methods of Rationality as a retelling of Rowling's original "in an attempt to explain Harry's wizardry through the scientific method".
Жеке өмір
Юдковский - өзіндік білім алған адам, ол орта мектепке де, колледжге де бармаған. Ол қазіргі заманғы ортодоксал яһудилердің отбасында тәрбиеленген, бірақ діни тұрғыдан яһуди екенін мойындамайды.