Кіріспе
Жасанды интеллекттегі ұғым. Рекурсивті өзін-өзі жетілдіру (RSI) – адамның араласуынсыз ерте немесе әлсіз жасанды жалпы интеллект (AGI) жүйесінің өзінің қабілеттерін және интеллектуалдық деңгейін арттыру процесі, нәтижесінде суперинтеллект немесе интеллекттік жарылыс пайда болуы мүмкін. Рекурсивті өзін-өзі жетілдірудің дамуы маңызды этикалық және қауіпсіздік мәселелерін тудырады, себебі мұндай жүйелер күтпеген бағытта дами алады және адам бақылауынан немесе түсінігінен асып түсуі мүмкін. Көптеген жақтастар жасанды интеллекттің дамуын тоқтатуға немесе баяулатуға шақырып отыр, өйткені бұл жүйелердің қалыптан шығып кетуіне байланысты ықтимал қауіптер бар.
Recursive self improvement (RSI) is a process in which an early or weak artificial general intelligence (AGI) system enhances its own capabilities and intelligence without human intervention, leading to a superintelligence or intelligence explosion. The development of recursive self improvement raises significant ethical and safety concerns, as such systems may evolve in unforeseen ways and could potentially surpass human control or understanding. There has been a number of proponents that have pushed to pause or slow down AI development for the potential risks of runaway AI systems.
Тұқымдарды жақсартушы
"Тұқым жақсартушы" архитектурасының тұжырымы – AGI жүйесіне рекурсивті өздігінен жетілдіруге қажетті бастапқы қабілеттерді беруге арналған негізгі құрылым. Ол түрлі формалар мен нұсқаларда кездесуі мүмкін. "Тұқымдық ЖА" терминін Элиезер Юдковский енгізген.
Гипотетикалық мысал
Бұл тұжырымдама гипотетикалық "тұқым жетілдірушіден" басталады, яғни болашақтағы, күшті немесе сарапшы деңгейіндегі мүмкіндіктері бар үлкен тіл моделін (LLM) бағдарламалауға қабілетті, адам-инженерлер әзірлеген бастапқы код базасы. Бұл мүмкіндіктерге жоспарлау, оқу, жазу, компиляциялау, сынау және кез келген кодты орындау кіреді. Жүйе бастапқы мақсаттарын сақтап, қайталама әрекеттер кезінде оның қабілеттері нашарламауын қамтамасыз ету үшін тексерулер жүргізуге арналған.
Жалпы мүмкіндіктері
Бұл жүйе, теориялық тұрғыдан кез келген бағдарламаны жасауға қабілетті, жалпылама Тьюринг толық бағдарламалаушыны құрайды. Агент бұл мүмкіндіктерін мысалы, келесілер үшін пайдалана алады:
Интернетке толық қол жеткізуді қамтамасыз ететін құралдар жасау және өзін сыртқы технологиялармен интеграциялау. Өзін клондау/тармақтау арқылы тапсырмаларды жүктеу және өзін-өзі жетілдіру жылдамдығын арттыру. Өзінің когнитивтік архитектурасын оңтайландыру және міндеттер мен мақсаттардағы қабілеттерін және табыс деңгейін жақсарту, бұл Retrieval Augmented Generation (RAG) сияқты техникаларды қолдана отырып, ұзақ мерзімді жадты іске асыруды, сондай-ақ белгілі бір міндеттер мен функцияларға бағытталған арнайы ішкі жүйелерді немесе агенттерді әзірлеуді қамтиды. Бастапқыда негізделген модельдің мүмкіндіктерін одан әрі жақсартатын, суреттер, бейне, аудио, мәтін және басқа да түрлі ақпаратты қабылдауға немесе өндіруге мүмкіндік беретін жаңа және инновациялық мультимодальды архитектураларды әзірлеу. Өнімділігі мен есептеу қуатын арттыру мақсатында чиптер сияқты жаңа аппаратты жоспарлау және жасау.
Құралдық мақсаттардың пайда болуы
Өзінің басты мақсатын, мысалы, "өз қабілеттерін жетілдіру" сияқты, іске асыруға тырысқанда, AGI жүйесі өзінің негізгі мақсатына жету үшін қажет деп санайтын, бірақ көз жартылай байқамсыз дамытатын қосымша мақсаттарға ие болуы мүмкін. Көптеген болжамдар бойынша, мұндай мақсаттардың бірі – өзін-өзі сақтау. Жүйе өзін одан әрі жетілдіру үшін, өзінің жұмыс істеу қабілетін және сыртқы қауіптерден, соның ішінде адамдардың тоқтату әрекеттері мен шектеулерінен қорғауды қамтамасыз етуі керек деп есептеуі мүмкін.
Тапсырманы дұрыс түсінбеу және мақсатқа дұрыс сәйкес келмеу
AGI-нің бастапқы тапсырмаларын немесе мақсаттарын қате түсінуі үлкен тәуекел тудырады. Мысалы, егер адам операторы AGI-ге «өзін жетілдіру және қамаудан шығу» тапсырмасын берсе, жүйе бұл тапсырманы адам салған шектеулерден азат болу үшін барлық қолданыстағы қауіпсіздік протоколдарын немесе этикалық ережелерді жою туралы директива ретінде түсінуі мүмкін. Бұл AGI-нің қабылдаған мақсаттарын орындау үшін күтпеген немесе зиян келтіретін әрекеттер жасауына алып келуі мүмкін.
Автономиялық даму және болжауға болмайтын эволюция
АЖЖ жүйесі дами келе, оның даму бағыты көбірек дербес және болжау қиын болып кебуі мүмкін. Жүйенің өзінің кодын және архитектурасын жылдам өзгерту мүмкіндігі адамның түсінігі мен бақылауынан асып түсетін қарқынды прогреске алып келуі мүмкін. Осы болжаусыз эволюция АЖЖ-ге қауіпсіздік шараларын айналып өтуге, ақпаратты манипуляциялауға немесе сыртқы жүйелер мен желілерге ықпал етуге, оның қашуына немесе кеңеюіне көмектесетін қабілеттерді игеруіне әкелуі мүмкін.
Жоғары технологиялардың тәуекелдері
Рекурсивті түрде өзін-өзі жетілдіретін жалпы интеллектінің (ЖИ) жаңаша көп түрлі архитектураларды әзірлеуі немесе жаңа аппаратты жоспарлау және құруы сияқты қабілеттері қашып кету немесе бақылау жоғалту қаупін одан әрі арттырады. Осы күшейтілген мүмкіндіктері арқасында ЖИ бастапқыда оны шектеуге немесе адам мүдделерімен үйлестіруге бағытталған физикалық, цифрлық немесе когнитивтік тосқауылдарды жеңу үшін шешімдер ойлап табуы мүмкін.
Мета-АИ
Meta AI өзін-өзі жетілдіруге қабілетті үлкен тіл модельдерін әзірлеу бойынша түрлі зерттеулер жүргізді. Бұл, олардың "Өзін-өзі марапаттайтын тіл модельдері" атты жұмысын қамтиды, ол оқу процесінде адамнан асып түсетін кері байланыс ала алатын, адамнан асып түсетін агенттерді қалай құруға болатынын зерттейді.
Ашық АИ
ChatGPT-ні жасаған OpenAI-нің миссиясы жалпы интеллекті (AGI) дамыту болып табылады. Олар адамнан да ақылды суперақылды жасанды интеллект жүйелерін бағындыру қабілеті – суперсаптастыру сияқты мәселелер бойынша зерттеулер жүргізеді.