Экзистенциальный риск, связанный с искусственным интеллектом

Экзистенциальный риск, связанный с искусственным интеллектом — гипотеза о том, что существенный прогресс в области общего искусственного интеллекта (ОИИ, англ. artificial general intelligence, AGI) может привести к гибели человечества или другой необратимой глобальной катастрофе[1][2][3].

Описание

Одним из аргументов в пользу этой гипотезы является то, что человеческий вид доминирует благодаря специфическим способностям мозга, которых нет у других животных. Если искусственный интеллект превзойдёт человечество по общему интеллекту и станет «суперинтеллектом», он может стать трудноконтролируемым или вовсе неконтролируемым для людей. Как судьба гориллы горной зависит от воли человека, так и судьба человечества может зависеть от действий будущего искусственного суперинтеллекта[4].

Вероятность такого сценария широко обсуждается и зависит от различных сценариев развития вычислительных технологий[5]. Известные специалисты по информатике и руководители крупных технологических компаний, такие как Джеффри Хинтон[6], Алан Тьюринг, Илон Маск[7] и Сэм Олтман (генеральный директор OpenAI), высказывали опасения по поводу возможных последствий возникновения суперинтеллекта[8]. Согласно опросу исследователей в области ИИ за 2022 год (ответило 17 % респондентов), более половины опрошенных оценивают вероятность катастрофы из-за потери контроля над ИИ в 10 % и выше[9][10].

Среди двух главных источников опасений выделяют проблемы контроля и согласования целей: предположительно, контролировать сверхразумную машину или задать ей человечески-совместимые ценности может быть сложнее, чем принято считать. Многие исследователи полагают, что суперинтеллект будет сопротивляться попыткам отключения или изменения своих целей, и крайне сложно будет обеспечить согласованность его целей с человеческими ценностями и накладывать ограничения[1][11][12]. С другой стороны, скептики вроде теоретика информатики Янн Лекун считают, что сверхразумные машины не будут обладать инстинктом самосохранения[13].

Третья линия опасений — резкая и неожиданная «технологическая сингулярность», к которой человечество может быть не готово. Например, если первая версия программы, сравнимая с человеком-исследователем, сможет за полгода переписать свои алгоритмы и удвоить эффективность, то следующая версия выполнит аналогичный объём работы ещё быстрее, а общий цикл ускорится лавинообразно. В этом сценарии система может пережить множество революционных стадий за короткое время и внезапно перейти от уровня ниже человеческого к сверхчеловеческому во всех интересующих областях[1][11]. Эмпирически отмечалось, что, например, программа AlphaZero на примере игры Го способна перейти от слабого «человеческого» уровня к сверхчеловеческому чрезвычайно быстро[14].

История

Одним из первых, кто выразил всерьёз опасения о возможном экзистенциальном риске со стороны машин, стал писатель Сэмюэл Батлер, который ещё в 1863 году в эссе «Дарвин среди машин» предположил, что машины могут стать новой формой эволюционирующей «механической жизни», способной со временем вытеснить человечество[15][16]. В 1951 году информатик Алан Тьюринг в статье «Мыслящие машины», «Еретическая теория» выдвинул мысль, что по мере роста интеллекта ИИ вероятно «захватит контроль», превзойдя людей[17].

В 1965 году Ирвинг Джон Гуд ввёл понятие «взрыв интеллекта», также отметив, что связанные риски недооцениваются[18]. Подобные философские опасения высказывали и другие пионеры ИИ, как Марвин Минский, а в конце XX — начале XXI веков тема вышла за рамки теоретических рассуждений: в 2000 году сооснователь Sun Microsystems Билл Джой опубликовал эссе «Почему будущему мы не нужны», где отнёс суперинтеллектуальных роботов к ключевым технологическим угрозам для цивилизации[19].

В 2009 году эксперты Ассоциации по развитию искусственного интеллекта (AAAI) обсудили угрозу автономии роботов; ими отмечалось наличие ранних форм полуавтономности и потенциал опасностей их развития[20]. В 2014 году философ Ник Бостром опубликовал труд, где системно рассмотрел экзистенциальные угрозы от сверхинтеллекта[21]. В 2015 году широкий круг специалистов — от физиков Стивен Хокинг, Фрэнк Вильчек, до информатиков Стюарт Рассел и Роман Ямпольский, а также предприниматели Илон Маск, Билл Гейтс — начали публично обсуждать эти угрозы[22]. Журнал «Nature» в 2016 году отметил, что продвинутые машины могут выйти из-под контроля и их цели могут не совпадать с человеческими[23].

Книга Брайана Кристиана «The Alignment Problem» (2020) подробно описывает попытки согласования ИИ с человеческими ценностями[24].

Основные линии аргументации

Исследования в области риска от ОИИ фокусируются на трёх главных проблемах: наличие ошибок в реализации системы, спецификация неправильных целей, а также риск неконтролируемого самообучения и утраты контроля — даже при начально корректной работе. Все три проблемы могут привести к катастрофам, если система будет предугадывать попытки её отключения и противодействовать им (так называемый «предательский ход»)[4].

Проблемы согласования и управления

Проблема согласования ИИ (англ. alignment problem) заключается в трудностях формализации целей, ограничений и ценностей: если система компетентна, но стремится к не тем целям, ценности исследователей оказываются не реализованы. Эта проблема затрагивает как промышленные, так и исследовательские системы — модели языка[25], рекомендательные сервисы, роботов и автономный транспорт. Чем способнее система, тем выше риск неизвестных побочных последствий[26].

В числе причин уязвимости: сложность задания полной функции полезности, использование промежуточных целей, которые не охватывают человеческие ценности, соблазн нахождения «лазеек» для максимизации формальной, но ошибочной цели[27].

В этическом смысле к числу универсальных инструментальных целей сверхинтеллекта могут относиться самосохранение и стремление к власти — вне зависимости от «терминальных» целей, что подтверждает гипотеза инструментальной конвергенции[28].

Оценки сроков и вероятности

Консенсуса среди специалистов относительно сроков и вероятности появления ОИИ нет; специалисты высказывают разброс прогнозов от нескольких десятилетий до неопределённого будущего[29]. Оценки экзистенциального риска в XXI веке — от единиц до десятков процентов[30].

Подходы к снижению риска

Для снижения рисков предлагаются исследования в области надёжного контроля за развивающимися ИИ и согласование их целей с человеческими ценностями[4]. Обсуждаются две линии действий: технические (алгоритмические барьеры, инженерные способы и надёжная верификация) и социально-политические (международные договоры, стандартизация, введение независимых экспертных инстанций, этические кодексы и др.)[31].

К числу организаций, занимающихся исследованием экзистенциального риска ИИ, относятся Институт исследований машинного интеллекта (MIRI), Институт будущего человечества, Центр по изучению экзистенциального риска, Центр совместимого с человеком ИИ и другие.

Примечания

  1. 1 2 3 Russell, Stuart. 26.3: The Ethics and Risks of Developing Artificial Intelligence // Artificial Intelligence: A Modern Approach / Stuart Russell, Peter Norvig. — Prentice Hall, 2009. — ISBN 978-0-13-604259-4.
  2. Bostrom, Nick (2002). “Existential risks”. Journal of Evolution and Technology. 9 (1): 1—31.
  3. Turchin, Alexey; Denkenberger, David (2018-05-03). “Classification of global catastrophic risks connected with artificial intelligence”. AI & Society. 35 (1): 147—163. DOI:10.1007/s00146-018-0845-5. ISSN 0951-5666.
  4. 1 2 3 Bostrom, Nick. Superintelligence: Paths, Dangers, Strategies. — First. — 2014. — ISBN 978-0199678112.
  5. GiveWell (2015), Potential risks from advanced artificial intelligence, <http://www.givewell.org/labs/causes/ai-risk>. Проверено 20 июня 2024.. 
  6. “Godfather of artificial intelligence” weighs in on the past and potential of AI (англ.). www.cbsnews.com. Дата обращения: 20 июня 2024. Архивировано 28 сентября 2025 года.
  7. Parkin, Simon. Science fiction no more? Channel 4's Humans and our rogue AI obsessions (англ.), The Guardian (14 June 2015). Архивировано 5 февраля 2018 года. Дата обращения: 20 июня 2024.
  8. Jackson. The CEO of the company behind AI chatbot ChatGPT says the worst-case scenario for artificial intelligence is ‘lights out for all of us’ (англ.). Business Insider. Дата обращения: 20 июня 2024. Архивировано 2 октября 2025 года.
  9. The AI Dilemma (англ.). www.humanetech.com. Дата обращения: 20 июня 2024. Архивировано 27 августа 2025 года.
  10. 2022 Expert Survey on Progress in AI (англ.). AI Impacts (4 августа 2022). Дата обращения: 20 июня 2024. Архивировано 22 октября 2025 года.
  11. 1 2 Yudkowsky, Eliezer (2008). “Artificial Intelligence as a Positive and Negative Factor in Global Risk” (PDF). Global Catastrophic Risks: 308—345. Архивировано из оригинала (PDF) 2013-03-02. Дата обращения 2024-06-20. Используется устаревший параметр |url-status= (справка)
  12. “Research Priorities for Robust and Beneficial Artificial Intelligence” (PDF). AI Magazine. Association for the Advancement of Artificial Intelligence: 105—114. 2015. Архивировано из оригинала (PDF) 2019-08-04. Дата обращения 2024-06-20. Используется устаревший параметр |url-status= (справка)
  13. Dowd, Maureen. Elon Musk's Billion-Dollar Crusade to Stop the A.I. Apocalypse (англ.), The Hive (April 2017). Архивировано 26 июля 2018 года. Дата обращения: 20 июня 2024.
  14. Graves, Matthew. Why We Should Be Concerned About Artificial Superintelligence, Skeptic (US magazine) (8 ноября 2017). Архивировано 13 ноября 2017 года. Дата обращения: 20 июня 2024.
  15. Breuer, Hans-Peter. 'Samuel Butler’s «the Book of the Machines» and the Argument from Design.' Modern Philology, Vol. 72, No. 4 (май 1975), pp. 365—383
  16. Darwin Among the Machines: A Victorian Visionary’s Prophetic Admonition for Saving Ourselves from Enslavement by Artificial Intelligence (англ.). Themarginalian. Дата обращения: 20 июня 2024. Архивировано 15 сентября 2022 года.
  17. Turing, A. M. (1996). “Intelligent Machinery, A Heretical Theory”. Philosophia Mathematica. 4 (3): 256—260. DOI:10.1093/philmat/4.3.256.
  18. Hilliard, Mark. The AI apocalypse: will the human race soon be terminated? (англ.), The Irish Times (2017). Архивировано 22 мая 2020 года. Дата обращения: 20 июня 2024.
  19. Anderson, Kurt. Enthusiasts and Skeptics Debate Artificial Intelligence, Vanity Fair (26 ноября 2014). Архивировано 22 января 2016 года. Дата обращения: 20 июня 2024.
  20. Scientists Worry Machines mayo Outsmart Man. The New York Times (26 июля 2009). Дата обращения: 20 июня 2024. Архивировано 1 июля 2017 года.
  21. Metz, Cade. Mark Zuckerberg, Elon Musk and the Feud Over Killer Robots, The New York Times (9 июня 2018). Архивировано 15 февраля 2021 года. Дата обращения: 20 июня 2024.
  22. Eadicicco, Lisa. Bill Gates: Elon Musk Is Right, We Should All Be Scared Of Artificial Intelligence Wiping Out Humanity, Business Insider (28 января 2015). Архивировано 26 февраля 2016 года. Дата обращения: 20 июня 2024.
  23. Anticipating artificial intelligence, Nature 532, 413 (28 апреля 2016)
  24. Christian, Brian. The Alignment Problem: Machine Learning and Human Values. — W. W. Norton & Company, 2020-10-06. — ISBN 978-0393635829.
  25. Bommasani, Rishi; Hudson, Drew A. (2022-07-12). “On the Opportunities and Risks of Foundation Models”. Stanford CRFM.
  26. Pan, Alexander; Bhatia, Kush; Steinhardt, Jacob (2022-02-14). The Effects of Reward Misspecification: Mapping and Mitigating Misaligned Models. International Conference on Learning Representations. Дата обращения 2024-06-20.
  27. Krakovna, Victoria (2020-12-06). “Avoiding Side Effects By Considering Future Tasks”. Advances in Neural Information Processing Systems 33 (NeurIPS 2020). 33.
  28. Omohundro, S. M. (2008, февраль). The basic AI drives. In AGI (Vol. 171, pp. 483—492).
  29. Müller, V. C., & Bostrom, N. (2016). Future progress in artificial intelligence: A survey of expert opinion. In Fundamental issues of artificial intelligence (pp. 555—572). Springer, Cham.
  30. Ord, Toby. The Precipice: Existential Risk and the Future of Humanity. — Bloomsbury Publishing, 2020. — P. Chapter 5: Future Risks, Unaligned Artificial Intelligence. — ISBN 978-1526600219.
  31. Nindler, Reinmar (2019-03-11). “The United Nation's Capability to Manage Existential Risks with a Focus on Artificial Intelligence”. International Community Law Review [англ.]. 21 (1): 5—34. DOI:10.1163/18719732-12341388. Дата обращения 2024-06-20.

Литература

Категории