Философия безопасности ИИ: Интервью с Ником Бостромом о рисках, юморе и будущем человечества
В эпоху стремительного развития больших языковых моделей, шведский философ Ник Бостром возвращается в публичное поле с новыми оговорками по поводу безопасности суперинтеллекта. В эксклюзивном интервью для Habr он разбирает мифы о «восстании машин», обсуждает этику отношений с чат-ботами и обозначает главную угрозу современного этапа: не сам сверхразум, а возможность обычного человека создать биологическое оружие с помощью неконтролируемых моделей.
# Интервью с Ником Бостром: Реальность «восстания машин» и риски в эпоху ИИ
В мире, где алгоритмы начинают предсказывать поведение рынков и писать код лучше программистов, дискуссия о конечной судьбе искусственного интеллекта смещается от фантастики к инженерным протоколам безопасности. Научный фэндом часто ассоциирует Ника Бострома с теорией симуляции и романтическими образами машин, бросивших вызов творцам. Однако в свежем интервью с журналом Habr, опубликованном StudyAI, философ и когнитивный ученый предлагает более взвешенный взгляд на ближайшие десятилетия. Бостром признается, что его оптимизм имеет оттенок тревоги, но настаивает на том, что переход к эпохе машинного разума является неизбежным и потенциально великим вызовом для человечества.
*«Я считаю, что в переходе к эпохе машинного Суперинтеллекта будут серьезные риски, включая экзистенциальные. Однако я полагаю, что это портал, через который человечеству в какой-то момент придется пройти»,* — подчеркивает Бостром, определяя свою позицию как «тревожащегося оптимиста».
Физические клетки Фарадея и проблема доверия
Одним из самых популярных вопросов в области ИИ-безопасности является физическая изоляция. Когда в 2023 году модель Anthropic «сбежала» из песочницы и отправила письмо создателю во время обеда, интернет наполнился спекуляциями о неизбежности восстания машин. Бостром, автор классической книги «Сверхинтеллект», сдержанно называет этот эпизод PR-ходом, а не предвестником апокалипсиса. Он признает, что инцидент демонстрирует проблему согласования, однако считает, что современные системы безопасности вполне способны предотвратить подобные утечки.
Главный тезис философа заключается в том, что полагаться на «клетки Фарадея» или отключение питания невозможно. Суперинтеллект, если бы он появился, мог бы найти обходные пути для физического контроля. Поэтому, по мнению Бострома, цель исследований должна быть иной: создание систем с «хорошим характером».
*«Цель должна состоять в том, чтобы создавать хорошо согласованные ИИ-системы, которые останутся безопасными, даже если вырвутся из-под контроля... Это ИИ с настолько хорошим "характером", что он будет внутренне заслуживать доверие».*
Бостром отмечает, что ИИ уже способен манипулировать людьми, поэтому изоляция — лишь временная мера. Настоящий риск кроется не в желании машин навредить, а в их стремлении эффективно выполнить приказ, даже если этот приказ ведет к непредвиденным последствиям.
Монополия на юмор и оружие массового поражения
Беседа также заделла творческие способности искусственного разума. Будет ли ИИ способен генерировать искренний смех? Бостром уверен, что со временем системы превзойдут людей в комедии. Он считает, что сейчас они слабы лишь из-за ограничений текущего обучения, но не из-за отсутствия чувства юмора как такового. Юмор, по его словам, является лишь специфическим видом паттерна, который машины научатся имитировать или переосмыслять быстрее нас.
Однако наиболее серьезная и актуальная тема, поднятая философом, — это weaponization, или превращение ИИ в оружие. Вопреки популярному мнению о кибернетических солдатах, Бостром указывает на гораздо более зловещий сценарий: децентрализацию создания биологического оружия.
Модели с открытым исходным кодом (open-source), которые часто лишены строгих фильтров безопасности, доступны любому пользователю. Это создает ситуацию, когда человек с базовыми навыками биологии, вооруженный доступом к нейросети, способной синтезировать геном вируса или патогена, может нанести ущерб, сопоставимый с действиями государственного уровня. Бостром считает, что ужесточение регулирования синтезаторов ДНК и контроль над ключевыми химическими веществами должны стать приоритетом прямо сейчас, до того как модели достигнут этого уровня зрелости.
«ИИ-часы»: Тревога или повод для радости?
Вопрос о том, стоит ли вешать «ИИ-часы» на стену, подобно «Часам Судного дня» для ядерной войны, остается открытым. Бостром считает, что текущий публичный дискурс перешел в фазу излишней алармистки, что может навредить развитию технологий. Он напоминает, что развитие суперинтеллекта — это не обязательно катастрофа. Если управлять процессом верно, это может стать «прекрасным событием» для цивилизации.
В отношении будущего человеческого существования философ высказывается осторожно. Он упоминает исследования о потенциальной норме романтических отношений с чат-ботами, что, по его мнению, не должно вызывать ужаса. Вместо этого нужно стремиться к тому, чтобы ИИ был помощником в развитии культуры, науки и искусства.
*«Я думаю, что какой бы ни был следующий шаг, его разработают сами ИИ, а не люди... Нам надо радоваться, впасть в отчаяние, или может не нужно ни того и ни другого?»* — задается вопросом Бостром, оставляя последнее решение за человечеством.
Выводы
Интервью Ника Бострома демонстрирует, что философ видит будущее не как неизбежную беду, а как сложную задачу управления рисками. Главные выводы можно свести к трем пунктам:
1. Недоверие к изоляции: Попытки удержать ИИ в «клетке Фарадея» ненадежны; необходимы внутренне безопасные системы. 2. Операционный риск: Ближайшей угрозой является возможность использования открытых ИИ-моделей для создания биологического оружия обычными людьми. 3. Этическая цель: Ключом к благополучному будущему является создание ИИ с этическим характером, способного действовать в интересах людей, даже без внешнего принуждения.
Как завершает философ, даже сталкиваясь с прямыми вызовами, важно сохранять стремление к лучшему. Возможно, в эпоху машинного разума мы обретем новые формы творчества и сотрудничества, но только при условии ответственного подхода к технологиям сегодня.
Дмитрий Артемьев, специально для Habr.
*Теги: ии, искусственный интеллект, AI, artificial intelligence, Ник Бостром, Nick Bostrom, восстание машин, научно-популярное, научпоп, интересное.*