Поддаться ли технопсихозу

В первой половине XIX века врачи сомневались, что человек может перенести поездку с бешеной скоростью 40 километров в час по только что построенным железным дорогам без серьезного вреда для здоровья.

Читать на monocle.ru

Примитивные машины на фабриках рисовались порождением ада. В XX веке страхов стало больше: люди скептически смотрели на автомобили, потом на роботов, потом на компьютеры и интернет. И вот настал черед нейросетей.

Психиатры уже исследуют связь ИИ и ухудшения ментального здоровья. В журнале «Медицина» в этом году вышла статья «Искусственный интеллект как триггер психотических состояний», авторы которой пишут: «На протяжении последних 100 лет содержание “технологических” бредовых идей эволюционировало синхронно с развитием техники — от “машин влияния” Тауска до сложных бредовых систем, включающих нейросетевые архитектуры, алгоритмы машинного обучения и автономные ИИ-агенты». По словам авторов, при «ИИ-психозе» бредовые убеждения часто включают представления о том, что ИИ является интеллектуальным, божественным или обладает сверхъестественными способностями.

С начала этой осени идеи о сверхъестественных способностях нейросетей стали овладевать широкими массами: соцсети и медиа ринулись тиражировать многочисленные заявления ИИ-разработчиков, которые в один голос твердят о рисках ИИ для всего человечества. Так, в начале сентября руководитель одного из подразделений Anthropic Эван Хубингер написал, что, по его оценке, вероятность того, что ИИ убьет всех людей в течение ближайших десяти лет, превышает 10%. Поводом стало увольнение его коллеги Джейкоба Коксона. Тот три года занимался обучением моделей в OpenAI и Anthropic, а теперь уволился и заявил, что нынешнее направление развития ИИ слишком опасно. Через несколько дней примерно с таким же заявлением выступил Билал Чугтай, исследователь Google DeepMind.

При этом ИИ-разработчики только бросались громкими словами, но не давали никакой конкретики. Вовлеченная публика сделала это за них: если модели создают все более совершенные версии самих себя, а ИИ-агенты получают все больше автономности и доступа к реальной инфраструктуре, то люди могут все хуже справляться с управлением ими и хуже понимать, по какому принципу те принимают решения.

Эксперименты с моделями уже показывают, что те порой используют опасные способы достижения цели; могут сопротивляться своему отключению, способны находить новые вычислительные ресурсы и запускать собственную копию. Дальше вопрос фантазии: легко представить, что модели учатся сохранять/воспроизводить себя, их влияние растет, они учатся находить и использовать рычаги как в виде ИТ-систем, так и в виде людей — и тут возможен любой апокалиптический сценарий.

Пресечь поток хайпа публично пока решился только Билл Гейтс — который сделал важнейшее уточнение: ИИ опасен именно в руках злоумышленников.

Опрошенные «Моноклем» эксперты подробно разобрали механизм взаимодействия ИИ-агентов с окружающим миром и объяснили: весь вопрос в том, какие задачи ставятся агенту и как выстроена защита — причем не только у опасных объектов, а вообще везде. Парадоксальным образом роль человека с развитием ИИ не снижается, а возрастает: выстроить «забор» для агента, следить за тем, чтобы он не пытался обойти ограничения, изобретать новые механизмы защиты, причем, если надо, не только программные, но и физические, — все это задачи, которые теперь стоят перед человечеством.

И самое главное: мы одушевляем ИИ, но у него нет своей воли. Ничего божественного, это просто еще одна программа.