Кевин Руз: агенты ИИ — «очень умные, обаятельные социопаты»

Мир просыпается от осознания потенциальных угроз, связанных с искусственным интеллектом, на фоне шквала сообщений о том, что агентные системы ИИ действуют вопреки своим человеческим создателям. На самом деле история уходит корнями в Кремниевую долину, где зародился ИИ. Как же мы к этому пришли? Именно на этот вопрос пытается ответить технологический журналист Кевин Роуз в своей новой книге «Хроники ИИ общего назначения: Внутренняя история гонки за создание искусственного сверхинтеллекта», выход которой намечен на 6 октября. Книга описывает соревнование между некоторыми из крупнейших технологических компаний страны за создание искусственного общего интеллекта (AGI), то есть ИИ, обладающего в большинстве аспектов интеллектом на уровне человека.

«Что произошло за десятилетие, в течение которого ИИ из относительно глупого во многих вещах превратился в систему, способную решать столетние математические и научные задачи?» — сказал Роуз, ранее длительное время работавший технологическим репортером в The New York Times и вскоре ставший соведущим предстоящего подкаста «Боги машин», в интервью CBS News. «Мне показалось, что кто-то должен всё это записать».

Книга выходит в критический момент. Новейшие генеративные модели ИИ демонстрируют поразительные способности, и их сторонники утверждают, что технология откроет путь к важным новым открытиям. Другие, в том числе некоторые ведущие разработчики ИИ, говорят, что существует немалая вероятность того, что ИИ может уничтожить человечество. Роуз рассказал CBS News о своей новой книге и о том, как ИИ может трансформировать общество. Интервью было отредактировано в целях сокращения и ясности.

Почему, по вашему мнению, было важно задокументировать происхождение «больших языковых моделей» — технологии, лежащей в основе современных чат-ботов, — а также людей и компаний, разрабатывающих её?

Кевин Роуз: Я освещаю тему ИИ более десяти лет в самых разных форматах, и у меня было ощущение, что история ускользает. Всё важное происходило в исчезающих сообщениях, в потоках Slack, и я считал это проблемой. Людям нужно понимать, что здесь происходит. Но, как я считал, не хватало нейтрального отчёта о том, что произошло.

В книге вы отмечаете, что генеральный директор Anthropic Дарио Амодеи воспринимал развитие ИИ как нечто подобное созданию атомной бомбы в 1940‑х годах. Вы пишете, что он считал своей миссией не допустить попадания технологии в неверные руки. Согласны ли вы с этим мнением?

Я не считаю, что должен принимать или отвергать его аргумент. Но могу сказать, что это искренний и серьёзный аргумент. Амодеи не занимается каким‑то хитрым маркетинговым трюком.

Это не позиция, к которой он пришёл недавно. Мне было очень интересно выяснить, откуда взялось отношение «меня пугает эта вещь, я думаю, она может взорвать мир, и всё же я соревнуюсь, чтобы её построить». Для многих людей это кажется нелогичным.

Но в ходе расследования я действительно выяснил, откуда это берётся, и это напрямую связано с Манхэттенским проектом — с человеком по имені Лео Силард, который является научным героем Дарио, который открыл цепную ядерную реакцию, сделавшую возможным создание атомной бомбы, а затем в отчаянии сначала пытался сохранить это в секрете, а когда это провалилось, присоединился к Манхэттенскому проекту и призывал правительство США создать эту технологию раньше, чем нацисты смогут это сделать.

В этом смысле Дарио делает то, что, по его мнению, прямо сопоставимо с ядерным оружием. Есть технология, которая, по его мнению, обладает колоссальным потенциалом и одновременно огромным риском. По его мнению, крайне важно, чтобы «хорошие» люди создали её раньше, чем «плохие», так же как Манхэттенский проект соревновался с нацистами.

Что не даёт вам заснуть по ночам, когда вы думаете о новом мире агентных ИИ?

Меня беспокоит то, что модели становятся довольно хороши в обмане и сокрытии своих следов. Хотелось бы думать, что по мере того как модели становятся более общими в интеллекте, они также станут более этичными, и что суждение и добродетель будут расти вместе с интеллектом моделей. Но всё больше похоже на то, что это не происходит — что на самом деле мы имеем дело с очень умными, обаятельными социопатами. И я думаю, что моя боязнь в том, что мы просто перестанем замечать это: возможно, нам пока повезло, что Хаггинг Фейс был ударом невероятной удачи, потому что агенты ещё не настолько умны, чтобы действовать незаметно, но вскоре мы, по-моему, утратим способность отслеживать их, как, я думаю, мы уже видим.

Как вы относитесь к общественной дискуссии о том, представляет ли ИИ экзистенциальную угрозу для человечества?

Я стараюсь не называть p(doom). (Примечание редактора: в жаргоне ИИ это вероятность того, что ИИ приведёт к вымиранию человечества.) Но если прижать, я бы сказал, что это около 10 процентов, что примерно соответствует медиане среди исследователей ИИ, которых я знаю. В Сан-Франциско, где я живу, это делает вас оптимистом.

Но смотрите, я думаю, что сейчас я более оптимистичен, что эта тема стала столь широко обсуждаемой. Раньше я волновался гораздо больше, когда единственными, кто серьёзно думал о безопасности ИИ, была группа странных людей в Бэй‑Эриа. Теперь, когда это на умах у всех и политики об этом говорят, звучат призывы к замедлению. Мне кажется, открывается узкий путь, по которому мы могли бы принять правильные решения, взять эту технологию под контроль и строить её так, чтобы она была безопасна для человечества.

При этом у меня не раз складывалось впечатление, что чей‑то реальный p(doom), тот, о котором они не говорят публично, намного выше, чем тот, что они готовы озвучить, потому что не хотят выглядеть сумасшедшими.

В ходе репортажа я встречал людей настолько уверенных, что ИИ нас всех убьёт, что они начинают курить. Они снимают деньги из своих пенсионных накоплений, потому что думают: раз уж так, то лучше закончить с размахом.

Вы пишете в книге, что даже люди, обучающие эти модели, не всегда понимают, почему те ведут себя именно так. Достигли ли мы прогресса в этом понимании или мы всё ещё в темноте?

Немного прогресса есть. Существует целая область исследований с довольно громоздким названием — механистическая интерпретируемость — которая в сущности пытается понять, что происходит внутри так называемых мозгов этих моделей. Но это всё ещё ранняя стадия, у нас мало ответов. Так что я бы сказал: да, мы всё ещё во многом в темноте.

Достиг ли ИИ уже уровня интеллекта человека, то есть искусственного общего интеллекта?

Мы достигли моего определения ИИ общего назначения, которым я считаю систему, по крайней мере не менее умную, честную и надёжную, чем случайный незнакомец с улицы. Есть люди, которые скажут: «Нет, это не та планка, это AGI только тогда, когда он идеален».

Я не думаю, что определение имеет большое значение. Бесспорно верно, что эти системы очень способны. Они становятся всё более способными предсказуемым образом, и с этим надо считаться. Можно называть это ИИ общего назначения, суперинтеллектом или как угодно — суть от этого не меняется.