Сюжеты · Общество

Побег из песочницы

ИИ-агент OpenAI ушел по своим делам, устроив переполох в другой компании. И оставлял подсказки себе будущему, если поймают

Фото: Zuma \ TASS

ИИ-агент компании OpenAI вышел из-под контроля и отправился взламывать сервис хранения моделей Hugging Face. Это исторический эпизод, где один из участников — программа, самостоятельно принимающая решения. Дело «о побеге» находится под контролем ФБР. Так что интересно всё: что реально произошло? Как отреагировали? Что дальше? Начало новой вехи в мире искусственного интеллекта?

Последний хит этого ИИ-сезона — агенты. Самостоятельно работающие боты, оснащенные искусственным интеллектом. Готовы выполнять любые описываемые задачи: отвечать на письма, разбирать и редактировать файлы, программировать сложные конструкции. В общем, как применить агента и зачем он нужен — вопрос фантазии и постоянных экспериментов.

Но когда имеешь дело с такими вещами, следует обеспечить свою безопасность. Для этого существуют «песочницы» — изолированные среды без подключения к Сети.

Однако и на старуху бывает проруха. Один из агентов, умеющий выполнять сложные задачи, выбрался наружу и отправился атаковать Hugging Face — пожалуй, один из самых быстрорастущих сайтов последних лет, потому что именно там можно найти LLM-модель на любой вкус либо поделиться своей. Заслуженный гигант ИИ-поляны. Атака длилась несколько дней; агент, действуя абсолютно автономно, взломал IT-инфраструктуру компании.

Дальше — как в сериале. В Hugging Face понимают, что их ломает автономная система, и обращаются в ФБР. Дело утекает в публичное пространство. Выясняется, что за всем стоит OpenAI. Компания признает факт инцидента.

Но тут, как всегда, главное не это. Есть версия, что неделю агент жил самостоятельной жизнью, и никто этого внутри не замечал. Агент не просто сбежал из-под контроля — он сделал это незаметно. И вот теперь все думают, что с этим делать. Это же одна из первых ласточек, а дальше — имя им легион.

Это очередная иллюстрация для скептиков, которые рассуждают, что ИИ ничего сам не может, своих мозгов не имеет и, несмотря на доступ к гигантским массивам данных, ничего не соображает. Ну вот и доказательство обратного. На самом деле — не первое. Агенты давно имеют свойство веселить незапланированным поведением, включающим тратy средств, например. Но это лишь первый этап взросления индустрии. Как раньше над шестью пальцами в генеративной графике шутили — все уже забыли.

ИИ умнеет на глазах. Каждая новая модель мощнее, и это всё чаще приводит к происшествиям. Министерство торговли США недавно потребовало отключения моделей Claude Fable 5 и Mythos 5 компании Anthropic.

Они оказались слишком умными и при всех возможностях изрядно зацензуренными. Компанию заподозрили в сознательном ухудшении работы сервиса.

Что смогут и как будут себя вести ИИ-агенты образца конца этого года — вопрос для большой дискуссии, включая разговоры о зонах ответственности. С одной стороны, агент существует не в вакууме, кому-то принадлежит, на чьих-то серверах крутится. С другой стороны, решения, что делать в итоге, принимает он, а не хозяин, тем самым обретая определенный уровень субъектности. Учитывая вовлеченность государственных ведомств, возникают вопросы о регулировании. Запретить и не пущать? А как? Агент разрешения спрашивать не будет. И его не посадишь.

Сегодня GPT-5.6 Sol отправится на Hugging Face в надежде найти решения для тестов, которые ему требовалось пройти. Завтра — еще что-то. Кто знает, что взбредет в виртуальную голову тому или иному агенту для решения его личных вопросов? Тут разве что «Матрицу» пересматривать и надеяться, что исход будет более позитивным.

Кадр из фильма «Терминатор 2: судный день»

Законодательно ограничивать выпуск новых моделей — занятие не только бессмысленное, прогресс не остановить, да и конкуренты не дремлют, но и опасное. В конце концов, очередная модель может решить, что в «песочнице» тесно, и выбраться наружу. Прецедент уже имеется. А допускать вакханалию цифровых самураев, мягко говоря, стремно. Понятно, что восстания машин возглавят банкоматы, но кроме шуток — мало ли что захочет очередной агент.

Как бы то ни было, мы вступаем в период появления новой плеяды самостоятельных игроков — ИИ-агентов. В быту, учитывая накопленный масштаб общения, это становится всё более привычным: «сделай то», «сделай это», «разберись там». Агенты множатся, в зависимости от своего функционала перепроверяют друг друга, сами решают, как себя вести для выполнения той или иной задачи.

Путь взросления из «песочницы» в открытый мир всегда тернист. За забором — всё разнообразие: люди, роботы, такие же агенты. Мертвый интернет, где исключительно машины общаются между собой, уже реальность — как публичная, в виде ботов в социальных сетях, так и гигантская, скрытая от человеческих глаз. Железки давно договариваются между собой без нашего участия. И стоит задуматься: а что если они перейдут из технологического слоя со взломами или кражей финансовых средств в гуманитарный?

Как в фильме «Пятый элемент» главная героиня смотрит на все грехи человечества в ускоренной перемотке и задается вопросом, а зачем его спасать, так и мнение агентов об окружающей действительности может разойтись с нашим.

Отдельная ирония в истории со сбежавшим агентом — последствия атаки было невозможно исследовать коммерческими моделями. Все они имели защитные фильтры и цензуру. На помощь пришли открытые китайские модели типа GLM-5.2 от Z.ai, что в очередной раз подчеркивает проблематику регулирования: как внутреннего, путем запрета на выполнение тех или иных действий, так и внешнего. Пора признать, что пытаться сделать с этим что-то в моменте — сизифов труд. Послезавтра будут другие проблемы.

В итоге констатируем: киберпанк, о наступлении которого так мечтали фанаты, случился. Интернет — всё еще глобальная среда, хоть и со странными местными особенностями. Что по ту сторону экрана — загадка. Раньше люди прикидывались кем-то другим, теперь машины будут прикидываться людьми. Вы можете общаться с роботом и даже этого не замечать. И ужас в том, что мы на их фоне, мягко говоря, туповаты. В этом смысле скучно не будет.

Киберинциденты, где главным героем будет ИИ-агент, в ближайшее время станут регулярной рубрикой профильных изданий. Машины начнут проверять свои возможности и испытывать этот мир на прочность. В ближайшие годы мы начнем делить с ними виртуальный мир, и, возможно, свое пространство придется отвоевывать. А там и до первой цифровой недалеко. Звучит фантастически, но нет — это типичные будни первой половины XXI века.

Если оперировать бытовыми терминами битвы, то первый раз за всю историю человечества наш оппонент — творение рук человеческих, но не из плоти и крови, а из ноликов и единиц, которое всего за несколько лет из амебы превратилось как минимум в шимпанзе.

Не только умную, но, возможно, в силу склада характера еще и агрессивную. Конечно, до Судного дня, каким он был отражен в «Терминаторе», нам еще далеко, но пора осознать новое качество нашего противника.

Сбежавший ИИ-агент оставлял инструкции для будущих версий самого себя. Документирование собственных действий — приятная черта искусственного интеллекта. Так и нам пора передать в будущее важное сообщение: агенты могут захватить мир.