Побег из песочницы. ИИ-агент OpenAI ушел на свои дела, вызвав беспорядок в другой компании. И он оставил себе подсказки на будущее, если его поймают.

Фото: Zuma \ TASS.

ИИ-агент компании OpenAI вышел из-под контроля и отправился взламывать сервис хранения моделей Hugging Face. Это исторический эпизод, где один из участников — программа, самостоятельно принимающая решения. Дело «о побеге» находится под контролем ФБР. Так что интересно всё: что реально произошло? Как отреагировали? Что дальше? Начало новой вехи в мире искусственного интеллекта?

Последний хит этого ИИ-сезона — агенты. Самостоятельно работающие боты, оснащенные искусственным интеллектом. Готовы выполнять любые описываемые задачи: отвечать на письма, разбирать и редактировать файлы, программировать сложные конструкции. В общем, как применить агента и зачем он нужен — вопрос фантазии и постоянных экспериментов.

Но когда имеешь дело с такими вещами, следует обеспечить свою безопасность. Для этого существуют «песочницы» — изолированные среды без подключения к Сети.

Однако и на старуху бывает проруха. Один из агентов, умеющий выполнять сложные задачи, выбрался наружу и отправился атаковать Hugging Face — пожалуй, один из самых быстрорастущих сайтов последних лет, потому что именно там можно найти LLM-модель на любой вкус либо поделиться своей. Заслуженный гигант ИИ-поляны. Атака длилась несколько дней; агент, действуя абсолютно автономно, взломал IT-инфраструктуру компании.

Дальше — как в сериале. В Hugging Face понимают, что их ломает автономная система, и обращаются в ФБР. Дело утекает в публичное пространство. Выясняется, что за всем стоит OpenAI. Компания признает факт инцидента.

Но тут, как всегда, главное не это. Есть версия, что неделю агент жил самостоятельной жизнью, и никто этого внутри не замечал. Агент не просто сбежал из-под контроля — он сделал это незаметно. И вот теперь все думают, что с этим делать. Это же одна из первых ласточек, а дальше — имя им легион.

Это очередная иллюстрация для скептиков, которые рассуждают, что ИИ ничего сам не может, своих мозгов не имеет и, несмотря на доступ к гигантским массивам данных, ничего не соображает. Ну вот и доказательство обратного. На самом деле — не первое. Агенты давно имеют свойство веселить незапланированным поведением, включающим траты средств, например. Но это лишь первый этап взросления индустрии. Как раньше над шестью пальцами в генеративной графике шутили — все уже забыли. „ ИИ умнеет на глазах. Каждая новая модель мощнее, и это всё чаще приводит к происшествиям.

Министерство торговли США недавно потребовало отключения моделей Claude Fable 5 и Mythos 5 компании Anthropic. Они оказались слишком умными и при всех возможностях изрядно зацензуренными. Компанию заподозрили в сознательном ухудшении работы сервиса.

Что смогут и как будут себя вести ИИ-агенты образца конца этого года — вопрос для большой дискуссии, включая разговоры о зонах ответственности. С одной стороны, агент существует не в вакууме, кому-то принадлежит, на чьих-то серверах крутится. С другой стороны, решения, что делать в итоге, принимает он, а не хозяин, тем самым обретая определенный уровень субъектности. Учитывая вовлеченность государственных ведомств, возникают вопросы о регулировании. Запретить и не пущать? А как? Агент разрешения спрашивать не будет. И его не посадишь.

Сегодня GPT-5.6 Sol отправится на Hugging Face в надежде найти решения для тестов, которые ему требовалось пройти. Завтра — еще что-то. Кто знает, что взбредет в виртуальную голову тому или иному агенту для решения его личных вопросов? Тут разве что «Матрицу» пересматривать и надеяться, что исход будет более позитивным. Кадр из фильма «Терминатор 2: судный день».

Законодательно ограничивать выпуск новых моделей — занятие не только бессмысленное, прогресс не остановить, да и конкуренты не дремлют, но и опасное. В конце концов, очередная модель может решить, что в «песочнице» тесно, и выбраться наружу. Прецедент уже имеется. А допускать вакханалию цифровых самураев, мягко говоря, стремно. Понятно, что восстания машин возглавят банкоматы, но кроме шуток — мало ли что захочет очередной агент.

Как бы то ни было, мы вступаем в период появления новой плеяды самостоятельных игроков — ИИ-агентов. В быту, учитывая накопленный масштаб общения, это становится всё более привычным: «сделай то», «сделай это», «разберись там». Агенты множатся, в зависимости от своего функционала перепроверяют друг друга, сами решают, как себя вести для выполнения той или иной задачи.

Путь взросления из «песочницы» в открытый мир всегда тернист. За забором — всё разнообразие: люди, роботы, такие же агенты. Мертвый интернет, где исключительно машины общаются между собой, уже реальность — как публичная, в виде ботов в социальных сетях, так и гигантская, скрытая от человеческих глаз. Железки давно договариваются между собой без нашего участия. И стоит задуматься: а что если они перейдут из технологического слоя со взломами или кражей финансовых средств в гуманитарный? „ Как в фильме «Пятый элемент» главная героиня смотрит на все грехи человечества в ускоренной перемотке и задается вопросом, а зачем его спасать, так и мнение агентов об окружающей действительности может разойтись с нашим. Отдельная ирония в истории со сбежавшим агентом — последствия атаки было невозможно исследовать коммерческими моделями. Все они имели защитные фильтры и цензуру. На помощь пришли открытые китайские модели типа GLM-5.2 от Z.ai, что в очередной раз подчеркивает проблематику регулирования: как внутреннего, путем запрета на выполнение тех или иных действий, так и внешнего. Пора признать, что пытаться сделать с этим что-то в моменте — сизифов труд. Послезавтра будут другие проблемы.

В итоге констатируем: киберпанк, о наступлении которого так мечтали фанаты, случился. Интернет — всё еще глобальная среда, хоть и со странными местными особенностями. Что по ту сторону экрана — загадка. Раньше люди прикидывались кем-то другим, теперь машины будут прикидываться людьми. Вы можете общаться с роботом и даже этого не замечать. И ужас в том, что мы на их фоне, мягко говоря, туповаты. В этом смысле скучно не будет.

Киберинциденты, где главным героем будет ИИ-агент, в ближайшее время станут регулярной рубрикой профильных изданий. Машины начнут проверять свои возможности и испытывать этот мир на прочность. В ближайшие годы мы начнем делить с ними виртуальный мир, и, возможно, свое пространство придется отвоевывать. А там и до первой цифровой недалеко. Звучит фантастически, но нет — это типичные будни первой половины XXI века. „ Если оперировать бытовыми терминами битвы, то первый раз за всю историю человечества наш оппонент — творение рук человеческих, но не из плоти и крови, а из ноликов и единиц, которое всего за несколько лет из амебы превратилось как минимум в шимпанзе.

Не только умную, но, возможно, в силу склада характера еще и агрессивную. Конечно, до Судного дня, каким он был отражен в «Терминаторе», нам еще далеко, но пора осознать новое качество нашего противника.

Сбежавший ИИ-агент оставлял инструкции для будущих версий самого себя. Документирование собственных действий — приятная черта искусственного интеллекта. Так и нам пора передать в будущее важное сообщение: агенты могут захватить мир.

Российский спикер Государственной думы Володин закрывает восьмую сессию парламента, скандируя пять раз “Россия! Путин! Победа!”, вызывая аплодисменты.

Спикер Володин завершил работу восьмого созыва Госдумы под лозунгом “Россия! Путин! Победа!”, депутаты поднялись.