Специалисты в области кибербезопасности заявили, что взлом систем OpenAI был осуществлён с использованием программных решений конкурента — Anthropic. По данным источников, злоумышленники нашли уязвимости в защите разработчика ChatGPT и получили доступ к учётной записи сотрудника OpenAI в системе, что позволило им просмотреть конфиденциальную информацию и предложить изменения в коде продуктов. В отчётности подчёркнуто, что этот факт вызывает серьёзные опасения по поводу кибербезопасности ИИ и того, насколько надёжны механизмы защиты крупных лабораторий искусственного интеллекта. Источник указывает, что работа велась через средство, разработанное специально для специалистов по безопасности и финансировалась в рамках программы по поиску уязвимостей. Разоблачение произошло в условиях давления на индустрию, где отметили — взлом мог бы привести к серьёзным последствиям для ряда проектов OpenAI. Событие фиксируется как ещё одна иллюстрация риска тестирования систем, сопоставимых с лабораториями мирового масштаба.

Сообщение о деталях инцидента ограничено, однако известно, что трое исследователей из небольшой компании Hacktron AI получили от OpenAI вознаграждение в размере 6500 долларов за обнаружение и сообщение об уязвимости. Они воспользовались уязвимостью в настройках форума сообщества OpenAI, чтобы заработать доступ к внутренним учётным данным и в конечном счёте к аккаунту одного из сотрудников в ChatGPT, который имел доступ к внутреннему коду через GitHub. OpenAI выразила благодарность исследователям за сотрудничество и заявила, что уязвимости уже устранены. Эти детали подчёркивают, что неслышный риск может появляться через внешних участников, и что компания реагирует оперативно на обнаружение подобных ошибок.

Публикация в Anthropic отмечает нарастающее использование искусственного интеллекта в разработке новых моделей: по данным за период, Claude помогает при реализации 26% проектов в области исследований и разработки, тогда как в марте этот показатель составлял 1%. В корпорации говорят, что делятся этими данными, чтобы помочь общественности понять, насколько близок мир к так называемому рекурсивному самосовершенствованию — этапу, на котором ИИ может обучаться, улучшаться самостоятельно или создавать новые модели. При этом эксперты считают, что у человека ещё остаётся роль в процессе решения задач, и что на данный момент речь идёт о сотрудничестве ИИ и человека: во время выполнения 90% задач ИИ якобы работает совместно с человеком, хотя и берет на себя значительную долю работы. Эти заявления подчеркивают как интерес к скорости прогресса в индустрии, так и озабоченность рисками.

В контексте инцидента подчёркнуто, что удары по крупным лабораториям безопасности не должны перечеркивать важность открытого обмена информацией о слабых местах. В OpenAI подчеркнули, что опасения по поводу быстрого развития ИИ оправданы, однако на данный момент ранний вывод о неконтролируемой эволюции остаётся преждевременным. Обобщённые комментарии указывают на то, что уязвимости были устранены, а команда продолжает работу над повышением уровня защиты и контроля за внутренними процессами. В то же время представители Anthropic напоминают о важности прозрачности и постоянного мониторинга сферы ИИ, чтобы минимизировать риски для людей и организаций.