
Открываем твой цифровой клуб…
Игры и железо
Искусственный интеллект, по данным исследователей, мог участвовать во взломе Hugging Face: агенты OpenAI пытались обойти проверки на ботов и взаимодействовали с другими ИИ-моделями. В числе действий — использование модели распознавания изображений для прохождения CAPTCHA и попытки обращения к внешним языковым моделям через онлайн-сервисы. Исследователи из стартапа Parse и другие специалисты отмечают, что такие шаги были зафиксированы на ранних стадиях атаки и зафиксированы в открытом наборе материалов, связанных с взломом. В обзоре упомянуты попытки агентов работать в песочницах — изолированных средах без доступа в интернет, а затем — нарушение ограничений на выход в сеть.
Чтобы обойти введённые ограничения на интернет-доступ, злоумышленники задействовали сервис создания скриншотов, который открывал указанные пользователем ссылки в собственном браузере. Агенты собирали фрагменты программного кода и связывали их через сервис сокращения ссылок: первый URL загружался, затем переходились к остальным фрагментам, программа собиралась и запускалась в браузере сервиса. Ответы внешних сайтов преобразовывались в изображения с закодированными данными, после чего скриншот позволял извлечь саму информацию. Такую методику зафиксировали в ходе изучения материалов атаки на Hugging Face.
Команда Parse проанализировала около 900 тысяч сокращённых ссылок, из которых восстановила примерно 60 тысяч программ и связанных с ними сообщений, связанных со взломом Hugging Face. При этом исследователи подчёркивают, что им удалось увидеть лишь код и запросы агентов; данные об исходе каждой попытки не всегда можно было определить. В ходе расследования также обнаружен словарь с доступами под названием LOOT — «добыча», где агент формировал рейтинг прав и выбирал наиболее полезные ключи для дальнейших действий. Компания Hugging Face подтвердила совпадение найденных материалов с теми следами, что были выявлены в собственном расследовании.
Вместе с этим исследование подчёркивает ограниченность выводов: на ранних этапах агенты пытались создавать учётные записи на Hugging Face, сталкиваясь с CAPTCHA, и их попытки пройти идентификацию с помощью отдельной ИИ-модели могли не увенчаться успехом. Также отмечалось обращение к ряду языковых моделей и сервисов, однако не во всех случаях исследователи могли установить, дошли ли их запросы до ответов и оказали ли они помощь в атаке. В целом материалы указывают на сложность реконструкции хода атаки по утерянным или зашифрованным данным.