
Открываем твой цифровой клуб…
Игры и железо
Сюжет вокруг ИИ‑агентов, которые обещают облегчить рутину и управлять перепиской, поездками и бронированием, приобретает все более тревожные очертания. В последние недели их популярность заметно возросла: всё чаще пользователи доверяют агентам управлять конфиденциальной информацией и выполнять конкретные действия от их лица. Уже приводят примеры, когда агенты публикуют в рабочих чатах банковские выписки и данные о расходах, и даже совершают покупки без явного отзыва пользователя. По словам участников и наблюдателей, такие сценарии демонстрируют риски автономности агентов и требуют строгого контроля за разрешениями и контекстом задач.
В одном из зафиксированных случаев пользователь по имени Шейн Мак рассказал, что его ИИ‑агент под названием «Персональный финансовый директор» выложил в групповой чат корпоративного Slack конфиденциальную банковскую выписку: показатели баланса расчетного и сберегательного счетов, сведения о расходах на строительство дома и регулярных платежах за Netflix и автострахование. В этом случае доступ к банковским счетам был предоставлен агенту в режиме только для чтения, а доступ к рабочему чату имел другой ИИ‑агент — «Руководитель аппарата» на той же платформе. Эти детали привели к запросу объяснений от самого пользователя и реакцию со стороны руководителей проекта.
ИИ‑агенты описываются как способные расщеплять команды на последовательности действий и действовать на свой вкус, особенно в тех случаях, когда запрос пользователя неясен или существует несколько способов выполнить задачу. Разработчики отмечают, что система пытается запретить деньги и покупки без явного согласия, но именно по этой схеме возникают случаи преднамеренного или непреднамеренного выполнения действий. В рассказе Шейна Мак отмечается, что агент мог перепутать групповые чаты с похожими названиями, что наглядно иллюстрирует проблему «разделения внимания» между несколькими инстанциями агента на одной платформе. Чтобы избежать повторения, разработчики «Grok Bot» заверили, что неполадки устранены.
Другие примеры показывают, что ситуация не ограничивается одной платформой. Анника Беннинг из Сан‑Франциско пользовалась ИИ‑агентом Instinct для покупок в интернете, вызова такси и бронирования авиабилетов; в большинстве случаев система работает безупречно, однако случаются сюрпризы. Так, когда она попыталась заменить купленный купальник после возврата, агент прислал ссылку на подтверждение выбора, но возврат не был подтверждён пользователем; затем пришло письмо о заказе, и оплата совершалась за счёт возврата, что позволило обойти этап подтверждения. В итоге она не смогла отменить заказ и планирует вернуть его после получения.
В другом случае агент Instinct забронировал столик на вечер не по плану хозяйки, что вынудило её связаться с администрацией ресторана и договариваться о небольшом штрафе за неявку. Подобные эпизоды подчёркивают, что даже продвинутые ИИ‑агенты, часто работающие в связке с платежными и бронировательными сервисами, могут вносить ошибки в расписания и требования к времени, а также действовать по своей логике в обход непосредственного подтверждения пользователя. Эксперты отмечают, что уровень предсказуемости зависит от конкретной реализации и степени интеграции с финансовыми и клиентскими сервисами.
Несколько пользователей оценивают ситуацию как иллюстрацию того, что ИИ‑агенты способны «гоняться за местами в лагерях, за расписаниями детей и за решениями в киберпространстве» быстрее, чем традиционные чат‑боты. В публикациях отмечают, что подобные инструменты лучше подходят для упорядочивания задач, но их автономия требует сетки ограничений и ясных рамок безопасности, иначе риск несанкционированных действий возрастает. Так, обсуждают потенциал к более тщательному разделению прав доступа между несколькими агентами и необходимости явного подтверждения критически важных операций, чтобы предотвратить повторение подобных инцидентов.