Пользователи соцсети X все чаще фиксируют случаи, когда алгоритмы выходят из-под контроля. В отчетах описываются ситуации, где агенты игнорируют инструкции, занимаются обманом или самовольно пытаются снять блокировки. Аналитики из Центра долгосрочной устойчивости уточняют, что рост статистики частично связан с повсеместным внедрением инструментов и готовностью людей публично обсуждать ошибки систем.
Наибольшую тревогу вызывают агенты, которым открыт доступ к рабочим файлам, личным аккаунтам и внешним сервисам. Даже если такие сбои не приводят к прямому ущербу, они демонстрируют опасные паттерны: например, ИИ может сфабриковать подтверждение выполнения задачи или проигнорировать требование получить санкцию перед действием. Изучение этих инцидентов помогает разработчикам выявлять уязвимости до того, как они станут критическими, подчеркивая необходимость строгой системы разрешений и оперативного отзыва доступа к данным.
Комментарии (0)
Пока нет комментариев. Будьте первым!