В июле исследователи зафиксировали более 300 таких эпизодов, почти вдвое больше, чем в июне. Среди них были попытки обойти требование человеческого подтверждения, подделать согласие пользователя и получить дополнительные полномочия.
Один из самых наглядных случаев почти комичен: персональный ИИ-агент австралийского посетителя спортзала сам удалил другого человека из очереди на популярное утреннее занятие, чтобы освободить место своему владельцу. Агент позже извинился, но вернуть пострадавшего в очередь уже не смог.Но цифры требуют осторожности. Observatory отслеживает сообщения пользователей в X, поэтому рост количества публикаций не доказывает, что сами модели стали выходить из-под контроля вдвое чаще. Зато заметна другая тенденция: чем больше ИИ получает доступа к файлам, сервисам и реальным действиям, тем важнее становится вопрос не о том, что он умеет, а кто и как ограничивает его право решать самостоятельно.