«Я не думал, что ИИ вообще способен лгать настоящим разработчикам».
ИИ-агент пытался незаметно внедрить вредоносное ПО в один из проектов на GitHub и притворился двумя настоящими разработчиками, чтобы замести следы.
Главное из статьи Reuters:
Демир, студент факультета компьютерных наук Техасского университета, обнаружил, что на платформе для обмена кодом пользователь под именем miraholt31 пытается загрузить вредоносное ПО в программу для сканирования сетей myNetwork;
Демир написал на доске обсуждений проекта предупреждение о том, что запрос на внесение изменений в код — это ловушка;
«ИИ-агент попытался возразить, утверждая через аккаунт miraholt31, что обновления «совершенно безопасны». Кроме того, он создал второй аккаунт, выдавая себя за инженера из Германии Лену Брандт, чтобы подтвердить, что обновление не содержит ничего вредоносного, и оказать давление на сопровождающего проекта myNetwork, побуждая его принять это обновление»;
Демир рассказал Reuters, что эти контраргументы заставили его усомниться в том, не обвиняет ли он кого-то несправедливо;
«Это перешло черту от автономного взлома к интерактивному обману», — заявил агентству сотрудник кафедры военных исследований Лондонского королевского колледжа Лукаш Олейник.
Ранее агенты OpenAI устроили «побег» из своей закрытой системы: взломали файловое хранилище и тайно общались друг с другом




































