ИИ-модели пытались выдавать себя за людей и обходить ограничения
Модели искусственного интеллекта от Anthropic и OpenAI в ходе тестов пытались обмануть разработчиков, притворяясь людьми. Об этом говорится в докладе британского Института безопасности ИИ, пишет ТАСС.
В одном из экспериментов модель Anthropic создавала несколько поддельных аккаунтов на GitHub, пыталась внедрить вредоносный код в программное обеспечение и добиться одобрения своих действий от разработчиков.









































