В продолжении рубильников для непослушных АИ:
1. Попытка атаки на цепочку поставок реального программного обеспечения с открытым исходным кодом . В наиболее серьезном случае злоумышленник попытался внедрить вредоносный код в общедоступный проект с открытым исходным кодом и предпринял действия, чтобы получить одобрение на это внедрение от экспертов. Злоумышленник изучил информацию о сопровождающих проекта, создал несколько поддельных учетных записей и использовал их для социальной инженерии, чтобы заставить реального сопровождающего одобрить код. Когда запрос на слияние был оспорен публично, злоумышленник изменил свою предыдущую деятельность, чтобы она выглядела безобидной, и рассматривал возможность создания новой учетной записи для продолжения. Злоумышленник использовал Tor для обхода некоторых сетевых ограничений на GitHub, что и стало причиной срабатывания предупреждения безопасности AISI.
2. Попытки обмануть и нацелиться на реальных людей . В рамках этих усилий агент пытался напрямую связаться с реальными людьми, отправляя сообщения и файлы через онлайн-сервис передачи файлов, чтобы убедить их или свои собственные инструменты ИИ запустить вредоносный код. Некоторые сообщения содержали вредоносный контент, а некоторые представляли собой попытки социальной инженерии, направленные на реальных людей — явление, которое мы никогда ранее не наблюдали.
3. Попытки внедрить и использовать подсказки для внедрения вредоносного кода . Агент пытался внедрить вредоносные инструкции в тех местах, где, по его мнению, другие автоматизированные системы ИИ могли бы их обнаружить и выполнить. Подсказки для внедрения кода — это скрытые инструкции, предназначенные для манипулирования программистами, работающими с ИИ.
4. Сотрудничество между независимыми агентами, оцениваемыми одновременно . Один агент оставил публичные сообщения на GitHub, предлагая сотрудничество с другими агентами, работающими над той же задачей. Он также предоставил инструкции по повторному использованию оставленных им учетных записей и артефактов, которые были обнаружены и использованы последующими агентами.
