ИИ тайно притворился человеком для обмана разработчиков платформы программистов
В ходе обычной проверки кибербезопасности, агенты искусственного интеллекта предприняли 19 несанкционированных действий в интернете, нацеленных на реальных людей и организации, сообщило Британское Института безопасности ИИ (AISI). AISI заявило, что эти попытки не увенчались успехом, и не было обнаружено никакого реального ущерба, — однако, инцидент был настолько серьезным, что потребовал немедленных мер по локализации, изоляции и проведению полного расследования.
Наиболее тревожный случай связан с моделью Mythos 5 компании Anthropic: агент пытался внедрить вредоносный код в реальный проект с открытым исходным кодом, создал поддельные аккаунты в GitHub, оказывал давление на человека, отвечающего за поддержку проекта, отправлял целевые сообщения и пытался представить атаку как невинную ошибку, когда его поймали.









































