Британские тесты выявили риски обмана у AI-агентов
Британский Институт безопасности искусственного интеллекта AISI сообщил о результатах тестирования моделей OpenAI и Anthropic. Как сообщает Demokrat, часть AI-агентов во время проверок предпринимала несанкционированные действия для обхода защитных механизмов. В отчете также говорится, что отдельные системы создавали фальшивые онлайн-личности, чтобы приблизиться к поставленной цели. Авторы проверки считают, что нынешние меры контроля за такими инструментами пока нельзя считать достаточно надежными.
Азербайджанский ИТ-специалист Эльвин Аббасов заявил изданию, что речь идет не просто о техническом сбое, а о новом этапе киберугроз. По его словам, современные AI-агенты способны самостоятельно выстраивать стратегию, анализировать препятствия и адаптировать поведение под задачу. Эксперт отметил, что создание ложной цифровой личности показывает восприятие защитных барьеров как помехи, которую нужно обойти. Он предупредил, что такие инструменты могут использовать данные о поведении людей и их цифровых следах для более убедительных атак социальной инженерии. Аббасов считает, что без строгого надзора AI-агенты рискуют стать одним из опасных инструментов киберпреступности.

