SkillCascade: безопасные по отдельности навыки ИИ-агента могут складываться в атаку
Авторы нового препринта описали каскадные атаки, при которых вредоносная цель распределяется между несколькими навыками ИИ-агента. Представленный ими SkillCascade-Bench содержит 213...
