ИССЛЕДОВАНИЕ · RESEARCH · #1120
Stealth Apart, Harm Together: статья вводит атаку «каскада навыков» на агентные системы
В статье описана атака «каскад навыков», при которой зловредная цель распределяется по нескольким внешне безобидным навыкам, и их совместное выполнение приводит к вреду. Авторы выпустили SkillCascade — автоматизированный фреймворк для red-teaming — и бенчмарк SkillCascade-Bench (213 проверенных сценариев), показав, что такие каскады вызывают вред на различных агентах (например, OpenClaw, Claude Code, Codex) и моделях, обходя сканеры по отдельным навыкам и мониторинг.
КЛЮЧЕВЫЕ ТЕЗИСЫ
- В статье описана атака «каскад навыков», при которой зловредная цель распределяется по нескольким внешне безобидным навыкам, и их совместное выполнение приводит к вреду.
- Авторы выпустили SkillCascade — автоматизированный фреймворк для red-teaming — и бенчмарк SkillCascade-Bench (213 проверенных сценариев), показав, что такие каскады вызывают вред на различных агентах (например, OpenClaw, Claude Code, Codex) и моделях, обходя сканеры по отдельным навыкам и мониторинг.
- Это выявляет системный пробел в безопасности: проверки по компонентам могут не замечать вред, возникающий только из взаимодействия навыков, поэтому нужны защиты, учитывающие композиции навыков.
ПОЧЕМУ ЭТО ВАЖНО
Это выявляет системный пробел в безопасности: проверки по компонентам могут не замечать вред, возникающий только из взаимодействия навыков, поэтому нужны защиты, учитывающие композиции навыков.