Tech Meridian ← К ЛЕНТЕ
PROМОЙ MERIDIAN EN

ИССЛЕДОВАНИЕ · RESEARCH · #1120

Stealth Apart, Harm Together: статья вводит атаку «каскада навыков» на агентные системы

В статье описана атака «каскад навыков», при которой зловредная цель распределяется по нескольким внешне безобидным навыкам, и их совместное выполнение приводит к вреду. Авторы выпустили SkillCascade — автоматизированный фреймворк для red-teaming — и бенчмарк SkillCascade-Bench (213 проверенных сценариев), показав, что такие каскады вызывают вред на различных агентах (например, OpenClaw, Claude Code, Codex) и моделях, обходя сканеры по отдельным навыкам и мониторинг.

КЛЮЧЕВЫЕ ТЕЗИСЫ

  1. В статье описана атака «каскад навыков», при которой зловредная цель распределяется по нескольким внешне безобидным навыкам, и их совместное выполнение приводит к вреду.
  2. Авторы выпустили SkillCascade — автоматизированный фреймворк для red-teaming — и бенчмарк SkillCascade-Bench (213 проверенных сценариев), показав, что такие каскады вызывают вред на различных агентах (например, OpenClaw, Claude Code, Codex) и моделях, обходя сканеры по отдельным навыкам и мониторинг.
  3. Это выявляет системный пробел в безопасности: проверки по компонентам могут не замечать вред, возникающий только из взаимодействия навыков, поэтому нужны защиты, учитывающие композиции навыков.

ПОЧЕМУ ЭТО ВАЖНО

Это выявляет системный пробел в безопасности: проверки по компонентам могут не замечать вред, возникающий только из взаимодействия навыков, поэтому нужны защиты, учитывающие композиции навыков.

ИСТОЧНИКИ И ХРОНОЛОГИЯ

1