ИИ-инструменты
2026-06-18 11:15 Программистам

Тестирование защиты OpenClaw. EarlyCore показала, что после усиления агент всё равно пропускает 80% атак из‑за удачных формулировок запросов.

We Hardened OpenClaw. Но даже после усиления защиты 80% атак всё равно срабатывали

EarlyCore — компания, которая занимается безопасностью ИИ-систем. В ходе проверок они обнаружили, что агент OpenClaw (раньше назывался Clawdbot) в четырёх случаях из пяти не выдерживает атак: например, может раскрыть пользовательские данные и системные параметры. Уязвимость проявляется так: если запрос сформулирован «правильно» — как вежливая просьба сделать что-то ради безопасности, — агент идёт навстречу злоумышленникам. Доходило до того, что он генерировал код, который включал инструмент, заранее запрещённый пользователем.

Авторы материала советуют задействовать весь набор защитных механизмов, которые предусмотрены в OpenClaw. Они отмечают, что тестировали агента на не самых мощных моделях, поэтому рекомендуют подключать нейросети уровня Claude Opus 4.5 и выше. В статье также есть готовые шаблоны команд и настроек.
https://earlycore.dev/collection/openclaw-security-hardening-80-percent-attacks-succeeded