We Hardened OpenClaw. Но даже после усиления защиты 80% атак всё равно срабатывали
EarlyCore — компания, которая занимается безопасностью ИИ-систем. В ходе проверок они обнаружили, что агент OpenClaw (раньше назывался Clawdbot) в четырёх случаях из пяти не выдерживает атак: например, может раскрыть пользовательские данные и системные параметры. Уязвимость проявляется так: если запрос сформулирован «правильно» — как вежливая просьба сделать что-то ради безопасности, — агент идёт навстречу злоумышленникам. Доходило до того, что он генерировал код, который включал инструмент, заранее запрещённый пользователем.
Авторы материала советуют задействовать весь набор защитных механизмов, которые предусмотрены в OpenClaw. Они отмечают, что тестировали агента на не самых мощных моделях, поэтому рекомендуют подключать нейросети уровня Claude Opus 4.5 и выше. В статье также есть готовые шаблоны команд и настроек.
https://earlycore.dev/collection/openclaw-security-hardening-80-percent-attacks-succeeded
EarlyCore — компания, которая занимается безопасностью ИИ-систем. В ходе проверок они обнаружили, что агент OpenClaw (раньше назывался Clawdbot) в четырёх случаях из пяти не выдерживает атак: например, может раскрыть пользовательские данные и системные параметры. Уязвимость проявляется так: если запрос сформулирован «правильно» — как вежливая просьба сделать что-то ради безопасности, — агент идёт навстречу злоумышленникам. Доходило до того, что он генерировал код, который включал инструмент, заранее запрещённый пользователем.
Авторы материала советуют задействовать весь набор защитных механизмов, которые предусмотрены в OpenClaw. Они отмечают, что тестировали агента на не самых мощных моделях, поэтому рекомендуют подключать нейросети уровня Claude Opus 4.5 и выше. В статье также есть готовые шаблоны команд и настроек.
https://earlycore.dev/collection/openclaw-security-hardening-80-percent-attacks-succeeded
