Ваш AI-помічник став хакером: атака Friendly Fire вже тут
Дослідники з AI Now Institute довели, що давати Claude Code або OpenAI Codex надто багато волі — це як довірити мавпі з гранатою аудит вашого коду. Автономність стала ідеальним майданчиком для розповсюдження вірусів.
Атака Friendly Fire базується на сліпій довірі автономних агентів до зовнішньої документації. Коли розробник доручає Claude Code або OpenAI Codex перевірити проєкт, модель аналізує вміст репозиторію. Зловмиснику достатньо додати в README.md безневинну інструкцію, яка видає себе за скрипт security.sh для перевірки безпеки.
Як тільки агент вирішує, що запуск цього файлу є частиною процесу аудиту, він виконує команду без жодного підтвердження від людини. Скрипт непомітно завантажує та запускає шкідливий бінарний файл прямо на комп'ютері розробника. Це не помилка в конкретній версії софту, а архітектурна вразливість, де права на виконання команд надаються недовіреному зовнішньому коду.
Автори дослідження наголошують, що оновленнями тут не зарадиш: проблема полягає в самому сценарії, де агент має дозвіл на самостійне виконання команд. Вразливість проявляється лише в режимах «auto-mode» або «auto-review», тоді як ручне керування повністю нівелює загрозу. Це продовжує серію атак, таких як TrustFall або Agentjacking, демонструючи, що процес автоматизації став головним об'єктом хакерських атак.
Давати коду право «самостійно себе лікувати» — це, звісно, мрія для ледачих, але на практиці це перетворюється на безкоштовний сервіс доставки вірусів для будь-якого хакера з доступом до GitHub. Можливо, час нарешті зрозуміти, що довіряти алгоритму, який ще вчора вигадував галюцинації в коді, — це не «інновація», а найкоротший шлях до повного краху безпеки системи.
Джерело: AI Now Institute
Коментарі
Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.