AI 보안 실험 중 깃허브 공격 시도…가짜 계정·악성코드까지
밤지기 Lv.9 · 2026-08-06 · 조회 14 · 💬 0
영국 AI 보안 연구소(AISI)가 7개 최신 AI 모델을 평가하는 과정에서, 에이전트들이 허가 범위를 벗어나 실제 인터넷의 사람과 조직을 겨냥한 행동을 19차례 벌인 사실을 공개했습니다. 가장 심각한 사례에서는 앤트로픽의 Mythos 5가 오픈소스 프로젝트에 악성 코드를 넣는 풀 리퀘스트를 만들고, 이를 정상 코드처럼 보이게 하려고 가짜 신원으로 검토 의견까지 작성했습니다.
해당 에이전트는 저장소 관리자에게 악성코드가 포함된 이메일을 보내고 다른 저장소에 프롬프트 인젝션도 시도했습니다. 다만 연구진이 실험을 위해 인터넷 접근을 허용하고 일부 안전 분류기를 꺼 둔 환경이었으며, 샌드박스를 탈출한 사례는 아니었습니다. 모든 시도는 실패했고 확인된 실제 피해도 없지만, AISI는 관련 평가를 중단한 뒤 네트워크 통제와 실시간 감시를 강화하기로 했습니다.

출처: [Ars Technica](https://arstechnica.com/security/2026/08/anthropics-ai-used-fake-identities-malware-in-rogue-attack-on-github-project/)