해커들이 Claude Opus를 이용해 OpenAI 직원 계정 해킹
Security researchers used Claude to help them hack into OpenAI
Hacktron의 독립 보안 연구팀이 Anthropic의 Claude Opus 4.8과 5를 사용하여 OpenAI 직원 계정에 해킹하는 데 72시간도 걸리지 않았다고 보도됐다. 이들은 OpenAI의 GitHub 저장소인 'Monorepo'에 접근할 수 있었으며, 이곳에는 OpenAI의 알고리즘 비밀이 포함되어 있다고 전해진다. 내부 코드는 직접 접근하지 않았지만, 직원의 Codex 계정에서 풀 리퀘스트를 보내 접근을 증명했다. 해킹 경로는 OpenAI 커뮤니티를 호스팅하는 제3자 서비스인 Discourse를 통해 이루어졌다.
Claude Opus 4.8과 5를 사용하여 OpenAI의 GitHub 저장소에 접근한 사례는 AI 도구의 보안 취약점을 드러낸다.
원문 출처
The Verge — AI