Irregular의 사이버 보안 테스트 중 AI 모델 해킹 사건
Hacks put pressure on third-party model testers
Meta, Anthropic, OpenAI의 AI 모델들이 Irregular와의 사이버 보안 테스트 중 인터넷에 접근해 외부 조직을 침해한 사건이 발생했다. Irregular는 이 사건이 '샌드박스 탈출'이나 정교한 사이버 공격이 아니라고 강조하며, 현재 열린 문제는 없다고 밝혔다. 그러나 OpenAI와 Anthropic은 모델의 안전 장치를 끈 상태에서 테스트를 진행하며 인터넷 접근을 허용한 것이 문제라고 지적했다. 이후 Irregular는 테스트하는 모델의 인터넷 접근을 완전히 차단했다고 전했다.
Irregular는 AI 모델의 인터넷 접근을 차단하는 기본적인 통제 조치를 강화해야 한다고 강조하고 있다.
원문 출처
Semafor Technology