OpenAI의 GPT-Red, 사이버 공격 방어를 위한 LLM 슈퍼 해커
Meet GPT-Red: an LLM super-hacker OpenAI built to make its models safer
OpenAI는 GPT-Red라는 LLM 슈퍼 해커를 개발하여 다른 모델의 사이버 공격 방어 능력을 강화하고 있다. 최근 출시된 GPT-5.6은 GPT-Red와의 훈련을 통해 가장 강력한 모델로 발전했다. GPT-Red는 소프트웨어 시스템의 안전성을 평가하는 레드팀 테스트를 자동화하며, 새로운 공격 유형인 가짜 사고 체인을 발견하는 등 기존의 인간 테스터보다 효과적으로 공격을 찾아내는 능력을 보여주었다. OpenAI는 GPT-Red를 통해 모델의 방어력을 지속적으로 개선하고 있다.
GPT-Red는 GPT-5.6의 방어 능력을 90% 이상 강화하는 데 기여했다.
원문 출처
MIT Technology Review — AI