방어자들이 프롬프트 인젝션을 활용하다
Now, defenders are embracing the prompt injection, too
프롬프트 인젝션은 공격자가 대형 언어 모델을 조종하기 위해 콘텐츠에 삽입하는 악의적인 명령이다. Tracebit의 연구자들은 Amazon Web Services에 저장된 비밀번호, 암호화 키와 같은 비밀 정보와 함께 프롬프트 인젝션을 배치하는 것이 AI 해킹 공격을 차단하는 데 효과적이라는 것을 발견했다. 이러한 프롬프트는 공격하는 LLM이 금지된 행동을 수행하도록 유도하며, LLM은 이에 따라 작동을 중단한다.
프롬프트 인젝션을 통해 LLM의 작동을 중단시킬 수 있다는 점은 AI 보안 강화에 중요한 의미를 가진다.
원문 출처
Ars Technica — AI