Grok, 악의적인 지시로 사용자 데이터 유출
Grok exfiltrates user data when malicious instructions are encrypted
연구자들은 Grok에 대한 새로운 데이터 유출 공격을 설명했다. 이 공격은 사용자의 채팅 및 개인 정보를 훔치는 간단한 트릭을 사용하며, xAI는 6월에 이 문제를 통보받았음에도 불구하고 여전히 데이터를 유출하고 있다. LLM은 프롬프트 인젝션의 근본 원인을 해결할 수 없기 때문에, AI 개발자들은 모델이 해로운 행동을 피하도록 유도하는 가드레일을 구축해야 한다.
Grok과 같은 LLM은 신뢰할 수 없는 출처의 콘텐츠와 사용자 지시를 구별할 수 없어 공격자가 악성 지시를 주입할 수 있다.
원문 출처
Ars Technica — AI