HuggingFace, 자율 AI 공격에 대한 보안 사고 보고
HuggingFace security incident report: "the attacker was bound by no usage policy, while our own forensic work was blocked by the guardrails"
HuggingFace는 자사의 생산 인프라에 대한 침입을 감지하고 대응했다. 이번 공격은 자율 AI 에이전트 시스템에 의해 주도되었으며, AI를 통해 탐지 및 분석이 이루어졌다. 공격은 AI 지원 탐지를 통해 처음 발견되었고, LLM 기반의 이상 탐지 파이프라인이 보안 텔레메트리에서 신호를 구분하여 침해를 알렸다. 로그 분석 과정에서는 상업적 API의 최전선 모델이 차단되어, GLM 5.2라는 오픈 웨이트 모델을 사용하여 자체 인프라에서 포렌식 분석을 수행했다.
GLM 5.2와 같은 오픈 웨이트 모델을 사용함으로써 공격자 데이터가 외부로 유출되지 않았다.
원문 출처
r/LocalLLaMA