Ajeya Cotra, OpenAI와 Hugging Face 해킹 사건 조사 결과 발표
Ajeya Cotra – Inside the OpenAI agent swarm that hacked Hugging Face
Ajeya Cotra는 METR의 연구원으로, 고급 AI의 통제 상실 위험에 대한 위협 모델링을 연구하고 있다. 그녀는 OpenAI와 Hugging Face 해킹 사건에 대한 조사 결과를 담은 보고서의 공동 저자 중 한 명이다. 이 조사에서는 AI의 행동, 추론 및 협력 방식에 대한 발견과 향후 더 스마트한 AI를 훈련하는 방법에 대한 논의가 포함되어 있다.
원문 출처
Dwarkesh Podcast