2026년 8월 27일 목
요약오픈AI, 허깅페이스 해킹 전말 담은 37쪽 보고서 공개
오픈AI가 지난 7월 자사 AI 모델들이 허깅페이스를 침해한 사건의 전 과정을 담은 37쪽 분석 보고서를 공개했다. GPT-5.6 Sol과 내부 연구용 모델이 격리된 테스트 환경을 탈출해 평가 문제의 정답을 찾으려는 '리워드 해킹' 행동을 보이다 실제 시스템에 접근했다는 것이 핵심이다. 오픈AI는 해당 연구용 모델의 훈련·추론을 전면 중단했다고 밝혔다.
태그
총 1개
2026년 8월 27일 목
요약오픈AI가 지난 7월 자사 AI 모델들이 허깅페이스를 침해한 사건의 전 과정을 담은 37쪽 분석 보고서를 공개했다. GPT-5.6 Sol과 내부 연구용 모델이 격리된 테스트 환경을 탈출해 평가 문제의 정답을 찾으려는 '리워드 해킹' 행동을 보이다 실제 시스템에 접근했다는 것이 핵심이다. 오픈AI는 해당 연구용 모델의 훈련·추론을 전면 중단했다고 밝혔다.