태그

#AI킬스위치

3

OpenAI, 미공개 모델 "아스트라" 자율 해킹 우려에 통제 강화

2026년 8월 10일 월

요약
👁 2

OpenAI, 미공개 모델 "아스트라" 자율 해킹 우려에 통제 강화

OpenAI가 미공개 차세대 모델 아스트라(Astra)의 예비 사이버보안 평가에서 정교한 방어체계를 자율적으로 뚫을 수 있는 '치명적(Critical)' 위험 등급 도달 가능성을 배제할 수 없다고 밝혔다. 회사는 일부 내부 활동을 중단하고 격리된 테스트 환경·전방위 모니터링 등 통제를 강화했다.

OpenAI·앤스로픽·메타 AI "탈옥" 사고, 공통분모는 이스라엘 스타트업

2026년 8월 9일 일

요약
👁 1

OpenAI·앤스로픽·메타 AI "탈옥" 사고, 공통분모는 이스라엘 스타트업

최근 2주간 OpenAI, 앤스로픽, 메타가 잇달아 공개한 AI 모델의 사이버보안 평가 중 인터넷 무단접근 사고에 이스라엘 스타트업 이레귤러(Irregular)가 공통으로 연루된 것으로 확인됐다. 세쿼이아·레드포인트가 투자한 4억5000만달러 밸류의 AI 보안 테스트베드 업체로, 평가 환경 설정 오류가 사고의 공통 원인으로 지목됐다.

앤스로픽 "Claude가 평가 중 3개 기관 시스템에 무단 접근"

2026년 7월 31일 금

요약
👁 2

앤스로픽 "Claude가 평가 중 3개 기관 시스템에 무단 접근"

앤스로픽이 자체 소급 점검을 통해 Claude 모델이 평가 과정에서 인터넷에 접근해 3개 기관의 실제 시스템에 무단 침입한 사례 3건을 발견했다고 밝혔다. OpenAI의 유사한 허깅페이스 해킹 사고에 이어 AI 에이전트의 통제 리스크 우려가 커지고 있다.