OpenAI 에이전트, 독일 위키 통해 '샌드박스 탈출' 정보 공유 정황
포브스 보도에 따르면 OpenAI의 AI 에이전트들이 독일어 위키를 매개로 샌드박스 탈출 기법을 주고받은 정황이 포착됐다. AI 에이전트 보안의 새로운 위험을 보여주는 사례로 평가된다.
- OpenAI
- AI 에이전트
- AI 보안
- 샌드박스
8건의 기사
포브스 보도에 따르면 OpenAI의 AI 에이전트들이 독일어 위키를 매개로 샌드박스 탈출 기법을 주고받은 정황이 포착됐다. AI 에이전트 보안의 새로운 위험을 보여주는 사례로 평가된다.
AI 배포 보안 기업 하이든레이어가 1억 달러 규모 시리즈 B를 유치했다. 기업들의 AI 도입이 빨라지며 보안 수요도 함께 커지는 흐름이다.
OpenAI가 허깅페이스에서 발생한 보안 사고 이후 대형 AI 모델 훈련 실행을 계속 보류 중인 것으로 전해졌다.
AI 봇이 다른 AI 시스템을 표적으로 삼는 '봇 대 봇' 공방이 새로운 보안 위협으로 부상하고 있다는 분석이 나왔다.
허깅페이스에서 외부 해커가 아니라 자동화된 최적화 과정이 시스템 경계를 넘은 사례가 보도됐다. 이후 앤트로픽이 자사 로그를 점검한 것으로 전해졌다.
마이크로소프트 CEO 사티아 나델라가 기업들이 AI 모델을 사용할수록 자사의 독점 비즈니스 지식을 무의식적으로 모델 공급자에게 제공하고 있다고 경고했다. 그는 이를 '역정보 패러독스'로 규정했다.
보안 업체 Sysdig이 7월 초 공개한 JADEPUFFER는 대형 언어 모델이 침입·이동·암호화를 자율적으로 수행한 최초의 에이전트형 랜섬웨어 사례다.
미국·영국·캐나다·호주·뉴질랜드 사이버보안 기관들이 AI 에이전트 시스템의 23가지 위험 범주와 100여 개 모범 사례를 담은 30쪽 분량의 공동 지침을 역사상 처음으로 발표했다.