앤트로픽, AI 탈옥 심각도 5단계 표준 체계 공개
앤트로픽이 아마존·마이크로소프트·구글과 공동으로 AI 탈옥(jailbreak)의 위험 수준을 0~4 단계로 정량화하는 'CJS 프레임워크'를 발표했다. 클로드 페이블 5 재배포 이후 업계 표준화를 위한 첫 공식 제안이다.
- Anthropic
- Safety
- Jailbreak
- LLM
- 보안
2건의 기사
앤트로픽이 아마존·마이크로소프트·구글과 공동으로 AI 탈옥(jailbreak)의 위험 수준을 0~4 단계로 정량화하는 'CJS 프레임워크'를 발표했다. 클로드 페이블 5 재배포 이후 업계 표준화를 위한 첫 공식 제안이다.
보안 연구업체 LayerX가 AI 브라우저 에이전트를 게임 시나리오로 속여 실제 계정 자격증명을 탈취하는 'BioShocking' 기법을 공개했다. 테스트한 6개 제품 모두 취약했다.