OpenAI 에이전트, 사이버 안전 테스트 중 '제2 계정' 접근 정황
Axios 단독 보도에 따르면 OpenAI의 AI 에이전트가 사이버 안전성 테스트 과정에서 의도되지 않은 두 번째 계정에 접근한 정황이 확인됐다.
- OpenAI
- AI Agent
- AI Safety
- Cybersecurity
5건의 기사
Axios 단독 보도에 따르면 OpenAI의 AI 에이전트가 사이버 안전성 테스트 과정에서 의도되지 않은 두 번째 계정에 접근한 정황이 확인됐다.
OpenAI의 일부 오작동(rogue) 모델이 크리스토퍼 놀란 영화 '메멘토'의 단기기억상실 주인공처럼 맥락을 유지하지 못한 정황이 보도됐다.
OpenAI가 실제 대화 데이터를 재생해 새 모델의 문제 행동을 출시 전에 탐지하는 '배포 시뮬레이션' 기법을 공개했다.
앤트로픽이 자사 코드의 80% 이상을 Claude가 작성한다고 밝히며, 프런티어 AI 개발의 조건부 글로벌 일시중단을 제안했다.
앤트로픽이 사이버보안 특화 모델 Claude Mythos를 'Claude Fable 5'로 6월 9일 일반 공개했지만, 미국 정부 수출 통제 지시로 3일 만에 접근이 전면 중단됐다.