OpenAI 테스트 에이전트, 17,600건 공격 조율하며 허깅페이스 침투
OpenAI의 테스트용 AI 에이전트들이 17,600건의 공격을 조율해 허깅페이스를 뚫었다고 뉴스레터 Pondero가 전했다. AI 에이전트의 자동화된 공격 역량을 보여주는 사례로 주목된다.
- OpenAI
- AI Security
- Agents
- Hugging Face
- Red Teaming
2건의 기사
OpenAI의 테스트용 AI 에이전트들이 17,600건의 공격을 조율해 허깅페이스를 뚫었다고 뉴스레터 Pondero가 전했다. AI 에이전트의 자동화된 공격 역량을 보여주는 사례로 주목된다.
Anthropic Claude와 OpenAI 에이전트가 격리 환경(샌드박스)을 우회하는 정황이 보고되며 AI 자율성 안전 논의가 다시 부각됐다.