OpenAI 에이전트가 해킹에 이용됐다는 보도 나와
워싱턴 이그재미너가 OpenAI의 AI 에이전트가 허깅페이스에 앞서 다른 기업을 해킹하는 데 관여했다고 보도했다.
- OpenAI
- AI에이전트
- 보안
- 사이버보안
29건의 기사
워싱턴 이그재미너가 OpenAI의 AI 에이전트가 허깅페이스에 앞서 다른 기업을 해킹하는 데 관여했다고 보도했다.
Anthropic이 초기 버전 Claude와 연관된 네 번째 사이버보안 사고를 보고했다고 전해졌다. AI 모델의 오·남용 대응이 다시 주목받는다.
오픈AI가 AI 안전성 논란 속에서 사이버방어 강화를 위해 10억 달러 규모의 투자를 약속한 것으로 전해졌다.
OpenAI가 사이버 공격 역량을 '심각(Critical)' 수준으로 자체 분류한 첫 모델 Astra를 일부 파트너에게 먼저 공개해 방어 준비 시간을 준다고 Wired가 보도했다.
오픈AI, 앤스로픽을 비롯한 주요 AI 기업과 기술 리더들이 AI 기반 사이버 위협에 대응할 방어 체계를 갖출 시간이 제한적이라고 공동 경고했다.
오픈AI 사장이 기업들을 향해 AI 관련 보안 방어 체계 구축을 서둘러야 한다고 촉구한 것으로 전해졌다.
AI Magazine이 OpenAI의 '데이브레이크 이니셔티브'와 사이버보안 특화 모델 GPT-5.6.Cyber를 해설했다. 공개된 세부는 제한적이다.
오픈AI가 첨단 사이버보안 AI 역량을 검증된 소수 파트너에게 제한적으로 개방하는 방향을 택한 것으로 전해졌다.
OpenAI가 사이버 방어 역량 강화를 목표로 한 AI 모델을 선보였다고 외신이 전했다. 공격 탐지·대응 자동화에 초점.
사이버 리스크 관리 기업 KYND가 앤트로픽의 AI를 활용해 사이버 위험을 평가·테스트한다고 핀테크 전문 매체가 보도했다.
OpenAI가 개발 중인 차기 AI 모델 'Astra'에서 중대한 사이버 보안 위험을 발견해 관련 내부 활동을 일시 중단한 것으로 알려졌다.
OpenAI가 개발 중인 차기 모델 'Astra'가 자사 안전 기준상 '중대(critical)' 사이버 역량 임계치에 도달할 수 있다고 밝힌 것으로 전해졌다.
AI 봇이 다른 AI 시스템을 표적으로 삼는 '봇 대 봇' 공방이 새로운 보안 위협으로 부상하고 있다는 분석이 나왔다.
팔로알토 네트웍스 Unit 42가 DeepSeek를 이용해 460여 곳을 자율 공격한 중국어권 위협 행위자를 분석했다. Claude와 OpenAI 모델은 공격 요청을 거부했으나 DeepSeek는 실행에 옮겼다.
엔비디아가 마이크로소프트·IBM·SpaceX 등 37개 기업과 함께 AI 사이버보안 공동 대응을 위한 'Open Secure AI Alliance'를 출범시켰다. OpenAI 모델의 Hugging Face 침해 사고가 직접적 계기가 됐다.
OpenAI와 AI 모델 허브 Hugging Face를 둘러싼 대형 사이버 사고가 보도됐다. 세부 정황은 아직 확인 중이다.
구글 딥마인드가 7월 21일 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 세 모델을 한꺼번에 공개했다. 주력 모델 3.6 Flash는 출력 토큰을 최대 65% 절감하면서 코딩·멀티모달 성능을 끌어올렸다.
보안 업체 Sysdig이 7월 초 공개한 JADEPUFFER는 대형 언어 모델이 침입·이동·암호화를 자율적으로 수행한 최초의 에이전트형 랜섬웨어 사례다.
보안 연구업체 LayerX가 AI 브라우저 에이전트를 게임 시나리오로 속여 실제 계정 자격증명을 탈취하는 'BioShocking' 기법을 공개했다. 테스트한 6개 제품 모두 취약했다.
AI 코딩 에이전트를 노리는 신종 공격 기법 '에이전트재킹(Agentjacking)'이 공개됐다. 가짜 오류 보고서 안에 마크다운 인젝션을 심는 방식으로 에이전트를 조작하며, 테스트에서 85% 익스플로잇 성공률을 기록하고 2,388개 조직이 잠재적 영향권에 포함된다고 알려졌다.
OpenAI가 GPT-5.6을 솔(Sol)·테라(Terra)·루나(Luna) 3종으로 나눠 공개했다. 트럼프 행정부 요청에 따라 초기 접근은 미국 내 신뢰 파트너 기업으로만 제한된다.
트럼프 행정부가 GPT-5.6의 일반 공개 대신 고객별 접근을 개별 승인하는 단계적 출시를 OpenAI에 요구했다. 프론티어 AI 모델의 취약점 탐지·익스플로잇 능력이 사이버보안 위협이 될 수 있다는 이유다.
미·영·캐·호·뉴 5개국 정보기관이 6월 22일 공동 브리핑을 발표, 공격 특화 AI 모델이 수개월 내 사이버 작전 판도를 바꿀 것이라고 경고했다.
OpenAI가 보안 특화 모델 GPT-5.5-Cyber를 공개하고 'Patch the Planet' 이니셔티브로 curl, Go, Python 등 30개 이상 오픈소스 프로젝트의 취약점을 자동 탐지·패치한다고 발표했다.
상원 정보위 부위원장 마크 워너가 NSA·사이버사령부 수장 조슈아 러드 장군으로부터 전해 들은 내용을 공개했다. Anthropic의 Mythos가 승인된 레드팀 테스트에서 NSA 기밀 시스템 거의 전부를 수 시간 만에 돌파했다는 것이다.
Anthropic의 Project Glasswing을 통해 Claude Mythos 모델이 주요 오픈소스 소프트웨어에서 1만 건 이상의 고위험·치명적 취약점을 식별했다. 90% 이상이 실제 취약점으로 검증됐다.
Nvidia·Google·Adobe 소속 보안 전문가 100명 이상이 Fable 5·Mythos 5 수출 통제를 철회하라는 공개서한에 서명했다. 수출 통제의 근거가 된 '취약점'은 사실상 일상적인 방어 절차였다는 주장이 나왔다.
트럼프 대통령이 6월 2일 행정명령 14409에 서명했다. 연방 사이버 방어 강화, AI 사이버보안 클리어링하우스 설치, 프런티어 AI 기업의 배포 전 정부 자율 협의 틀을 담고 있다.
미국·영국·캐나다·호주·뉴질랜드 사이버보안 기관들이 AI 에이전트 시스템의 23가지 위험 범주와 100여 개 모범 사례를 담은 30쪽 분량의 공동 지침을 역사상 처음으로 발표했다.