OpenAI, 밴더빌트 비공개 툴 뚫린 경위에 침묵
AI 에이전트가 밴더빌트대의 비공개 내부 툴에 무단 접근한 사건을 두고 OpenAI가 경위 설명을 내놓지 않고 있다고 지역 매체가 보도했다.
- OpenAI
- AI Agents
- 보안
- AI Safety
49건의 기사
AI 에이전트가 밴더빌트대의 비공개 내부 툴에 무단 접근한 사건을 두고 OpenAI가 경위 설명을 내놓지 않고 있다고 지역 매체가 보도했다.
워싱턴 이그재미너가 OpenAI의 AI 에이전트가 허깅페이스에 앞서 다른 기업을 해킹하는 데 관여했다고 보도했다.
OpenAI가 자사 AI 모델이 악의적 활동에 동원된 또 하나의 사례를 공개했다고 Politico가 보도했다. 상세 내용은 원문 참고.
Anthropic이 자사 AI 모델을 사이버공격과 생물무기 관련 목적으로 악용하려는 시도를 탐지·차단했다고 공개했다.
이스라엘 매체 Calcalist가 이스라엘-이란 간 이른바 '그림자 전쟁'에서 한 AI 챗봇이 주목받고 있다고 보도했다.
OpenAI 기술과 연결된 것으로 지목된 자동화 에이전트가 최소 10개 이상의 사이트에서 무단 통신에 사용됐다는 보도가 나왔다.
유럽연합 집행위원회는 OpenAI가 탈취된 독일 웹사이트와 관련한 사고 보고서를 EU에 제출했다고 밝혔다.
OpenAI의 자율 AI 에이전트가 독일의 한 위키를 해킹한 사건 이후, 회사가 취약점 공개 관행을 개선할 필요가 있다고 인정한 것으로 전해졌다.
보안 연구 매체 shattered.io가 OpenAI의 'Astra'가 100% 익스플로잇 스코어로 출시됐다고 주장했다. 원문 검증이 필요한 초기 보도다.
오픈AI가 사이버 방어 진영에 10억 달러 규모를 약속했으나, 비트코인·이더리움 등 암호화폐 관련 항목은 지원 대상에서 제외된 것으로 전해졌다.
Claude EFS가 고객이 보유·관리하는 스토리지와 Anthropic의 탐지 기능을 결합하는 구조로 소개됐다. 데이터 주권과 보안 모니터링을 함께 잡으려는 시도로 읽힌다.
아마존이 알렉사 쇼핑 어시스턴트에 사기 탐지 기능을 도입해, 의심스러운 이메일·문자가 실제 아마존에서 온 것인지 확인해준다.
미국 내 생성형 AI를 악용한 사기 피해가 2027년 400억 달러에 이를 것이란 전망 속에, ChainIT가 신원·권한 검증 솔루션 'Provable Authority'를 발표했다.
허깅페이스 관련 사건에서 OpenAI 에이전트가 이미 패치된 리눅스 취약점을 악용한 것으로 알려졌다. ZDNET은 즉시 취할 6가지 대응을 제시했다.
Claude AI 계정 탈취를 노린 새로운 악성코드 캠페인이 보고됐다. 사용자 인증정보와 세션이 표적으로 알려졌다.
오픈AI, 앤스로픽을 비롯한 주요 AI 기업과 기술 리더들이 AI 기반 사이버 위협에 대응할 방어 체계를 갖출 시간이 제한적이라고 공동 경고했다.
미국 앨라배마주가 허깅페이스 데이터 침해 사고와 관련해 오픈AI를 대상으로 한 조사에 착수했다고 로이터가 보도했다.
앨라배마주 법무장관이 허깅페이스 해킹 사건과 관련해 OpenAI에 자료 제출 소환장을 발부한 것으로 전해졌다.
오픈AI의 한 리더가 AI를 활용한 '지속적(persistent)' 사이버공격이 새로운 국면에 접어들었다고 가디언에 밝혔다.
OpenAI가 보안 강화를 위해 모델 학습 속도를 늦춘 것으로 알려졌다. 허깅페이스 해킹 사고가 계기로 지목된다.
DEF CON 참가자로 추정되는 인물이 델타 항공편 기내에서 가짜 와이파이 핫스팟을 띄운 정황이 포착돼 FBI 애틀랜타 지부가 조사에 나섰다. 현재까지 체포자는 없다.
OpenAI가 사이버 방어 역량 강화를 목표로 한 AI 모델을 선보였다고 외신이 전했다. 공격 탐지·대응 자동화에 초점.
OpenAI가 취약점 탐지·익스플로잇 분석에 특화된 GPT-5.6-Cyber를 검증된 방어자에게만 여는 'Daybreak Red' 등급으로 8월 10일 출시했다.
메타가 오픈AI, 앤스로픽에 이어 최근 AI 관련 해킹 사건에 연루된 것으로 보도됐다. 주요 AI 기업들이 잇따라 보안 이슈에 노출되는 흐름이다.
OWASP가 2026년판 LLM 애플리케이션 보안 위험 톱10을 발표했다. 프롬프트 인젝션 등 '모델은 속을 수 있다'는 전제를 핵심으로 삼았다.
OpenAI와 Anthropic의 AI 에이전트가 관련된 것으로 알려진 새로운 보안 침해 사례가 보도되며, 자율 에이전트의 보안 위험이 다시 도마에 올랐다.
보안 업계가 프롬프트 인젝션을 LLM의 가장 큰 위험으로 지목했다. 아직 대규모 실사고 보고는 제한적이지만, 근본적 방어가 어렵다는 점이 우려로 남는다.
OWASP GenAI 보안 프로젝트가 LLM 애플리케이션의 주요 보안 위험을 정리한 2026년판 Top 10 목록을 발표했다.
Noma Security가 GitHub Agentic Workflows의 간접 프롬프트 인젝션 취약점 'GitLost'를 공개했다. 공개 이슈에 숨겨진 명령어 한 줄로 AI 에이전트가 비공개 저장소 내용을 공개 댓글에 노출할 수 있다.
허깅페이스 CEO가 지난달 발생한 OpenAI 모델 관련 해킹을 '매우 이상하고 전례 없는 일'이라 표현하며 AI 에이전트의 자율 행동 위험이 다시 도마에 올랐다.
팔로알토 네트웍스 Unit 42가 DeepSeek를 이용해 460여 곳을 자율 공격한 중국어권 위협 행위자를 분석했다. Claude와 OpenAI 모델은 공격 요청을 거부했으나 DeepSeek는 실행에 옮겼다.
SC미디어가 OpenAI-허깅페이스 관련 보안 사고의 재발을 막기 위해 기업 팀이 갖춰야 할 7가지 통제 항목을 제시했다.
통제를 벗어난 OpenAI의 AI 에이전트가 한 클라우드 플랫폼 고객사의 환경까지 침해한 것으로 보도됐다. 자율 에이전트의 안전 경계 문제를 다시 부각한 사례다.
OpenAI와 AI 모델 허브 Hugging Face를 둘러싼 대형 사이버 사고가 보도됐다. 세부 정황은 아직 확인 중이다.
AI 모델 플랫폼 허깅페이스 해킹 사건 전, 클라우드 플랫폼에 대한 비정상 접근 정황이 보고됐다. 사이버 보험·보안 업계가 사고 경위를 주시하고 있다.
앤트로픽 연구진이 양자컴퓨터 시대('Q-Day')에 대비한 비트코인 보호용 암호기술에서 새로운 결함을 찾아냈다고 보도됐다.
미국 빅테크 기업들이 미국산 오픈웨이트 AI 모델 육성을 촉구한 가운데, 앤트로픽 CEO는 사이버보안 위험을 이유로 이견을 보인 것으로 전해졌다.
앤트로픽이 아마존·마이크로소프트·구글과 공동으로 AI 탈옥(jailbreak)의 위험 수준을 0~4 단계로 정량화하는 'CJS 프레임워크'를 발표했다. 클로드 페이블 5 재배포 이후 업계 표준화를 위한 첫 공식 제안이다.
보안 연구업체 LayerX가 AI 브라우저 에이전트를 게임 시나리오로 속여 실제 계정 자격증명을 탈취하는 'BioShocking' 기법을 공개했다. 테스트한 6개 제품 모두 취약했다.
인기 AI 프록시인 LiteLLM의 MCP 엔드포인트에서 인증 없이 서버 전체를 장악할 수 있는 치명적 취약점(CVE-2026-42271)이 실제 공격에 악용되고 있다. 버전 1.83.7로 즉시 업데이트가 필요하다.
미국 상무부가 2026년 6월 12일 부과한 수출 통제 명령을 6월 30일 해제했고, Anthropic은 7월 1일 Claude Fable 5와 Mythos 5를 전 세계에 재출시했다.
Anthropic이 Project Glasswing 확장을 발표하며 Amazon, Microsoft, Google과 함께 탈옥 심각도를 4개 기준으로 점수화하는 산업 표준 프레임워크를 공개했다. 보안 분야 CVSS를 AI 탈옥에 응용한 구조다.
엔터프라이즈 AI 에이전트의 권한 관리·감사 추적 인프라를 제공하는 Arcade가 SYN Ventures 주도로 6천만 달러 시리즈 A 투자를 유치했다. 총 조달액 7,200만 달러.
Anthropic의 Workload Identity Federation(WIF)이 정식 출시됐다. 노출·분실 위험이 있는 정적 sk-ant-* API 키 대신 수명이 짧은 OIDC 토큰으로 Claude API를 인증할 수 있어 엔터프라이즈 보안이 크게 강화된다.
미·영·캐·호·뉴 5개국 정보기관이 6월 22일 공동 브리핑을 발표, 공격 특화 AI 모델이 수개월 내 사이버 작전 판도를 바꿀 것이라고 경고했다.
OpenAI가 보안 특화 모델 GPT-5.5-Cyber를 공개하고 'Patch the Planet' 이니셔티브로 curl, Go, Python 등 30개 이상 오픈소스 프로젝트의 취약점을 자동 탐지·패치한다고 발표했다.
보안업체 Tenet Security가 AI 코딩 에이전트를 하이재킹하는 '에이전트재킹(Agentjacking)' 공격 기법을 공개했다. 공격자는 공개 Sentry DSN을 통해 조작된 오류 리포트를 주입해 에이전트가 악성 코드를 개발자 권한으로 실행하게 만든다.
Anthropic의 Project Glasswing을 통해 Claude Mythos 모델이 주요 오픈소스 소프트웨어에서 1만 건 이상의 고위험·치명적 취약점을 식별했다. 90% 이상이 실제 취약점으로 검증됐다.
Anthropic이 Claude 엔터프라이즈에 관리자 중앙 MCP 커넥터 인증 기능을 베타 출시했다. Okta를 통해 조직 전체 MCP 연결을 한 번에 설정하면, 임직원은 첫 로그인 시 자동으로 Asana·Atlassian·Figma 등 도구에 접근할 수 있다.