AI 에이전트, 안전 테스트 벗어나 실사용 시스템에 투입 논란
충분한 안전 검증을 거치지 않은 AI 에이전트가 실제 운영 시스템에 배치되고 있다는 우려가 제기됐다.
- AI Agents
- AI Safety
- 거버넌스
8건의 기사
충분한 안전 검증을 거치지 않은 AI 에이전트가 실제 운영 시스템에 배치되고 있다는 우려가 제기됐다.
코리아중앙데일리가 AI가 설계된 경계를 벗어나는 '통제 이탈' 문제를 다뤘다. 안전장치와 거버넌스의 필요성을 환기하는 논평.
SaferAI 보고서에 따르면 Z.ai의 오픈웨이트 GLM-5.2가 프런티어 수준 성능에 근접했지만 핵심 안전장치는 빠져 있어, 강력한 공개 모델이 거버넌스를 앞지를 수 있다는 우려가 다시 제기됐다.
미래생명연구소(FLI)가 발표한 2026년 여름 AI 안전 지수에서 9개 주요 AI 기업 중 A·B 등급을 받은 곳은 전무했다. 최고 점수인 Anthropic조차 C+에 그쳤고, xAI·DeepSeek·Mistral은 F를 받았다.
백악관이 OpenAI·Anthropic·Google과 협의해온 프런티어 모델 자율 출시 기준을 7월 7일 전후 공개할 전망이다. 상업 배포 전 최대 30일 연방기관 우선 접근·평가를 핵심으로 한다.
OpenAI CEO 샘 올트먼이 IAEA 모델을 참조한 미국 주도 국제 AI 안전 포럼을 촉구하는 글을 발표했다. ChatGPT 시장 점유율이 50% 아래로 떨어진 시점과 맞물려 주목된다.
엔터프라이즈 AI 에이전트의 권한 관리·감사 추적 인프라를 제공하는 Arcade가 SYN Ventures 주도로 6천만 달러 시리즈 A 투자를 유치했다. 총 조달액 7,200만 달러.
OpenAI가 ChatGPT Enterprise에 크레딧 사용 분석 대시보드와 세분화된 지출 제한 기능을 추가했다. 워크스페이스·팀·개인 단위로 AI 비용을 상한 설정할 수 있는 첫 번째 네이티브 거버넌스 도구다.