앤트로픽, Claude Opus 5 출시 — 프론티어 성능을 절반 가격에
앤트로픽이 7월 24일 Claude Opus 5를 전면 출시했다. Fable 5에 근접한 성능을 절반 가격에 제공하며, 추론 강도를 직접 조절하는 '에포트 세팅' 기능이 핵심이다.
- Anthropic
- Claude
- LLM
- 모델 출시
- AI 개발
45건의 기사
앤트로픽이 7월 24일 Claude Opus 5를 전면 출시했다. Fable 5에 근접한 성능을 절반 가격에 제공하며, 추론 강도를 직접 조절하는 '에포트 세팅' 기능이 핵심이다.
7월 28일 Model Context Protocol 2026-07-28 스펙이 출시됐다. 세션 상태를 완전히 제거하는 역대 최대 변경으로, AI 에이전트의 분산 배포와 엔터프라이즈 보안 요건을 동시에 해결한다.
LiquidAI가 CPU에서 빠른 장문맥 추론을 목표로 한 인코더 모델군 LFM2.5-Encoders를 공개했다. 임베딩·검색 등 인코더 작업을 GPU 없이 돌리려는 시도다.
OpenAI의 일부 오작동(rogue) 모델이 크리스토퍼 놀란 영화 '메멘토'의 단기기억상실 주인공처럼 맥락을 유지하지 못한 정황이 보도됐다.
구글 딥마인드가 7월 21일 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 세 모델을 한꺼번에 공개했다. 주력 모델 3.6 Flash는 출력 토큰을 최대 65% 절감하면서 코딩·멀티모달 성능을 끌어올렸다.
DeepSeek이 7월 24일 15:59 UTC를 기점으로 deepseek-chat·deepseek-reasoner 엔드포인트를 종료한다. 해당 API를 쓰는 개발자는 코드 한 줄을 바꿔 deepseek-v4-pro 또는 deepseek-v4-flash로 마이그레이션해야 한다.
구글 딥마인드가 재귀적 툴 호출 결함으로 전면 재설계에 들어갔던 Gemini 3.5 Pro를 7월 17일 출시를 목표로 준비 중이다. 2M 토큰 컨텍스트와 Deep Think 추론 레이어 탑재가 예고됐으나 공식 확인은 아직 없다.
앤트로픽이 아마존·마이크로소프트·구글과 공동으로 AI 탈옥(jailbreak)의 위험 수준을 0~4 단계로 정량화하는 'CJS 프레임워크'를 발표했다. 클로드 페이블 5 재배포 이후 업계 표준화를 위한 첫 공식 제안이다.
보안 업체 Sysdig이 7월 초 공개한 JADEPUFFER는 대형 언어 모델이 침입·이동·암호화를 자율적으로 수행한 최초의 에이전트형 랜섬웨어 사례다.
6월 출시를 놓친 Gemini 3.5 Pro가 아키텍처 전면 재설계를 마치고 7월 17일 일반 출시를 목표로 한다. 프런티어 최대 규모인 200만 토큰 컨텍스트와 Deep Think 추론이 핵심 사양이다.
CNBC 조사에 따르면 중국산 AI 모델이 미국 기업 API 토큰 사용량의 30~46%를 차지하는 것으로 나타났다. OpenAI·Anthropic 대비 60~90% 저렴한 가격이 주요 원인이다.
Meta가 에이전트 작업 특화 멀티모달 추론 모델 Muse Spark 1.1을 유료 API로 공개했다. 입력 100만 토큰당 $1.25로 Anthropic·OpenAI 대비 4분의 1 수준이다.
Meta의 슈퍼인텔리전스 총괄 Alexandr Wang이 내부 타운홀에서 훈련 중인 차세대 모델 '워터멜론'이 일부 벤치마크에서 GPT-5.5에 필적한다고 밝혔다.
OpenAI가 새 GPT-5.6 모델군이 마이크로소프트 Copilot 365의 '선호 모델'로 계속 쓰인다고 밝히며 양사 결별 관측을 반박했다.
OpenAI가 7월 9일부터 GPT-5.6 Sol·Terra·Luna를 ChatGPT 전 사용자와 API에 전면 개방했다. 예산형 Luna($1/$6)가 추가되며 프론티어 모델 접근성이 크게 확대됐다.
xAI가 7월 8일 Grok 4.5를 공개 출시했다. 1.5T V9 아키텍처 기반의 코딩·에이전트 특화 모델로, Cursor와 공동 훈련해 실제 엔지니어링 작업에서 경쟁 모델을 앞선다고 밝혔다.
Anthropic이 6월 30일 Claude Sonnet 5를 출시했다. Opus 4.8에 근접한 추론·코딩 성능을 갖추면서 입력 $2/백만 토큰이라는 공격적 가격으로 책정됐다.
OpenAI가 GPT-5.6 Sol을 Cerebras 웨이퍼 스케일 인프라에서 최대 750 tokens/s로 7월부터 서비스한다. 일반 GPU 대비 약 10배 속도로, 에이전트형 AI 워크플로의 경험을 근본적으로 바꿀 전망이다.
AI 최대 학회 ICML이 숨겨진 워터마크로 LLM 리뷰어를 탐지, 497편을 일괄 탈락시키며 학술 동료 심사의 AI 오용 문제를 수면 위로 끌어올렸다.
Anthropic이 6월 30일 Claude Sonnet 5를 공개했다. Opus 4.8에 준하는 에이전트 성능을 절반 이하 가격에 제공하며, Free·Pro 플랜의 기본 모델로 즉시 적용됐다.
xAI가 1.5조 파라미터 V9 기반 Grok 4.5를 SpaceX·Tesla 내부에 비공개 배포했다. 일론 머스크는 Claude Opus 수준 혹은 그 이상의 성능이라고 주장했지만, 공개 벤치마크는 아직 없다.
중국 음식 배달·테크 기업 메이퇀이 1.6조 파라미터 LLM 'LongCat-2.0'을 MIT 라이선스로 오픈소스 공개했다. Nvidia 없이 국산 ASIC 5만 장 이상으로 사전학습을 완료한 첫 프론티어급 모델로 주목받는다.
6월 27일 제한 프리뷰로 공개된 GPT-5.6 Sol·Terra·Luna가 7월 10~17일 사이 일반 출시될 가능성이 높다. 미국 정부 요청으로 현재는 약 20개 신뢰 파트너 기관만 접근 가능하다.
메타 수퍼인텔리전스 랩스 수장 Alexandr Wang이 사내 타운홀에서 차기 플래그십 모델 Watermelon이 GPT-5.5와 동등한 성능을 보였다고 밝혔다. 전 세대 대비 약 10배 더 많은 컴퓨팅을 투입했다.
앤트로픽이 6월 30일 Claude Sonnet 5를 공개해 Free·Pro 기본 모델로 전환했다. Opus 4.8에 근접한 성능을 제공하면서 가격은 Sonnet 수준으로 유지해 에이전트 개발 비용을 크게 낮춘다.
Anthropic이 6월 30일 Claude Sonnet 5를 공개했다. Free·Pro 플랜 기본 모델로 승격되며, Opus 4.8에 근접한 성능을 더 낮은 비용으로 제공한다.
Google이 6월 22일 Gemini 2.5 Pro Deep Think를 공개했다. GPQA Diamond 82.4%, MMLU-Pro 89.8%로 Claude Fable 5와 GPT-5.5를 제치고 과학·추론 부문 공개 모델 1위를 차지했다.
Google이 Gemini 3.5 Pro 정식 출시를 7월로 확정했다. 현존 최대 200만 토큰 컨텍스트와 고급 추론 모드 Deep Think를 탑재했으며, 현재 Vertex AI 기업 고객 한정 프리뷰 중이다.
OpenAI가 GPT-5.6 패밀리를 공개했다. 최상위 모델 Sol은 서브에이전트를 병렬 실행하는 '울트라 모드'와 최대 추론 노력(max reasoning) 모드를 탑재했으며, 미 정부 승인 파트너 약 20곳에만 제한 공개 중이다.
NVIDIA가 5,500억 파라미터 MoE 하이브리드 모델 '네모트론 3 울트라'를 오픈웨이트로 공개했다. Artificial Analysis 지능 지수 미국 오픈소스 1위(48점)를 기록했으며, 허깅페이스·NVIDIA NIM에서 상업 이용 가능한 OpenMDW-1.1 라이선스로 배포된다.
구글 I/O에서 Sundar Pichai CEO가 '다음 달 드리겠다'고 공언했던 제미나이 3.5 Pro가 6월 말을 넘기며 7월 출시로 밀렸다. 구글의 플래그십 AI 모델이 경쟁사 대비 한 달 이상 지연된 셈이다.
6월 23일부터 Claude Fable 5가 Pro·Max·Team·Enterprise 플랜 무료 사용 기간이 종료되며 크레딧 과금으로 전환된다. 새 거부(refusal) API 동작 등 개발자가 즉시 확인해야 할 변경 사항을 정리했다.
Polymarket 계약 83% 확률이 가리키는 GPT-5.6 출시 예측 윈도우가 6월 22일 열렸다. 누출된 정보에 따르면 150만 토큰 컨텍스트와 GPT-5.5 정렬 실패를 잡는 보상 감사 파이프라인이 포함될 전망이다.
xAI의 Grok 4.3이 Amazon Bedrock에 정식 출시됐다. 100만 토큰 컨텍스트, 4단계 추론 모드, 네이티브 동영상 입력을 갖추고 OpenAI·Anthropic에 맞서는 엔터프라이즈 선택지로 부상했다.
OpenAI가 이르면 6월 22~28일 GPT-5.6을 출시할 가능성이 높다는 예측이 나왔다. Polymarket 예측 시장에서 83% 확률이 배정됐고, OpenAI 수석 과학자도 GPT-5.5 대비 '의미 있는 개선'이라 언급한 것으로 알려졌다.
DeepSeek이 4월 24일 V4 Pro를 프리뷰 공개했다. 총 1.6조 파라미터(활성 490억)의 MoE 아키텍처, 100만 토큰 컨텍스트, MIT 라이선스로 SWE-bench Verified 80.6%를 달성하며 출력 토큰당 $0.87에 제공한다.
구글이 Google I/O에서 '다음 달까지' 출시를 공언한 Gemini 3.5 Pro가 6월 19일 현재 Vertex AI 일부 기업 고객 전용 프리뷰에 그치고 있다. 마감까지 11일이 남은 가운데 예측 마켓은 달성 확률을 50~55%로 보고 있다.
알리바바가 오픈소스 코딩 특화 MoE 모델 Qwen3-Coder-Next를 공개했다. 총 800억 파라미터 중 추론 시 30억만 활성화하는 초희소 구조로, 동급 밀집 모델 대비 처리량이 최대 10배 높다.
미 하원 의원들이 269페이지 분량의 포괄적 연방 AI 법안 초안을 공개했다. 주(州) AI 규제를 3년간 유예하고 연매출 5억 달러 이상 AI 기업에 구속력 있는 의무를 부과하는 내용이다.
Zhipu AI의 Z.ai가 744B 파라미터 MoE 모델 GLM-5.2를 공개했다. 실사용 100만 토큰 컨텍스트와 두 가지 사고 강도를 제공하며, 벤치마크 수치 없이 출시한 점이 이례적이다.
중국 AI 연구소 MiniMax가 6월 1일 오픈웨이트 모델 M3를 출시했다. 새로운 희소 어텐션 구조(MSA)로 100만 토큰 컨텍스트를 구현하고, SWE-Bench Pro에서 GPT-5.5를 상회하는 성능을 GPT-5.5 비용의 5~10% 수준에 제공한다.
Google I/O 2026에서 공개된 Gemini 3.5 Flash는 전년도 Pro 모델을 코딩·에이전트 벤치마크에서 앞서며, 속도는 4배, 비용은 40% 저렴하다.
OpenAI가 GPT-5.5 Instant를 ChatGPT의 새 기본 모델로 교체하고, 6월 9일부터 무료(Go·Free) 사용자에게도 개인화 기능을 개방했다. 이전 모델 대비 환각 52.5% 감소, 과거 대화·파일·Gmail 참조 가능.
메타가 오픈소스 전략을 뒤집고 첫 독점 AI 모델 Muse Spark를 공개했다. 14.3조 원을 들여 AI 스택을 전면 재구축한 결과물이다.
AIWire가 매일 업데이트되는 LLM 최신 소식 코너를 엽니다. 한국어와 영어로 핵심만 정리합니다.