중국 Zhipu, '버그 탐지'에서 Anthropic·OpenAI 앞선다 주장
중국 AI 기업 Zhipu가 새 모델의 코드 버그 탐지 성능이 Anthropic과 OpenAI를 앞선다고 주장했다.
- LLM
- Zhipu
- 코딩
- Anthropic
- OpenAI
- 중국
새 AI 모델 출시와 연구 동향
134건의 기사
중국 AI 기업 Zhipu가 새 모델의 코드 버그 탐지 성능이 Anthropic과 OpenAI를 앞선다고 주장했다.
Anthropic이 AI 코딩 도구 Claude Code를 쓸 때 불필요한 토큰 소모를 줄이라는 사용 지침을 개발자들에게 안내한 것으로 전해졌다.
알리바바의 Qwen이 오픈 웨이트(open-weight) AI 모델 경쟁에서 메타 Llama와 구글을 제치고 선두로 올라섰다는 분석이 나왔다.
HackerNoon이 직접 만든 채팅 UI 대신 React Native에서 LLM 응답을 매끄럽게 스트리밍하는 구현 패턴을 다뤘다.
Yahoo Tech는 Anthropic 신규 모델이 벤치마크에서 앞섰지만 일반 사용자는 그 차이를 체감하기 어렵다고 짚었다.
OpenAI의 GPT-5.6 Sol이 새 'Ultrafast' 모드에서 최대 14배 빠른 추론 속도를 낸다고 보도됐다. 지연 시간에 민감한 실서비스 적용이 초점이다.
프랑스 스타트업 Kog가 GPU가 에이전트 워크플로에 부적합하다는 통념에 반박하며, 기존 GPU에서 더 많은 추론 성능을 짜내는 접근을 제시했다.
중국 AI 모델의 부상으로 가성비 경쟁이 심화되면서, 오픈AI와 앤스로픽이 가격 인하로 맞대응하고 있다는 보도가 나왔다.
출판 거물 팀 오라일리가 AI가 자신의 사업을 무너뜨리고 있음에도 AI를 지지한다고 밝혔다. 단, 오픈소스라는 조건에서다.
글로벌 커뮤니케이션 기업 루더핀이 대규모 언어모델(LLM)로 구동되는 새 웹사이트를 선보였다. 마케팅·PR 업계의 생성형 AI 도입 흐름을 보여주는 사례다.
xAI가 8월 7일 Grok 4.6을 출시했다. 기존 1.5조 파라미터 V9 아키텍처를 유지하면서 SFT·RL 집중 개선을 통해 SWE-Marathon 29.0%를 달성, Claude Opus 4.8(26.0%)을 앞섰다.
연구진이 Claude·GPT·Gemini의 추론 흔적(reasoning trace)을 추출하는 기법을 공개했다. 일부 중국 AI가 미국 선도 모델로 학습됐을 가능성을 시사한다는 주장도 나왔다.
알리바바가 5일 3세대 이미지 생성 모델 Qwen Image 3.0 Pro를 발표했다. GPT Image 2에 이어 세계 2위 이미지 생성 모델을 자처하지만 벤치마크와 모델 가중치는 공개하지 않아 논란이다.
메타가 10일 30B 파라미터 오픈웨이트 에이전트 모델 Muse Glimmer를 출시했다. 소비자용 GPU 하나로 로컬 실행이 가능하며 Apache 2.0 라이선스로 무료 공개됐다.
니혼게이자이(Nikkei) 보도에 따르면 문샷AI 창업자가 애플 영입 제안을 거절하고, 앤트로픽에 맞서는 중국 AI 스타트업을 설립한 것으로 전해졌다.
메타가 오픈웨이트 모델 공개 기조를 두고 오락가락하는 모습을 보이며 업계 관측통들의 우려를 낳고 있다는 분석이 제기됐다.
대형 모델의 지식을 소형 모델로 옮기는 '증류' 기술이 미국과 중국 간 AI 경쟁의 새로운 쟁점으로 부상하고 있다는 보도가 나왔다.
Anthropic이 코딩 에이전트 Claude Code를 기본적으로 더 자율적으로 동작하도록 바꿨다는 외신 보도가 나왔다. 승인 단계를 줄여 작업을 스스로 진행하는 방향이라는 설명이다.
Wired가 무료·오픈소스 회의 기록 도구 Meetily를 소개했다. 구독 없이 로컬에서 회의를 전사·요약한다.
오픈AI의 한 임원이 코딩 도구 코덱스(Codex)가 향후 2~3개월 안에 구식이 될 것이라고 전망한 것으로 알려졌다. AI 코딩 도구의 세대 교체 속도를 보여주는 발언이다.
앤트로픽이 코딩 도구 Claude Code의 기본 설정을 오토 모드로 바꿔, 잘못된 승인으로 인한 개발자 실수를 줄이려 한다고 보도됐다.
DeepSeek이 7월 31일 V4-Flash-0731을 공식 출시했다. 모델 구조는 그대로 두고 포스트 트레이닝만 재작업한 결과, 자사 플래그십인 V4-Pro보다 9개 에이전트·코딩 벤치마크에서 모두 높은 점수를 기록했다.
NVIDIA가 AI 에이전트를 단일 파이썬 클래스로 정의하는 객체지향 프레임워크 NOOA를 오픈소스로 공개했다. SWE-bench Verified에서 82.2%를 기록하며 GPT-5.5 대비 토큰 절반으로 최고 성능을 달성했다고 밝혔다.
틱톡 모기업 바이트댄스가 앤트로픽의 'Mythos'에 맞설 초대형 AI 모델을 훈련 중인 것으로 알려졌다.
파이낸셜타임스 보도에 따르면 틱톡 모회사 바이트댄스가 앤트로픽의 최상위 모델에 근접하는 대규모 AI 모델 개발을 목표로 하고 있다고 로이터가 전했다.
파이낸셜타임스 보도에 따르면 바이트댄스가 앤트로픽의 최상위 모델 'Mythos'에 근접하는 대형 AI 모델을 개발 중인 것으로 알려졌다.
데미스 하사비스가 구글 DeepMind CEO에서 물러나 회장 겸 Alphabet 수석 과학자로 역할을 바꿨다. 코레이 카부쿠오글루 CTO가 SVP로 승진해 Gemini 개발과 일상 운영을 맡는다.
xAI가 Grok Voice Think Fast 2.0을 공개했다. 첫 오디오 응답까지 대기 시간을 0.70초로 단축하고, 추론 토큰을 60% 줄여 도구 호출 속도를 대폭 개선했다. 8월 5일부터 기본 음성 모델로 전환됐다.
알리바바가 8월 3일 Qwen3.8-Max를 발표했다. 2.4조 파라미터의 MoE 구조로 중국 모델 중 최대 규모이며, 비전 태스크에서는 글로벌 2위를 기록했다. 다음 주 오픈소스 가중치 공개 예정.
DeepSeek이 7월 31일 V4-Flash-0731 공식 베타를 출시했다. 284B 파라미터의 저비용 모델이 자사 플래그십 V4-Pro-Preview를 에이전트 벤치마크 9개 전부에서 앞지르며, 가격 그대로 성능만 대폭 올린 이례적 업데이트로 평가받는다.
Google이 Gemini Spark를 기존 월 99.99달러 AI Ultra 전용에서 월 19.99달러 AI Pro 구독자까지 개방했다. Spark는 기기가 꺼져 있어도 구글 클라우드 VM에서 상시 작동하는 자율 에이전트로, 미국 내 이용 가능하다.
Anthropic이 코딩 에이전트마다 별도 git worktree를 두라고 권하지만, 많은 팀의 기존 런타임 인프라에서는 이 방식이 걸림돌이 된다는 분석이 나왔다.
Meta가 8월 5일 터미널 기반 코딩 에이전트 Muse Code(베타)와 코딩 특화 모델 Muse Spark 1.2를 동시 공개했다. 세션 전체를 유지하는 비동기 백그라운드 에이전트와 100만 토큰 컨텍스트가 특징이다.
메타가 자체 코딩 에이전트를 선보이며 오픈AI, 앤스로픽이 주도하던 AI 코딩 도구 시장에 본격 진입한 것으로 전해졌다.
알리바바가 자사 역대 가장 강력하다고 밝힌 새 AI 모델을 공개했다. 중국 빅테크의 프런티어 모델 경쟁이 다시 가열되는 신호다.
Anthropic이 인도 내 현지 Claude 추론(in-country inference)을 개시하고 현지 파트너십을 확대한다고 발표했다.
한 연구기관 분석에 따르면 딥시크의 신형 AI 모델이 널리 알려진 모델들 가운데 구동 비용이 압도적으로 가장 저렴한 것으로 나타났다.
구글 딥마인드가 인간형 로봇 전신을 실시간으로 제어하는 Gemini Robotics 2 시리즈를 발표했다. 상체 중심이던 전작 대비 전체 신체 움직임을 지원하며, 멀티로봇 협업 기능도 탑재했다.
LG AI리서치가 7월 31일 K-EXAONE 2.0을 Hugging Face에 Apache 2.0 라이선스로 공개했다. 총 7,500억(750B) 파라미터, 활성 370억(37B) 파라미터의 혼합 전문가(MoE) 모델로, 한국어 포함 10개 언어와 262K 토큰 컨텍스트를 지원하는 현재 국내 최대 규모 AI 파운데이션 모델이다.
마이크로소프트의 첫 전이중(full-duplex) 음성 AI 모델 MAI-Realtime이 내부 프리뷰에서 유출됐다. 동시 송수신, 18개 언어, 웹 검색 등 도구 사용 기능을 갖춰 GPT Live·Gemini Live와 경쟁 구도를 형성할 전망이다.
OpenAI의 미공개 차세대 모델 '아스트라'가 수십 년간 미해결이던 순수 수학·이론 컴퓨터과학 난제 10개를 해결했다. 모든 증명은 Lean 4 형식 코드와 함께 GitHub에 공개됐다.
OpenAI가 신규 AI 모델 '아스트라(Astra)'가 10개의 수학 문제에서 돌파구를 만들었다고 밝힌 것으로 전해졌다. 진위와 검증 범위는 아직 불명확하다.
OpenAI가 차세대 AI 모델 'Astra'와 249쪽 분량의 연구 논문을 공개하며 10대 미해결 난제에서 진전을 이뤘다고 중국 36Kr이 보도했다. 세부 성능은 아직 독립 검증 전이다.
OpenAI가 GPT-5.6 Luna를 80%, Terra를 20% 인하했다. 출시 3주 만의 급격한 조정으로, 중국 AI 모델이 미국 기업 토큰 사용량의 46%를 점유하는 경쟁 압박이 배경으로 꼽힌다.
DeepSeek가 7월 31일 V4-Flash-0731을 정식 출시했다. 자사 플래그십 Pro-Preview 대비 9개 에이전트·코딩 벤치마크 전승, 가격은 입력 기준 $0.14/M 토큰.
AI 뉴스레터 'Reset to Zero'가 오래 작동하는 자율 에이전트의 누적 비용 문제를 짚었다. '미터기가 돌아간다'는 비유로 장시간 실행의 경제성을 지적한다.
OpenAI가 수학 관련 블로그 게시물에 차기 AI 모델로 알려진 'Astra'의 존재를 슬쩍 끼워 넣었다고 Gizmodo가 보도했다.
SitePoint이 Claude가 요청에 눈에 띄지 않는 방식으로 표식을 심는 '스테가노그래피 요청 마킹'을 다루며 개발자 유의점을 정리했다.
유명 유튜버 행크 그린이 LLM 사용이 자신에게 건강하지 않다며 공개적으로 사과했다. AI 챗봇의 '도파민' 중독성을 지적한 사례다.
구글 딥마인드가 로봇을 직접 제어하는 제미나이 로보틱스 2를 공개했다. '피지컬 AGI'로의 도약이지만 현실 배치에 따르는 위험도 함께 지적됐다.
마이크로소프트가 자체 AI 모델과 개발 도구를 전면에 내세우며, 파트너였던 OpenAI·Anthropic과의 경쟁 구도를 그 어느 때보다 뚜렷이 드러냈다.
테크크런치 보도에 따르면, 마이크로소프트가 자체 AI 모델 개발에 힘을 실으며 OpenAI·앤트로픽과의 경쟁 구도를 어느 때보다 뚜렷하게 드러내고 있다.
앤트로픽이 7월 24일 Claude Opus 5를 전면 출시했다. Fable 5에 근접한 성능을 절반 가격에 제공하며, 추론 강도를 직접 조절하는 '에포트 세팅' 기능이 핵심이다.
Moonshot AI가 2.8조 파라미터 Kimi K3의 전체 가중치 파일을 Hugging Face에 무료 공개했다. 100만 토큰 컨텍스트를 지원하는 역대 최대 오픈웨이트 모델로, 당일부터 클라우드 호스팅도 제공된다.
파이낸셜타임스가 LLM에 연준 FOMC 위원 역할을 맡겨 금리 결정을 모의한 결과, 모델들이 '인상' 쪽으로 기울었다고 전했다. AI를 정책·거시경제 판단에 활용하는 실험의 한 단면.
Claude의 대화 공유 링크 일부가 구글 검색 결과에 색인되고 있다는 보도가 나왔다. 앞서 ChatGPT에서 불거진 프라이버시 이슈와 유사한 양상이다.
LiquidAI가 CPU에서 빠른 장문맥 추론을 목표로 한 인코더 모델군 LFM2.5-Encoders를 공개했다. 임베딩·검색 등 인코더 작업을 GPU 없이 돌리려는 시도다.
Anthropic이 7월 20일부로 Fable 5를 Max·Team Premium 플랜 사용 한도의 50%로 영구 제공한다. Pro·Team Standard 사용자는 별도 사용 크레딧(입력 $10/M·출력 $50/M)으로만 이용 가능하며, 초기 $100 크레딧이 지급된다.
구글이 주력 AI 모델 Gemini 3.5 Pro를 코딩 성능 미달로 수개월 미뤘다. 보도 당일 Alphabet 주가가 4.4% 급락해 약 2000억 달러의 시가총액이 사라졌다.
중국 Moonshot AI가 역대 최대 오픈웨이트 모델 Kimi K3(2.8T 파라미터)를 발표했다. 프론트엔드 코드 아레나에서 Claude Fable 5를 누르고 1위를 기록했다.
Mira Murati가 이끄는 Thinking Machines Lab이 창업 9개월 만에 첫 오픈웨이트 AI 모델 Inkling을 발표했다. MoE 구조의 975B 파라미터 멀티모달 모델로, 완제품보다 기업 맞춤화의 출발점으로 포지셔닝된다.
DeepSeek이 7월 24일 15:59 UTC를 기점으로 deepseek-chat·deepseek-reasoner 엔드포인트를 종료한다. 해당 API를 쓰는 개발자는 코드 한 줄을 바꿔 deepseek-v4-pro 또는 deepseek-v4-flash로 마이그레이션해야 한다.
중국 오픈웨이트 모델이 허깅페이스 다운로드의 41%, OpenRouter 처리 토큰의 61%를 차지하며 오픈소스 AI 시장을 장악했다. Qwen은 메타 Llama를 제치고 허깅페이스 역대 최다 다운로드 모델로 등극했다.
구글 딥마인드가 재귀적 툴 호출 결함으로 전면 재설계에 들어갔던 Gemini 3.5 Pro를 7월 17일 출시를 목표로 준비 중이다. 2M 토큰 컨텍스트와 Deep Think 추론 레이어 탑재가 예고됐으나 공식 확인은 아직 없다.
전 구글 딥마인드 연구원들이 창업한 오픈소스 AI 스타트업 Reflection AI(기업가치 80억 달러)가 유럽 AI 인프라 기업 Nebius와 10억 달러 이상의 컴퓨팅 공급 계약을 체결했다. Nvidia 최신 칩을 2029년까지 확보해 프런티어급 오픈 모델 훈련을 가속한다.
구글이 7월 1일 가나 아크라에 아프리카 최초의 응용 AI 연구소를 개소하고 스타트업·연구자를 대상으로 Gemini 등 최신 DeepMind 모델 조기 접근권과 멘토링을 제공한다.
OpenAI가 동시에 듣고 말할 수 있는 풀-듀플렉스 음성 AI 'GPT-Live'를 7월 8일 공개했다. ChatGPT 전 플랜에 즉시 적용되며, 배경에서 GPT-5.5가 복잡한 추론을 처리한다.
앤트로픽이 7월 9일 Claude 전 사용자 대상 사용량 분석 대시보드 'Claude Reflect'를 베타 출시했다. 월별 대화 통계·주제 분포·피크 시간대를 한눈에 볼 수 있다.
6월 출시를 놓친 Gemini 3.5 Pro가 아키텍처 전면 재설계를 마치고 7월 17일 일반 출시를 목표로 한다. 프런티어 최대 규모인 200만 토큰 컨텍스트와 Deep Think 추론이 핵심 사양이다.
Google이 Gemini 3.5 Flash를 검색 AI Mode와 Gemini 앱의 전 세계 기본 모델로 설정했다. 커스텀 생성형 UI로 검색 결과 형태가 전통적인 링크 목록에서 인터랙티브 AI 응답으로 본격 전환된다.
OpenAI의 GPT-5.6 Sol Ultra가 64개 병렬 서브에이전트를 활용해 1시간도 안 돼 '사이클 이중 피복 추측'을 증명했다고 주장했다. 수학계의 동료심사는 아직 진행 중이다.
바이트댄스가 Seedream 5.0 Pro를 공개했다. 딥싱킹 추론, 레이어 정밀 편집, 10개 이상 언어 네이티브 지원, 네이티브 2K 출력을 결합해 OpenAI GPT-Image 2의 직접 경쟁자로 자리잡겠다는 포석이다.
OpenAI가 목표를 입력하면 문서·시트·슬라이드·코드를 자율적으로 완성하는 에이전트 ChatGPT Work를 출시하고, Codex를 단일 데스크톱 앱에 통합했다.
Meta의 슈퍼인텔리전스 총괄 Alexandr Wang이 내부 타운홀에서 훈련 중인 차세대 모델 '워터멜론'이 일부 벤치마크에서 GPT-5.5에 필적한다고 밝혔다.
OpenAI와 Broadcom이 공동 개발한 LLM 특화 추론 칩 '할라페뇨(Jalapeño)'를 공개했다. 역대 고성능 반도체 중 최단 개발 주기를 기록하며 2026년 말 첫 배포를 목표로 한다.
OpenAI가 새 GPT-5.6 모델군이 마이크로소프트 Copilot 365의 '선호 모델'로 계속 쓰인다고 밝히며 양사 결별 관측을 반박했다.
Anthropic이 7월 7일 Claude Code와 Claude Cowork를 FedRAMP High 환경에서 연방 기관에 공개 베타로 제공한다고 발표했다. 8월까지 기관당 $1(무제한 시트)로 이용 가능하다.
OpenAI가 7월 9일부터 GPT-5.6 Sol·Terra·Luna를 ChatGPT 전 사용자와 API에 전면 개방했다. 예산형 Luna($1/$6)가 추가되며 프론티어 모델 접근성이 크게 확대됐다.
xAI가 7월 8일 Grok 4.5를 공개 출시했다. 1.5T V9 아키텍처 기반의 코딩·에이전트 특화 모델로, Cursor와 공동 훈련해 실제 엔지니어링 작업에서 경쟁 모델을 앞선다고 밝혔다.
7월 7일부로 Fable 5의 Pro·Max·Team 구독 내 50% 사용량 포함이 종료된다. 8일부터는 입력 $10/M·출력 $50/M의 사용 크레딧 방식으로만 접근 가능하다.
Anthropic이 6월 30일 Claude Sonnet 5를 출시했다. Opus 4.8에 근접한 추론·코딩 성능을 갖추면서 입력 $2/백만 토큰이라는 공격적 가격으로 책정됐다.
OpenAI가 GPT-5.6 Sol을 Cerebras 웨이퍼 스케일 인프라에서 최대 750 tokens/s로 7월부터 서비스한다. 일반 GPU 대비 약 10배 속도로, 에이전트형 AI 워크플로의 경험을 근본적으로 바꿀 전망이다.
AI 최대 학회 ICML이 숨겨진 워터마크로 LLM 리뷰어를 탐지, 497편을 일괄 탈락시키며 학술 동료 심사의 AI 오용 문제를 수면 위로 끌어올렸다.
Anthropic이 수익성이 낮아 대형 제약사가 외면해온 소외 질병을 대상으로 자체 전임상 신약 후보물질 발굴 프로그램을 시작했다. Claude Science 출시와 함께 6월 30일 발표됐다.
Anthropic이 6월 30일 Claude Sonnet 5를 공개했다. Opus 4.8에 준하는 에이전트 성능을 절반 이하 가격에 제공하며, Free·Pro 플랜의 기본 모델로 즉시 적용됐다.
xAI가 1.5조 파라미터 V9 기반 Grok 4.5를 SpaceX·Tesla 내부에 비공개 배포했다. 일론 머스크는 Claude Opus 수준 혹은 그 이상의 성능이라고 주장했지만, 공개 벤치마크는 아직 없다.
중국 음식 배달·테크 기업 메이퇀이 1.6조 파라미터 LLM 'LongCat-2.0'을 MIT 라이선스로 오픈소스 공개했다. Nvidia 없이 국산 ASIC 5만 장 이상으로 사전학습을 완료한 첫 프론티어급 모델로 주목받는다.
개빈 뉴섬 캘리포니아 주지사가 앤스로픽과 파트너십을 체결했다. 주 정부·도시·카운티 전체에 Claude AI를 즉시 50% 할인 제공하며, 자체 AI 도구 Poppy도 7월 전 기관 배포 예정이다.
구글이 검색 결과를 Gemini 3.5 Flash 기반 AI 요약 페이지로 전면 전환했다. 회사는 이를 '검색 25년 역사상 최대 변화'로 규정했다.
메타 수퍼인텔리전스 랩스 수장 Alexandr Wang이 사내 타운홀에서 차기 플래그십 모델 Watermelon이 GPT-5.5와 동등한 성능을 보였다고 밝혔다. 전 세대 대비 약 10배 더 많은 컴퓨팅을 투입했다.
앤트로픽 Claude 모델이 6월 29일 마이크로소프트 Azure AI Foundry에 정식 출시됐다. NVIDIA GB300 Blackwell Ultra GPU로 구동돼 기존 A100 대비 토큰 비용 약 50% 절감, H100 대비 추론 속도 약 40% 향상을 달성했다.
앤트로픽이 6월 30일 Claude Sonnet 5를 공개해 Free·Pro 기본 모델로 전환했다. Opus 4.8에 근접한 성능을 제공하면서 가격은 Sonnet 수준으로 유지해 에이전트 개발 비용을 크게 낮춘다.
구글이 6월 30일 초고속·저비용 이미지 모델 Nano Banana 2 Lite와 동영상 생성·편집 모델 Gemini Omni Flash를 동시 공개했다.
Anthropic이 게놈학·단백질 구조 분석 등 60개 이상 과학 도구를 통합한 연구 전용 플랫폼 Claude Science를 베타로 선보였다. 새 모델이 아닌 워크플로우 혁신에 초점을 뒀다.
Anthropic이 6월 30일 Claude Sonnet 5를 공개했다. Free·Pro 플랜 기본 모델로 승격되며, Opus 4.8에 근접한 성능을 더 낮은 비용으로 제공한다.
Anthropic 프론티어 레드팀이 Claude Opus 4.7을 로봇독 제어 과제에 투입한 결과, AI가 인간 팀보다 평균 37배 빠른 속도로 같은 작업을 완료한 것으로 나타났다.
Google이 6월 22일 Gemini 2.5 Pro Deep Think를 공개했다. GPQA Diamond 82.4%, MMLU-Pro 89.8%로 Claude Fable 5와 GPT-5.5를 제치고 과학·추론 부문 공개 모델 1위를 차지했다.
Google이 Gemini 3.5 Pro 정식 출시를 7월로 확정했다. 현존 최대 200만 토큰 컨텍스트와 고급 추론 모드 Deep Think를 탑재했으며, 현재 Vertex AI 기업 고객 한정 프리뷰 중이다.
OpenAI가 GPT-5.6 패밀리를 공개했다. 최상위 모델 Sol은 서브에이전트를 병렬 실행하는 '울트라 모드'와 최대 추론 노력(max reasoning) 모드를 탑재했으며, 미 정부 승인 파트너 약 20곳에만 제한 공개 중이다.
OpenAI가 Broadcom과 공동 개발한 첫 번째 자체 AI 추론 칩 '할라페뇨(Jalapeño)'를 6월 24일 공개했다. LLM 추론에 최적화된 이 칩은 OpenAI 자체 모델을 활용해 설계 속도를 높였으며, 장기적인 NVIDIA 의존 축소의 신호탄이다.
구글이 컴퓨팅 자원 부족으로 메타의 Gemini AI 사용량을 제한했다. AI 수요가 공급을 초과하는 인프라 병목이 빅테크 파트너십까지 흔드는 신호다.
OpenAI가 2026년 6월 27일 GPT-4.5를 ChatGPT에서 완전히 제거했다. 30일 일몰 기간이 종료되며 모든 대화는 GPT-5.5로 자동 마이그레이션됐다. GPT-5 패밀리 이전 시대의 공식 종막이다.
Anthropic이 Apple Foundation Models 프레임워크와 연동하는 Swift 패키지를 출시했다. iOS 27, macOS 27 등 Apple 전 플랫폼에서 개발자가 온디바이스 모델과 Claude를 혼용할 수 있게 된다.
알리바바가 AI 동영상 생성 모델 HappyHorse 1.1을 출시하며 글로벌 순위 2위에 올랐다. OpenAI Sora 서비스 종료, ByteDance Seedance 글로벌 롤아웃 중단으로 생긴 공백을 중국 빅테크가 빠르게 메우고 있다.
NVIDIA가 5,500억 파라미터 MoE 하이브리드 모델 '네모트론 3 울트라'를 오픈웨이트로 공개했다. Artificial Analysis 지능 지수 미국 오픈소스 1위(48점)를 기록했으며, 허깅페이스·NVIDIA NIM에서 상업 이용 가능한 OpenMDW-1.1 라이선스로 배포된다.
애플이 WWDC 2026에서 제3세대 애플 파운데이션 모델(AFM 3) 5종을 공개했다. 온디바이스 20B 파라미터 멀티모달 모델을 포함하며, 클라우드 버전은 Google Cloud의 NVIDIA GPU 위에서 구동된다.
알파폴드·젬마이 공동 연구자인 조나스 애들러와 알렉산더 프리첼이 앤트로픽 합류를 준비 중이라고 블룸버그가 6월 24일 보도했다. 노암 샤지어·존 점퍼 이탈에 이어 일주일 새 네 번째·다섯 번째 이탈이다.
유럽위원회가 이탈리아 스타트업 Domyn 주도의 EUROPA 컨소시엄을 '프런티어 AI 그랜드 챌린지' 우승자로 선정했다. EU 24개 공식 언어를 지원하는 4,000억 매개변수 이상의 오픈소스 AI 모델을 개발한다.
구글 I/O에서 Sundar Pichai CEO가 '다음 달 드리겠다'고 공언했던 제미나이 3.5 Pro가 6월 말을 넘기며 7월 출시로 밀렸다. 구글의 플래그십 AI 모델이 경쟁사 대비 한 달 이상 지연된 셈이다.
OpenAI가 브로드컴과 협력해 LLM 추론에 특화된 첫 자체 설계 ASIC '할라페뇨(Jalapeño)'를 공개했다. 9개월 만에 개발 완료, 2026년 말 대규모 배포 예정이며 엔비디아 의존도를 낮추는 전략적 행보다.
6월 23일부터 Claude Fable 5가 Pro·Max·Team·Enterprise 플랜 무료 사용 기간이 종료되며 크레딧 과금으로 전환된다. 새 거부(refusal) API 동작 등 개발자가 즉시 확인해야 할 변경 사항을 정리했다.
Polymarket 계약 83% 확률이 가리키는 GPT-5.6 출시 예측 윈도우가 6월 22일 열렸다. 누출된 정보에 따르면 150만 토큰 컨텍스트와 GPT-5.5 정렬 실패를 잡는 보상 감사 파이프라인이 포함될 전망이다.
Reflection AI가 SpaceX의 Colossus 2 데이터센터에서 Nvidia GB300 칩을 월 1억 5천만 달러에 임차하는 최대 63억 달러 규모 계약을 맺었다. 오픈소스 프런티어 모델 훈련을 위한 대규모 컴퓨팅 확보 경쟁이 가속화되고 있다.
xAI의 Grok 4.3이 Amazon Bedrock에 정식 출시됐다. 100만 토큰 컨텍스트, 4단계 추론 모드, 네이티브 동영상 입력을 갖추고 OpenAI·Anthropic에 맞서는 엔터프라이즈 선택지로 부상했다.
Microsoft가 Build 2026에서 자사 개발 AI 모델 7종으로 구성된 'MAI(Microsoft AI) 패밀리'를 공개했다. 추론·코딩·이미지·음성·전사 등 전 분야를 커버하며, OpenAI 또는 서드파티 모델 증류 없이 순수 자체 데이터로 학습했다.
OpenAI가 이르면 6월 22~28일 GPT-5.6을 출시할 가능성이 높다는 예측이 나왔다. Polymarket 예측 시장에서 83% 확률이 배정됐고, OpenAI 수석 과학자도 GPT-5.5 대비 '의미 있는 개선'이라 언급한 것으로 알려졌다.
DeepSeek이 4월 24일 V4 Pro를 프리뷰 공개했다. 총 1.6조 파라미터(활성 490억)의 MoE 아키텍처, 100만 토큰 컨텍스트, MIT 라이선스로 SWE-bench Verified 80.6%를 달성하며 출력 토큰당 $0.87에 제공한다.
구글이 Google I/O에서 '다음 달까지' 출시를 공언한 Gemini 3.5 Pro가 6월 19일 현재 Vertex AI 일부 기업 고객 전용 프리뷰에 그치고 있다. 마감까지 11일이 남은 가운데 예측 마켓은 달성 확률을 50~55%로 보고 있다.
구글이 6년 만에 신형 스마트 스피커를 출시했다. $99에 Gemini AI를 내장해 자연스러운 다단계 대화와 스마트홈 제어가 가능하며, 350만 명의 얼리액세스 피드백을 반영한 결과물이다.
알리바바가 오픈소스 코딩 특화 MoE 모델 Qwen3-Coder-Next를 공개했다. 총 800억 파라미터 중 추론 시 30억만 활성화하는 초희소 구조로, 동급 밀집 모델 대비 처리량이 최대 10배 높다.
OpenAI 공동창업자이자 테슬라 AI 전 수장 앤드레이 카르파티가 Anthropic에 합류해 Claude 사전훈련(pre-training) 연구팀을 신설·주도한다. AI 분야 최고 기술 인재가 잇따라 Anthropic으로 집결하고 있다는 신호다.
NVIDIA가 물리적 AI를 위한 첫 오픈 옴니모델 Cosmos 3를 발표했다. 영상·음향·행동을 단일 모델로 처리하며 로봇·자율주행 훈련 기간을 수개월에서 수일로 단축한다.
OpenAI가 제약·바이오 전문가 173명이 만든 750개 과제 벤치마크 LifeSciBench를 발표했다. 최고 성능 모델도 합격률 약 33%에 그쳐 AI의 실제 과학 연구 역량이 아직 제한적임을 드러냈다.
구글이 Android 17과 6월 Pixel Drop을 배포하며 AI 동영상 편집 기능 Gemini Omni와 음악 창작 도구 Lyria 3를 새롭게 선보였다.
Zhipu AI의 Z.ai가 744B 파라미터 MoE 모델 GLM-5.2를 공개했다. 실사용 100만 토큰 컨텍스트와 두 가지 사고 강도를 제공하며, 벤치마크 수치 없이 출시한 점이 이례적이다.
마이크로소프트가 Wave 3 업데이트로 Microsoft 365 Copilot에 Anthropic의 Claude Fable 5를 추가했다. 단일 모델 의존에서 벗어나 GPT·Claude 중 작업에 최적인 모델을 자동 선택하는 구조로 전환됐다.
중국 AI 연구소 MiniMax가 6월 1일 오픈웨이트 모델 M3를 출시했다. 새로운 희소 어텐션 구조(MSA)로 100만 토큰 컨텍스트를 구현하고, SWE-Bench Pro에서 GPT-5.5를 상회하는 성능을 GPT-5.5 비용의 5~10% 수준에 제공한다.
Google I/O 2026에서 공개된 Gemini 3.5 Flash는 전년도 Pro 모델을 코딩·에이전트 벤치마크에서 앞서며, 속도는 4배, 비용은 40% 저렴하다.
OpenAI가 GPT-5.5 Instant를 ChatGPT의 새 기본 모델로 교체하고, 6월 9일부터 무료(Go·Free) 사용자에게도 개인화 기능을 개방했다. 이전 모델 대비 환각 52.5% 감소, 과거 대화·파일·Gmail 참조 가능.
NVIDIA가 6월 12일 Blackwell Ultra B300 칩 양산을 시작했다. HBM3e 288GB 탑재, 추론 워크로드에서 Hopper 대비 메가와트당 처리량 50배, 토큰당 비용 35배 절감을 목표로 에이전트 AI 시대의 핵심 GPU로 자리매김한다.
애플이 WWDC 2026에서 Gemini 기반으로 전면 재설계된 Siri와 Claude·ChatGPT·Grok를 선택할 수 있는 AI 확장 프레임워크를 발표했다.
구글이 추론 특화 오픈 모델 Gemma 4와 LLM 최대 병목인 KV 캐시를 획기적으로 줄이는 TurboQuant 알고리즘을 동시에 발표했다.
메타가 오픈소스 전략을 뒤집고 첫 독점 AI 모델 Muse Spark를 공개했다. 14.3조 원을 들여 AI 스택을 전면 재구축한 결과물이다.
AIWire가 매일 업데이트되는 LLM 최신 소식 코너를 엽니다. 한국어와 영어로 핵심만 정리합니다.