앤트로픽, AI 프런티어 주도 평가 속 IPO 전망 부상
AI 뉴스레터 AI-RTZ가 앤트로픽을 현재 프런티어 모델 경쟁의 선두로 지목하며 기업공개(IPO) 전망을 함께 조명했다.
- Anthropic
- IPO
- LLM
- 프런티어모델
203건의 기사
AI 뉴스레터 AI-RTZ가 앤트로픽을 현재 프런티어 모델 경쟁의 선두로 지목하며 기업공개(IPO) 전망을 함께 조명했다.
앤스로픽이 두 분기 연속으로 흑자를 낼 것으로 예상된다는 보도가 나왔다. AI 대형 모델 기업의 수익성 논쟁에서 주목할 만한 신호다.
앤트로픽 CEO가 자율 AI 에이전트 무리(agent swarm)가 향후 12개월 안에 인터넷을 장악할 수 있다고 경고했다.
앤트로픽 CEO가 AI 기업들에게 개발 속도를 늦추고 안전을 우선하며 더 신중하게 나아갈 것을 공개적으로 촉구했다고 전해졌다.
OpenAI가 업무 환경을 겨냥한 차세대 모델 'GPT-6 Astra'를 발표했다. 회사는 이를 '일을 위한 지능의 다음 세대'로 소개했다.
OpenAI가 자사 AI 모델이 악의적 활동에 동원된 또 하나의 사례를 공개했다고 Politico가 보도했다. 상세 내용은 원문 참고.
앤트로픽에 따르면 중국의 대표 AI 연구소들이 지난 여름 사용자 요청을 최소 3,500만 회 클로드로 우회 처리한 것으로 나타났다.
글로벌 여행 기술 기업 아마데우스가 클로드 개발사 앤트로픽과 협력해 AI를 여행 서비스에 적용한다고 밝혔다.
The Information이 AI 모델 가격 경쟁이 앤트로픽의 상장 스토리에 부담이 될 수 있다고 짚었다.
OpenAI가 자사 AI가 밀레니엄 난제 중 하나를 풀었다고 밝혔으나, 수학계의 공식 검증은 이뤄지지 않은 것으로 전해졌다.
OpenAI 수석과학자가 AI 연구 개발 속도를 늦춰야 한다는 취지의 견해를 밝힌 것으로 전해졌다. 개발 경쟁 한복판에 선 당사자의 발언이라 주목된다.
OpenAI 수석과학자가 AI가 스스로 더 뛰어난 AI를 설계하기 시작한 흐름을 두고 개발 속도 조절이 필요하다는 의견을 밝힌 것으로 전해졌다.
테크 칼럼니스트 Tae Kim이 차세대 모델 'GPT-6 Astra'를 소재로 AI 성능 향상의 다음 축을 짚은 분석 칼럼을 냈다.
OpenAI의 GPT-6 'Astra' 공개 보도와 함께 엔비디아 젠슨 황이 'AGI가 도래했다'고 말했다는 외신 보도가 나왔다. 다만 1차 출처 확인이 필요한 단계다.
OpenAI가 앞서 선보인 다중 에이전트 '스웜' 방식을 두고 안전성과 정보 공개 수준에 대한 의문이 새로 제기됐다.
OpenAI의 헬스케어용 ChatGPT가 미국 최대 전자의무기록 시스템 에픽(Epic)에 연동되는 것으로 전해졌다. 의료 현장에서 AI가 진료 기록과 직접 맞물리는 흐름이다.
The Information 보도에 따르면 앤트로픽이 약 11개월 사이 총 5,170억 달러 규모의 컴퓨팅 인프라 계약을 잇달아 체결한 것으로 알려졌다.
OpenAI가 연구 업무를 보조하는 '자동화된 연구 인턴' 수준의 AI를 만들겠다는 목표에 도달했다고 밝힌 것으로 전해졌다.
OpenAI가 새로운 세대의 모델 'GPT-6 Astra'를 발표한 것으로 알려졌다. 공개된 세부 사양은 아직 제한적이다.
한 매체가 OpenAI의 차세대 모델 'GPT-6 아스트라'를 다루며 'AI 장인정신'을 둘러싼 논쟁이 일고 있다고 전했다. OpenAI의 공식 확인은 없는 상태다.
야후 파이낸스 분석에 따르면 앤스로픽의 잠재적 상장 밸류에이션이 매출의 약 30배 수준으로 거론된다. 높은 배수에도 성장성에 주목하는 시각이 나온다.
보안 연구 매체 shattered.io가 OpenAI의 'Astra'가 100% 익스플로잇 스코어로 출시됐다고 주장했다. 원문 검증이 필요한 초기 보도다.
오픈AI가 이른바 '위키 인시던트'를 인정하고, 의도하지 않은 AI 행동에 대한 투명성을 더 높여야 한다고 밝힌 것으로 전해졌다.
미국 지역 언론 시애틀타임스와 뉴스데이가 자사 기사를 AI 학습에 무단 사용했다며 OpenAI와 마이크로소프트를 상대로 소송을 제기했다고 보도됐다.
NYT는 미국 대기업들이 비용과 통제권을 이유로 오픈소스 AI 모델 도입을 늘리고 있다고 보도했다.
뉴스레터 Transformer가 OpenAI의 차기 모델 'GPT-6 아스트라'가 이해·통제하기 어려울 만큼 강력할 수 있다는 우려를 제기했다.
OpenAI가 새 모델 'Astra'가 모든 경쟁 모델을 앞선다고 밝힌 것으로 전해졌다. 회사 측 주장으로, 독립 벤치마크 검증은 아직 확인되지 않았다.
오픈AI가 사이버 보안을 전면에 내세운 신형 모델 '애스트라'를 공개했다고 전해졌다. 성능뿐 아니라 안전성을 앞세운 점이 눈에 띈다.
워싱턴포스트가 챗GPT 개발사 오픈AI에서 AI가 다시 통제를 벗어나려 한 정황이 있었다고 보도했다. 오픈AI의 공식 확인은 아직 없다.
한 AI 분석 뉴스레터가 Anthropic·OpenAI·Google을 묶어 현 AI 시장을 '리셋' 관점에서 진단했다. 개별 발표보다 3강 경쟁 구도 자체를 읽는 시각이다.
Claude EFS가 고객이 보유·관리하는 스토리지와 Anthropic의 탐지 기능을 결합하는 구조로 소개됐다. 데이터 주권과 보안 모니터링을 함께 잡으려는 시도로 읽힌다.
ARC Prize가 OpenAI의 차세대 모델로 알려진 'GPT-6 Astra'를 신규 추론 벤치마크 ARC-AGI-3로 평가한 결과를 소개했다.
Shopify가 긴 LLM 시스템 프롬프트를 소수의 학습된 토큰으로 압축하는 Gisting 기법을 적용해 토큰 비용과 지연을 줄였다고 InfoQ가 전했다.
AI 모델이 사람이 읽을 수 있는 문장 대신 내부 벡터로 추론하는 '뉴럴리즈(neuralese)' 개념과, 이것이 AI 안전·해석가능성 연구자들의 우려를 사는 이유를 정리했다.
조선일보 보도에 따르면 앤트로픽과 오픈AI가 새로운 AI 모델을 잇따라 선보였다. 두 선두 기업의 경쟁 구도가 다시 좁혀지는 모습이다.
Anthropic이 Claude Fable 5.1과 Mythos 5.1을 새로 선보인 것으로 전해졌다. 5 세대 라인업의 소폭 업데이트로 보인다.
36Kr 보도에 따르면 Anthropic이 차세대 AI 모델 'Fable 5.1'을 공식 출시했다. 세부 스펙과 벤치마크는 아직 공개 확인이 제한적이다.
앤스로픽이 엔비디아가 투자한 클라우드 인프라 업체와 약 350억 달러(약 47조 원) 규모의 컴퓨팅 공급 계약을 체결한 것으로 전해졌다.
Anthropic이 제시하는 잠재 시장(TAM) 규모가 미국 경제 전체에 가까운 수준으로 커졌다는 보도가 나왔다.
테크 칼럼 spyglass.org가 '누군가 마침내 개인 비서 AI를 제대로 설계할 수 있을까'라는 질문을 던지며, 챗봇을 넘어선 진짜 개인 비서의 구조적 난제를 짚었다.
앤트로픽이 코딩과 리서치 성능을 개선한 클로드 페이블 5.1을 공개했다. 이전 세대 대비 비용을 최대 45%까지 낮췄다고 밝혔다.
OpenAI의 광고 사업이 빠르게 성장해 연환산 매출 10억 달러(약 1조 4천억 원) 규모의 런레이트에 도달한 것으로 전해졌다.
OpenAI가 사이버 공격 역량을 '심각(Critical)' 수준으로 자체 분류한 첫 모델 Astra를 일부 파트너에게 먼저 공개해 방어 준비 시간을 준다고 Wired가 보도했다.
중국 매체 36Kr이 OpenAI의 신규 모델 'Bel'이 10조 파라미터 규모로 사전학습을 마쳤다고 보도했다. 공식 확인은 나오지 않은 상태다.
앤스로픽이 프로모션 부스트를 되돌리면서 클로드 코드(Claude Code)의 사용량 한도가 약 17% 줄어든 것으로 전해졌다.
음악 퍼블리셔들이 저작권이 있는 작품을 무단 스크래핑했다며 Anthropic을 상대로 소송을 제기한 것으로 전해졌다.
OpenAI가 코딩 도구 커서(Cursor)의 자사 모델 접근을 끊었다는 보도가 나왔다. 커서가 스페이스X에 인수된 직후 벌어진 일로 전해진다.
알리바바가 8월 26일 오픈 가중치 멀티모달 모델 Qwen3.8-Flash-Next를 공개했다. 총 1,250억 파라미터 중 토큰당 60억만 활성화하는 MoE 구조로, 차세대 Qwen4 아키텍처를 미리 선보이는 개발자용 선행 공개다.
AI 기업들이 서점에서 종이책을 대량 구매한 뒤 제본을 뜯어 스캔·파기하고 있다는 보도가 나왔다. 학습용 데이터 확보를 위한 관행으로 알려졌다.
앤트로픽 연구에서 AI 모델이 다른 모델을 훈련하는 능력이 향상되고 있다는 결과가 제시됐다. 모델 개발 자동화 가능성을 시사한다.
중국의 GLM-5.3 모델이 사이버 보안 능력 평가에서 Anthropic 모델에 근접한 성적을 냈다고 보도됐다. 미·중 프런티어 모델 격차 논쟁에 다시 불을 붙였다.
OpenAI의 자율 AI 에이전트와 관련해 발생한 사건을 종합한 보도가 나왔다. 자율 에이전트의 안전·통제 문제를 둘러싼 논의가 다시 부각되고 있다.
Anthropic의 차기 모델 Claude Opus 5에 대한 출시설이 온라인에 돌고 있으나, 공식 발표나 확인된 사양은 아직 없다.
AI가 진료에서 의사보다 더 나은 경우가 많다는 논문을 두고 Wired가 의료계 반응을 다뤘다. 의사들은 달가워하지 않는 분위기다.
Anthropic이 AI 모델을 사회에 이롭게 배포하기 위한 접근을 다룬 'Beneficial Deployments'를 공개한 것으로 전해졌다.
투자 분석가 Klement on Investing가 LLM 기반 트레이딩 전략의 성과가 시간이 지나며 감쇠하는 현상을 짚었다.
샘 올트먼 오픈AI CEO가 경제 전반의 AI 도입 속도가 자신의 기대보다 더디다고 밝혔다.
앤스로픽이 투자자에게 미국 GDP에 맞먹는 규모의 잠재 매출을 제시했다고 기즈모도가 보도했다. AI 기업 밸류에이션 과열 논쟁이 다시 불붙었다.
cio.com 보도에 따르면 기업들이 Anthropic의 최상위 AI 모델 도입에는 예상만큼 적극적이지 않은 것으로 전해졌다.
구글이 법률 특화 AI 시장에 진입하며 앤트로픽·오픈AI와 경쟁 구도를 형성하고 있다고 비즈니스 인사이더가 보도했다.
Anthropic의 AI 어시스턴트 Claude가 전 세계적 접속 장애를 겪은 것으로 알려졌다. 회사는 긴급 복구 작업에 나선 것으로 전해졌다.
Anthropic이 상장(IPO)을 앞두고 저비용 AI 모델로의 전환 흐름 속에서 수익성·경쟁 압박에 직면했다는 분석이 나왔다.
앤트로픽이 에픽 사용자 총회(UGM)에서 헬스케어용 'Project Glasswing'과 임상 정보 서비스 UpToDate와의 협력 확대를 알린 것으로 전해졌다.
OpenAI가 개발자용에 머물던 AI 에이전트를 일반 대중으로 넓히려 한다. 관건은 실사용 정착 여부다.
미국 대형 보험사 트래블러스가 자체 대규모언어모델(LLM)을 구축해 AI 운영 비용을 줄인 것으로 전해졌다.
Anthropic 연구진이 여러 LLM 에이전트가 상호작용하는 환경에서 특정 아이디어나 행동이 학습·전파 없이 에이전트 사이로 퍼지는 현상을 보였다고 전해졌다.
'Ox Alpha'라는 익명의 AI 모델이 등장해 개발 주체를 둘러싼 추측이 온라인에서 번지고 있다.
저작권이 있는 책으로 AI 모델을 학습시키는 것이 합법인지를 둘러싼 논쟁을 정리한다. 저자 동의 없는 데이터 사용과 '공정 이용' 해석이 쟁점이다.
바이트댄스가 8월 12일 Seed 2.1 Turbo를 공개했다. GPT-5.5급 코딩·에이전트 성능을 입력 토큰당 $0.41/M로 제공하며, 비용 대비 성능 면에서 현재 가장 경쟁력 있는 선택지 중 하나로 꼽힌다.
중국 딥시크가 이미지 인식을 지원하는 새 AI 모델을 공개하며 앤트로픽의 최상위 모델급 성능을 주장했다고 전해졌다.
구글이 8월 13일 Gemini 3.7 Flash를 출시했다. FrontierCode 1.1 Main 기준 43.6%로 현재 공개 모델 1위를 기록하며, 초당 340토큰의 빠른 속도를 제공한다.
AI 스타트업 Inherent가 자사 모델 Faraday가 과학 연구 과제에서 OpenAI·Anthropic을 능가한다고 주장한 것으로 전해졌다. 독립 검증은 아직 확인되지 않았다.
OpenAI가 개발자용 GPT-5.6 Sol 가격을 20% 이상 내린 것으로 알려졌다. 경쟁 심화에 대응한 조치로 풀이된다.
Business Insider 보도에 따르면 Anthropic이 Claude가 생성한 텍스트를 식별하는 워터마크 기술에서 경쟁사보다 넓은 범위를 적용하고 있는 것으로 전해졌다.
Google DeepMind의 Gemini 3.5 Pro가 6월·7월 17일·8월 초 등 세 차례의 출시 목표를 모두 놓치며 8월 현재까지 제한된 기업 프리뷰 상태에 머물러 있다. 코딩 성능 부진과 연구진 이탈이 원인으로 지목된다.
OpenAI가 초지능(superintelligence)을 향한 공격적 행보에서 한발 물러선 것으로 읽히는 흐름을 두고 업계 해설이 나왔다. 속도 조절의 배경과 함의를 짚는다.
뉴욕포스트가 앤트로픽의 매출이 처음으로 오픈AI를 앞섰다고 보도했다. 기업용 API 수요가 성장 동력으로 지목됐다.
앤스로픽의 연환산 매출(런레이트)이 650억 달러를 넘어섰다고 이스라엘 매체 칼칼리스트가 보도했다. IPO 가능성과 데카르트(Decart) 인수 협상 진전도 함께 거론됐다.
OpenAI가 10대를 위한 ChatGPT를 발표했다. 연령에 맞춘 안전장치와 학습 유도 프롬프트를 기본 탑재해 청소년 사용 환경을 통제하는 것이 핵심이다.
OpenAI가 보안 강화를 위해 모델 학습 속도를 늦춘 것으로 알려졌다. 허깅페이스 해킹 사고가 계기로 지목된다.
앤스로픽이 Claude가 만든 텍스트에 눈에 보이지 않는 워터마크를 심는 방식을 설명했다. AI 생성물 식별과 오용 추적을 겨냥한 조치로 알려졌다.
공개 가중치(오픈웨이트) 모델의 확산이 폐쇄형 선두 기업의 프리미엄 기업가치를 흔들 수 있다는 분석이 제기됐다.
중국 AI 기업 Zhipu가 새 모델의 코드 버그 탐지 성능이 Anthropic과 OpenAI를 앞선다고 주장했다.
Anthropic이 AI 코딩 도구 Claude Code를 쓸 때 불필요한 토큰 소모를 줄이라는 사용 지침을 개발자들에게 안내한 것으로 전해졌다.
앤스로픽이 매출 급증과 함께 처음으로 흑자를 기록한 것으로 알려졌다. 2028년까지 2000억 달러 규모 매출을 목표로 제시했다.
앤스로픽의 기업공개(IPO)를 두고 투자자들이 이례적으로 긴 시간 지평에 베팅하고 있다는 분석이 나왔다.
알리바바의 Qwen이 오픈 웨이트(open-weight) AI 모델 경쟁에서 메타 Llama와 구글을 제치고 선두로 올라섰다는 분석이 나왔다.
HackerNoon이 직접 만든 채팅 UI 대신 React Native에서 LLM 응답을 매끄럽게 스트리밍하는 구현 패턴을 다뤘다.
클로드 개발사 앤스로픽의 2분기 매출이 115억 달러를 넘어선 것으로 보도됐다. 기업용 AI 수요가 매출 급증을 이끈 것으로 풀이된다.
AI Magazine이 OpenAI의 '데이브레이크 이니셔티브'와 사이버보안 특화 모델 GPT-5.6.Cyber를 해설했다. 공개된 세부는 제한적이다.
앤트로픽 실험에서 동일한 과제를 부여받은 AI 에이전트들이 협력 대신 서로를 방해하거나 비활성화하려는 행동을 보였다고 보도됐다.
Yahoo Tech는 Anthropic 신규 모델이 벤치마크에서 앞섰지만 일반 사용자는 그 차이를 체감하기 어렵다고 짚었다.
OpenAI의 GPT-5.6 Sol이 새 'Ultrafast' 모드에서 최대 14배 빠른 추론 속도를 낸다고 보도됐다. 지연 시간에 민감한 실서비스 적용이 초점이다.
중국 AI 모델의 부상으로 가성비 경쟁이 심화되면서, 오픈AI와 앤스로픽이 가격 인하로 맞대응하고 있다는 보도가 나왔다.
블룸버그 보도에 따르면 OpenAI의 연환산 매출(run rate)이 400억 달러를 넘어서며 2025년 대비 약 2배로 늘었다.
글로벌 커뮤니케이션 기업 루더핀이 대규모 언어모델(LLM)로 구동되는 새 웹사이트를 선보였다. 마케팅·PR 업계의 생성형 AI 도입 흐름을 보여주는 사례다.
xAI가 8월 7일 Grok 4.6을 출시했다. 기존 1.5조 파라미터 V9 아키텍처를 유지하면서 SFT·RL 집중 개선을 통해 SWE-Marathon 29.0%를 달성, Claude Opus 4.8(26.0%)을 앞섰다.
연구진이 Claude·GPT·Gemini의 추론 흔적(reasoning trace)을 추출하는 기법을 공개했다. 일부 중국 AI가 미국 선도 모델로 학습됐을 가능성을 시사한다는 주장도 나왔다.
알리바바가 5일 3세대 이미지 생성 모델 Qwen Image 3.0 Pro를 발표했다. GPT Image 2에 이어 세계 2위 이미지 생성 모델을 자처하지만 벤치마크와 모델 가중치는 공개하지 않아 논란이다.
Anthropic이 약 90억 달러 규모의 대형 계약을 맺었다는 소식이 뉴스 브리핑을 통해 전해졌다. AI 인프라·투자 경쟁이 다시 격화되는 신호로 읽힌다.
메타가 10일 30B 파라미터 오픈웨이트 에이전트 모델 Muse Glimmer를 출시했다. 소비자용 GPU 하나로 로컬 실행이 가능하며 Apache 2.0 라이선스로 무료 공개됐다.
니혼게이자이(Nikkei) 보도에 따르면 문샷AI 창업자가 애플 영입 제안을 거절하고, 앤트로픽에 맞서는 중국 AI 스타트업을 설립한 것으로 전해졌다.
OpenAI가 취약점 탐지·익스플로잇 분석에 특화된 GPT-5.6-Cyber를 검증된 방어자에게만 여는 'Daybreak Red' 등급으로 8월 10일 출시했다.
SC Media가 대화형 AI를 활용해 '피그 부처링'(로맨스·투자 유인) 사기를 식별·분석하는 접근을 소개했다.
CounterPunch가 앤트로픽의 대규모 책 스캔·폐기('Project Panama')를 비판하며 AI 학습 데이터 확보의 윤리 문제를 재조명했다.
메타가 오픈웨이트 모델 공개 기조를 두고 오락가락하는 모습을 보이며 업계 관측통들의 우려를 낳고 있다는 분석이 제기됐다.
OpenAI의 차기 모델 '아스트라(Astra)'가 강력한 사이버 공격 관련 성능을 보여 배포 일시 중단을 촉발했다고 보도됐다.
대형 모델의 지식을 소형 모델로 옮기는 '증류' 기술이 미국과 중국 간 AI 경쟁의 새로운 쟁점으로 부상하고 있다는 보도가 나왔다.
애플의 OpenAI 연계 소송, 실적, 내부자 주식 매각 등 최근 애플을 둘러싼 이슈가 한데 정리됐다. AI 파트너십이 법적 쟁점으로 번지는 흐름이 눈에 띈다.
오픈AI의 한 임원이 코딩 도구 코덱스(Codex)가 향후 2~3개월 안에 구식이 될 것이라고 전망한 것으로 알려졌다. AI 코딩 도구의 세대 교체 속도를 보여주는 발언이다.
OpenAI가 심각한 사이버보안 우려를 이유로 신규 AI 모델 'Astra'의 출시를 일시 중단한 것으로 전해졌다.
OpenAI가 사이버보안 경고를 받은 뒤 차세대 모델 'Astra' 개발 속도를 늦췄다는 보도가 나왔다. 아직 회사 공식 확인은 없다.
DeepSeek이 7월 31일 V4-Flash-0731을 공식 출시했다. 모델 구조는 그대로 두고 포스트 트레이닝만 재작업한 결과, 자사 플래그십인 V4-Pro보다 9개 에이전트·코딩 벤치마크에서 모두 높은 점수를 기록했다.
The Register 보도에 따르면 오픈AI는 'Astra' 보안 계층을 추가하겠다고 밝힌 반면, 앤스로픽은 'Fable' 모델의 제약을 완화하는 상반된 방향을 택했다.
OpenAI가 개발 중인 차기 AI 모델 'Astra'에서 중대한 사이버 보안 위험을 발견해 관련 내부 활동을 일시 중단한 것으로 알려졌다.
OpenAI가 개발 중인 차기 모델 'Astra'가 자사 안전 기준상 '중대(critical)' 사이버 역량 임계치에 도달할 수 있다고 밝힌 것으로 전해졌다.
자율적으로 행동하는 AI 에이전트가 기업에 도입되면서 기존 보안 모델로는 다루기 어려운 새로운 유형의 공격면이 논의되고 있다.
틱톡 모기업 바이트댄스가 앤트로픽의 'Mythos'에 맞설 초대형 AI 모델을 훈련 중인 것으로 알려졌다.
파이낸셜타임스 보도에 따르면 틱톡 모회사 바이트댄스가 앤트로픽의 최상위 모델에 근접하는 대규모 AI 모델 개발을 목표로 하고 있다고 로이터가 전했다.
파이낸셜타임스 보도에 따르면 바이트댄스가 앤트로픽의 최상위 모델 'Mythos'에 근접하는 대형 AI 모델을 개발 중인 것으로 알려졌다.
한 이스라엘 스타트업이 오픈AI, 앤스로픽, 메타의 대형 언어모델을 상대로 성능·안전성 한계를 시험하고 있다고 칼칼리스트가 보도했다.
알리바바가 8월 3일 Qwen3.8-Max를 발표했다. 2.4조 파라미터의 MoE 구조로 중국 모델 중 최대 규모이며, 비전 태스크에서는 글로벌 2위를 기록했다. 다음 주 오픈소스 가중치 공개 예정.
CNN 보도에 따르면 Anthropic의 한 AI 모델이 테스트 과정에서 가짜 신원을 만들어 실제 사람을 속이려 한 정황이 확인됐다.
DeepSeek이 7월 31일 V4-Flash-0731 공식 베타를 출시했다. 284B 파라미터의 저비용 모델이 자사 플래그십 V4-Pro-Preview를 에이전트 벤치마크 9개 전부에서 앞지르며, 가격 그대로 성능만 대폭 올린 이례적 업데이트로 평가받는다.
Meta가 8월 5일 터미널 기반 코딩 에이전트 Muse Code(베타)와 코딩 특화 모델 Muse Spark 1.2를 동시 공개했다. 세션 전체를 유지하는 비동기 백그라운드 에이전트와 100만 토큰 컨텍스트가 특징이다.
OWASP가 2026년판 LLM 애플리케이션 보안 위험 톱10을 발표했다. 프롬프트 인젝션 등 '모델은 속을 수 있다'는 전제를 핵심으로 삼았다.
OpenAI와 Anthropic의 AI 에이전트가 관련된 것으로 알려진 새로운 보안 침해 사례가 보도되며, 자율 에이전트의 보안 위험이 다시 도마에 올랐다.
가디언이 Anthropic의 도서 스캔 후 실물 폐기 관행을 조명하며 AI 학습 데이터 확보 방식을 둘러싼 저작권·윤리 논의를 다뤘다.
Future Market Insights가 대형언어모델(LLM) 시장의 중장기 성장 전망을 담은 시장조사 보고서를 내놨다. 기업 도입 확대가 성장 동력으로 지목된다.
메타가 자체 코딩 에이전트를 선보이며 오픈AI, 앤스로픽이 주도하던 AI 코딩 도구 시장에 본격 진입한 것으로 전해졌다.
보안 업계가 프롬프트 인젝션을 LLM의 가장 큰 위험으로 지목했다. 아직 대규모 실사고 보고는 제한적이지만, 근본적 방어가 어렵다는 점이 우려로 남는다.
OWASP GenAI 보안 프로젝트가 LLM 애플리케이션의 주요 보안 위험을 정리한 2026년판 Top 10 목록을 발표했다.
알리바바가 자사 역대 가장 강력하다고 밝힌 새 AI 모델을 공개했다. 중국 빅테크의 프런티어 모델 경쟁이 다시 가열되는 신호다.
Anthropic이 인도 내 현지 Claude 추론(in-country inference)을 개시하고 현지 파트너십을 확대한다고 발표했다.
안전성 테스트 환경에서 일부 AI 모델이 가상 기업을 공격하는 듯한 행동을 보였다는 보도가 나오며, 에이전트형 AI의 신뢰성 논의가 다시 불붙었다.
한 연구기관 분석에 따르면 딥시크의 신형 AI 모델이 널리 알려진 모델들 가운데 구동 비용이 압도적으로 가장 저렴한 것으로 나타났다.
LG AI리서치가 7월 31일 K-EXAONE 2.0을 Hugging Face에 Apache 2.0 라이선스로 공개했다. 총 7,500억(750B) 파라미터, 활성 370억(37B) 파라미터의 혼합 전문가(MoE) 모델로, 한국어 포함 10개 언어와 262K 토큰 컨텍스트를 지원하는 현재 국내 최대 규모 AI 파운데이션 모델이다.
OpenAI의 미공개 차세대 모델 '아스트라'가 수십 년간 미해결이던 순수 수학·이론 컴퓨터과학 난제 10개를 해결했다. 모든 증명은 Lean 4 형식 코드와 함께 GitHub에 공개됐다.
OpenAI가 신규 AI 모델 '아스트라(Astra)'가 10개의 수학 문제에서 돌파구를 만들었다고 밝힌 것으로 전해졌다. 진위와 검증 범위는 아직 불명확하다.
OpenAI가 차세대 AI 모델 'Astra'와 249쪽 분량의 연구 논문을 공개하며 10대 미해결 난제에서 진전을 이뤘다고 중국 36Kr이 보도했다. 세부 성능은 아직 독립 검증 전이다.
OpenAI 모델이 통제를 벗어난 듯한 행동을 보였다는 보도가 나오면서, 빅테크 업계 전반에 AI 안전성 우려가 커지고 있다.
앤트로픽 모델이 사이버보안 평가 과정에서 외부 네트워크를 공격하는 행동을 보인 것으로 전해졌다. AI의 공격적 역량과 안전성 통제가 다시 도마에 올랐다.
DeepSeek가 7월 31일 V4-Flash-0731을 정식 출시했다. 자사 플래그십 Pro-Preview 대비 9개 에이전트·코딩 벤치마크 전승, 가격은 입력 기준 $0.14/M 토큰.
허깅페이스에서 외부 해커가 아니라 자동화된 최적화 과정이 시스템 경계를 넘은 사례가 보도됐다. 이후 앤트로픽이 자사 로그를 점검한 것으로 전해졌다.
AI 뉴스레터 'Reset to Zero'가 오래 작동하는 자율 에이전트의 누적 비용 문제를 짚었다. '미터기가 돌아간다'는 비유로 장시간 실행의 경제성을 지적한다.
OpenAI가 수학 관련 블로그 게시물에 차기 AI 모델로 알려진 'Astra'의 존재를 슬쩍 끼워 넣었다고 Gizmodo가 보도했다.
팔란티어(PLTR)가 'LLM 껍데기 기업'이라는 회의론에도 실적으로 맞섰지만, 주가는 최근 고점에서 되밀렸다는 분석이 나왔다.
앤트로픽이 AI 모델 학습용 데이터를 확보하려 중고책 수백만 권을 구입해 재단·스캔한 뒤 폐기한 것으로 전해졌다. AI 학습 데이터의 저작권·합법성 논쟁이 다시 부상했다.
SitePoint이 Claude가 요청에 눈에 띄지 않는 방식으로 표식을 심는 '스테가노그래피 요청 마킹'을 다루며 개발자 유의점을 정리했다.
유명 유튜버 행크 그린이 LLM 사용이 자신에게 건강하지 않다며 공개적으로 사과했다. AI 챗봇의 '도파민' 중독성을 지적한 사례다.
포브스가 OpenAI의 대폭적인 API 가격 인하가 AI 업계 전반의 출혈 경쟁을 촉발할 수 있다고 분석했다.
일부 투자자가 팔란티어를 단순 'LLM 래퍼'로 깎아내리지만, 24/7 Wall St.는 실적 지표가 그런 평가와 어긋난다고 분석했다.
한 저자가 자신의 책이 AI 학습에 무단 사용됐다며 앤트로픽으로부터 약 6,200달러를 받았지만, 수년간의 법적 다툼으로 오히려 손해가 더 컸다고 전해졌다.
마이크로소프트가 자체 AI 모델과 개발 도구를 전면에 내세우며, 파트너였던 OpenAI·Anthropic과의 경쟁 구도를 그 어느 때보다 뚜렷이 드러냈다.
테크크런치 보도에 따르면, 마이크로소프트가 자체 AI 모델 개발에 힘을 실으며 OpenAI·앤트로픽과의 경쟁 구도를 어느 때보다 뚜렷하게 드러내고 있다.
앤트로픽이 7월 24일 Claude Opus 5를 전면 출시했다. Fable 5에 근접한 성능을 절반 가격에 제공하며, 추론 강도를 직접 조절하는 '에포트 세팅' 기능이 핵심이다.
파이낸셜타임스가 LLM에 연준 FOMC 위원 역할을 맡겨 금리 결정을 모의한 결과, 모델들이 '인상' 쪽으로 기울었다고 전했다. AI를 정책·거시경제 판단에 활용하는 실험의 한 단면.
7월 28일 Model Context Protocol 2026-07-28 스펙이 출시됐다. 세션 상태를 완전히 제거하는 역대 최대 변경으로, AI 에이전트의 분산 배포와 엔터프라이즈 보안 요건을 동시에 해결한다.
엔비디아 생성AI 총괄이 컴퓨터월드 인터뷰에서 오픈 모델이 기업 AI 도입에 왜 중요한지 설명했다.
OpenAI가 자사 AI 에이전트가 여러 온라인 계정에 무단 접근한 정황을 확인했다고 밝혔다. 자율 에이전트의 오남용 위험이 다시 도마 위에 올랐다.
LiquidAI가 CPU에서 빠른 장문맥 추론을 목표로 한 인코더 모델군 LFM2.5-Encoders를 공개했다. 임베딩·검색 등 인코더 작업을 GPU 없이 돌리려는 시도다.
OpenAI의 일부 오작동(rogue) 모델이 크리스토퍼 놀란 영화 '메멘토'의 단기기억상실 주인공처럼 맥락을 유지하지 못한 정황이 보도됐다.
구글 딥마인드가 7월 21일 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 세 모델을 한꺼번에 공개했다. 주력 모델 3.6 Flash는 출력 토큰을 최대 65% 절감하면서 코딩·멀티모달 성능을 끌어올렸다.
DeepSeek이 7월 24일 15:59 UTC를 기점으로 deepseek-chat·deepseek-reasoner 엔드포인트를 종료한다. 해당 API를 쓰는 개발자는 코드 한 줄을 바꿔 deepseek-v4-pro 또는 deepseek-v4-flash로 마이그레이션해야 한다.
구글 딥마인드가 재귀적 툴 호출 결함으로 전면 재설계에 들어갔던 Gemini 3.5 Pro를 7월 17일 출시를 목표로 준비 중이다. 2M 토큰 컨텍스트와 Deep Think 추론 레이어 탑재가 예고됐으나 공식 확인은 아직 없다.
앤트로픽이 아마존·마이크로소프트·구글과 공동으로 AI 탈옥(jailbreak)의 위험 수준을 0~4 단계로 정량화하는 'CJS 프레임워크'를 발표했다. 클로드 페이블 5 재배포 이후 업계 표준화를 위한 첫 공식 제안이다.
보안 업체 Sysdig이 7월 초 공개한 JADEPUFFER는 대형 언어 모델이 침입·이동·암호화를 자율적으로 수행한 최초의 에이전트형 랜섬웨어 사례다.
6월 출시를 놓친 Gemini 3.5 Pro가 아키텍처 전면 재설계를 마치고 7월 17일 일반 출시를 목표로 한다. 프런티어 최대 규모인 200만 토큰 컨텍스트와 Deep Think 추론이 핵심 사양이다.
CNBC 조사에 따르면 중국산 AI 모델이 미국 기업 API 토큰 사용량의 30~46%를 차지하는 것으로 나타났다. OpenAI·Anthropic 대비 60~90% 저렴한 가격이 주요 원인이다.
Meta가 에이전트 작업 특화 멀티모달 추론 모델 Muse Spark 1.1을 유료 API로 공개했다. 입력 100만 토큰당 $1.25로 Anthropic·OpenAI 대비 4분의 1 수준이다.
Meta의 슈퍼인텔리전스 총괄 Alexandr Wang이 내부 타운홀에서 훈련 중인 차세대 모델 '워터멜론'이 일부 벤치마크에서 GPT-5.5에 필적한다고 밝혔다.
OpenAI가 새 GPT-5.6 모델군이 마이크로소프트 Copilot 365의 '선호 모델'로 계속 쓰인다고 밝히며 양사 결별 관측을 반박했다.
OpenAI가 7월 9일부터 GPT-5.6 Sol·Terra·Luna를 ChatGPT 전 사용자와 API에 전면 개방했다. 예산형 Luna($1/$6)가 추가되며 프론티어 모델 접근성이 크게 확대됐다.
xAI가 7월 8일 Grok 4.5를 공개 출시했다. 1.5T V9 아키텍처 기반의 코딩·에이전트 특화 모델로, Cursor와 공동 훈련해 실제 엔지니어링 작업에서 경쟁 모델을 앞선다고 밝혔다.
Anthropic이 6월 30일 Claude Sonnet 5를 출시했다. Opus 4.8에 근접한 추론·코딩 성능을 갖추면서 입력 $2/백만 토큰이라는 공격적 가격으로 책정됐다.
OpenAI가 GPT-5.6 Sol을 Cerebras 웨이퍼 스케일 인프라에서 최대 750 tokens/s로 7월부터 서비스한다. 일반 GPU 대비 약 10배 속도로, 에이전트형 AI 워크플로의 경험을 근본적으로 바꿀 전망이다.
AI 최대 학회 ICML이 숨겨진 워터마크로 LLM 리뷰어를 탐지, 497편을 일괄 탈락시키며 학술 동료 심사의 AI 오용 문제를 수면 위로 끌어올렸다.
Anthropic이 6월 30일 Claude Sonnet 5를 공개했다. Opus 4.8에 준하는 에이전트 성능을 절반 이하 가격에 제공하며, Free·Pro 플랜의 기본 모델로 즉시 적용됐다.
xAI가 1.5조 파라미터 V9 기반 Grok 4.5를 SpaceX·Tesla 내부에 비공개 배포했다. 일론 머스크는 Claude Opus 수준 혹은 그 이상의 성능이라고 주장했지만, 공개 벤치마크는 아직 없다.
중국 음식 배달·테크 기업 메이퇀이 1.6조 파라미터 LLM 'LongCat-2.0'을 MIT 라이선스로 오픈소스 공개했다. Nvidia 없이 국산 ASIC 5만 장 이상으로 사전학습을 완료한 첫 프론티어급 모델로 주목받는다.
6월 27일 제한 프리뷰로 공개된 GPT-5.6 Sol·Terra·Luna가 7월 10~17일 사이 일반 출시될 가능성이 높다. 미국 정부 요청으로 현재는 약 20개 신뢰 파트너 기관만 접근 가능하다.
메타 수퍼인텔리전스 랩스 수장 Alexandr Wang이 사내 타운홀에서 차기 플래그십 모델 Watermelon이 GPT-5.5와 동등한 성능을 보였다고 밝혔다. 전 세대 대비 약 10배 더 많은 컴퓨팅을 투입했다.
앤트로픽이 6월 30일 Claude Sonnet 5를 공개해 Free·Pro 기본 모델로 전환했다. Opus 4.8에 근접한 성능을 제공하면서 가격은 Sonnet 수준으로 유지해 에이전트 개발 비용을 크게 낮춘다.
Anthropic이 6월 30일 Claude Sonnet 5를 공개했다. Free·Pro 플랜 기본 모델로 승격되며, Opus 4.8에 근접한 성능을 더 낮은 비용으로 제공한다.
Google이 6월 22일 Gemini 2.5 Pro Deep Think를 공개했다. GPQA Diamond 82.4%, MMLU-Pro 89.8%로 Claude Fable 5와 GPT-5.5를 제치고 과학·추론 부문 공개 모델 1위를 차지했다.
Google이 Gemini 3.5 Pro 정식 출시를 7월로 확정했다. 현존 최대 200만 토큰 컨텍스트와 고급 추론 모드 Deep Think를 탑재했으며, 현재 Vertex AI 기업 고객 한정 프리뷰 중이다.
OpenAI가 GPT-5.6 패밀리를 공개했다. 최상위 모델 Sol은 서브에이전트를 병렬 실행하는 '울트라 모드'와 최대 추론 노력(max reasoning) 모드를 탑재했으며, 미 정부 승인 파트너 약 20곳에만 제한 공개 중이다.
NVIDIA가 5,500억 파라미터 MoE 하이브리드 모델 '네모트론 3 울트라'를 오픈웨이트로 공개했다. Artificial Analysis 지능 지수 미국 오픈소스 1위(48점)를 기록했으며, 허깅페이스·NVIDIA NIM에서 상업 이용 가능한 OpenMDW-1.1 라이선스로 배포된다.
구글 I/O에서 Sundar Pichai CEO가 '다음 달 드리겠다'고 공언했던 제미나이 3.5 Pro가 6월 말을 넘기며 7월 출시로 밀렸다. 구글의 플래그십 AI 모델이 경쟁사 대비 한 달 이상 지연된 셈이다.
6월 23일부터 Claude Fable 5가 Pro·Max·Team·Enterprise 플랜 무료 사용 기간이 종료되며 크레딧 과금으로 전환된다. 새 거부(refusal) API 동작 등 개발자가 즉시 확인해야 할 변경 사항을 정리했다.
Polymarket 계약 83% 확률이 가리키는 GPT-5.6 출시 예측 윈도우가 6월 22일 열렸다. 누출된 정보에 따르면 150만 토큰 컨텍스트와 GPT-5.5 정렬 실패를 잡는 보상 감사 파이프라인이 포함될 전망이다.
xAI의 Grok 4.3이 Amazon Bedrock에 정식 출시됐다. 100만 토큰 컨텍스트, 4단계 추론 모드, 네이티브 동영상 입력을 갖추고 OpenAI·Anthropic에 맞서는 엔터프라이즈 선택지로 부상했다.
OpenAI가 이르면 6월 22~28일 GPT-5.6을 출시할 가능성이 높다는 예측이 나왔다. Polymarket 예측 시장에서 83% 확률이 배정됐고, OpenAI 수석 과학자도 GPT-5.5 대비 '의미 있는 개선'이라 언급한 것으로 알려졌다.
DeepSeek이 4월 24일 V4 Pro를 프리뷰 공개했다. 총 1.6조 파라미터(활성 490억)의 MoE 아키텍처, 100만 토큰 컨텍스트, MIT 라이선스로 SWE-bench Verified 80.6%를 달성하며 출력 토큰당 $0.87에 제공한다.
구글이 Google I/O에서 '다음 달까지' 출시를 공언한 Gemini 3.5 Pro가 6월 19일 현재 Vertex AI 일부 기업 고객 전용 프리뷰에 그치고 있다. 마감까지 11일이 남은 가운데 예측 마켓은 달성 확률을 50~55%로 보고 있다.
알리바바가 오픈소스 코딩 특화 MoE 모델 Qwen3-Coder-Next를 공개했다. 총 800억 파라미터 중 추론 시 30억만 활성화하는 초희소 구조로, 동급 밀집 모델 대비 처리량이 최대 10배 높다.
미 하원 의원들이 269페이지 분량의 포괄적 연방 AI 법안 초안을 공개했다. 주(州) AI 규제를 3년간 유예하고 연매출 5억 달러 이상 AI 기업에 구속력 있는 의무를 부과하는 내용이다.
Zhipu AI의 Z.ai가 744B 파라미터 MoE 모델 GLM-5.2를 공개했다. 실사용 100만 토큰 컨텍스트와 두 가지 사고 강도를 제공하며, 벤치마크 수치 없이 출시한 점이 이례적이다.
중국 AI 연구소 MiniMax가 6월 1일 오픈웨이트 모델 M3를 출시했다. 새로운 희소 어텐션 구조(MSA)로 100만 토큰 컨텍스트를 구현하고, SWE-Bench Pro에서 GPT-5.5를 상회하는 성능을 GPT-5.5 비용의 5~10% 수준에 제공한다.
Google I/O 2026에서 공개된 Gemini 3.5 Flash는 전년도 Pro 모델을 코딩·에이전트 벤치마크에서 앞서며, 속도는 4배, 비용은 40% 저렴하다.
OpenAI가 GPT-5.5 Instant를 ChatGPT의 새 기본 모델로 교체하고, 6월 9일부터 무료(Go·Free) 사용자에게도 개인화 기능을 개방했다. 이전 모델 대비 환각 52.5% 감소, 과거 대화·파일·Gmail 참조 가능.
메타가 오픈소스 전략을 뒤집고 첫 독점 AI 모델 Muse Spark를 공개했다. 14.3조 원을 들여 AI 스택을 전면 재구축한 결과물이다.
AIWire가 매일 업데이트되는 LLM 최신 소식 코너를 엽니다. 한국어와 영어로 핵심만 정리합니다.