본문으로 건너뛰기
뉴스 목록

딥시크, 비전 탑재 AI 모델 공개…'앤트로픽 최상위급' 주장

한 줄 요약: 중국 딥시크가 이미지까지 이해하는 새 AI 모델을 내놓으며 앤트로픽 최상위 모델급 성능을 주장한 것으로 전해졌다.

핵심

  • 딥시크가 텍스트뿐 아니라 이미지를 처리하는 비전 지원(멀티모달) AI 모델을 공개했다.
  • 회사 측은 이 모델이 앤트로픽의 최상위 티어 모델에 견줄 만한 성능이라고 주장한 것으로 알려졌다.
  • 저비용·오픈 접근 전략으로 주목받아 온 딥시크가 멀티모달 영역으로 경쟁을 확대한 셈이다.

왜 중요한가

성능 주장은 아직 독립 검증이 필요하지만, 사실이라면 미국 선두권과 중국 오픈 모델의 격차가 멀티모달 영역에서도 좁혀지고 있음을 보여준다. 비용 대비 성능이 핵심 변수가 될 전망이다.

더 보기

이 이야기의 흐름

  1. 알리바바, 3세대 이미지 생성 모델 'Qwen Image 3.0 Pro' 출시 — 벤치마크·가중치 비공개
  2. 바이트댄스, Seedream 5.0 Pro 출시 — GPT-Image 2에 도전하는 전문가용 이미지 AI
  3. 구글, 이미지 4초 생성 'Nano Banana 2 Lite'·동영상 생성 'Gemini Omni Flash' 동시 출시
  4. 알리바바 HappyHorse 1.1, 글로벌 AI 비디오 리더보드 2위 등극 — Sora·Seedance 공백 파고든다
LLM
— Large Language Model의 약자로, '거대 언어 모델'이라고 해요. ChatGPT, Claude 같은 AI가 바로 LLM이에요. 엄청나게 많은 텍스트를 학습해서 사람처럼 글을 쓰고 대화할 수 있어요.
멀티모달
— 텍스트뿐 아니라 이미지, 음성, 영상까지 함께 이해하고 만들어내는 AI를 말해요. 사진을 보여주며 질문하거나, 말로 대화하거나, 영상을 분석하는 게 모두 멀티모달 능력이에요. 지금은 거의 모든 주요 모델이 멀티모달이에요.

뉴스레터 구독

무료 뉴스레터

매주 핵심 AI 소식, 한 번에 받기

쏟아지는 AI·LLM 뉴스 중 꼭 알아야 할 것만 골라 메일로 보내드려요. 뉴스레터 발송이 시작되면 구독자분들께 가장 먼저 보내드립니다.