본문으로 건너뛰기
뉴스 목록

OpenAI, Cerebras에서 GPT-5.6 Sol 최대 750 t/s 초고속 추론 7월 개시

한 줄 요약: OpenAI가 GPT-5.6 Sol을 Cerebras 웨이퍼 스케일 하드웨어에서 최대 750 tokens/s로 7월부터 제공하며, 프론티어 모델 초고속 추론 시대를 열었다.

핵심

  • GPT-5.6 Sol의 Cerebras 구동 속도: 최대 750 t/s — 일반 GPU 클러스터(40~120 t/s) 대비 약 10배
  • 모델 패밀리 가격: Sol $5/$30, Terra $2.50/$15, Luna $1/$6 (입력/출력, 백만 토큰당)
  • 출시 초기에는 파트너 20곳으로 제한; 트럼프 행정부의 안보 검토 요청에 따라 단계적 공개
  • Sol은 장기 에이전트 작업·코딩·과학 추론, Terra·Luna는 비용 효율 일반 용도에 최적화

왜 중요한가

750 t/s는 멀티-스텝 에이전트 루프를 실시간으로 처리할 수 있는 속도다. 지금까지 하룻밤 작업이던 복잡한 코딩·연구 태스크가 대화 속도로 줄어들 수 있어, 에이전트형 AI 도구의 실용성이 한 단계 높아질 것으로 보인다.

더 보기

이 이야기의 흐름

  1. GPT-5.6 Sol, 7월 중순 일반 출시 전망… 정부 협력 후 단계적 해제
  2. OpenAI, GPT-5.6 3단계 라인업 공개 — Sol·Terra·Luna와 에이전트 '울트라 모드'
  3. OpenAI GPT-5.6 공개 — 솔·테라·루나 3종, 미 정부 요청으로 신뢰 파트너만 접근
  4. GPT-5.6, 6월 출시 무산 — 예측 시장 오즈 83%→18%로 급락, 7월 발표 유력
LLM
— Large Language Model의 약자로, '거대 언어 모델'이라고 해요. ChatGPT, Claude 같은 AI가 바로 LLM이에요. 엄청나게 많은 텍스트를 학습해서 사람처럼 글을 쓰고 대화할 수 있어요.

뉴스레터 구독

무료 뉴스레터

매주 핵심 AI 소식, 한 번에 받기

쏟아지는 AI·LLM 뉴스 중 꼭 알아야 할 것만 골라 메일로 보내드려요. 뉴스레터 발송이 시작되면 구독자분들께 가장 먼저 보내드립니다.