OpenAI, GPT-5.6 Sol 'Ultrafast' 모드 공개 — 기존 대비 최대 14배 빠른 속도
한 줄 요약: OpenAI가 Cerebras 인프라 위에서 GPT-5.6 Sol을 초당 750 토큰으로 실행하는 'Ultrafast' 모드를 API 프리뷰로 선보였다.
핵심
- 최대 처리 속도는 초당 750 출력 토큰으로, 기존 Standard 티어 대비 최대 14배 빠르다고 OpenAI는 밝혔다.
- 현재 OpenAI API의 일부 고객 대상으로만 한정 프리뷰 중이며, 가격·정식 출시일·모델 ID는 미공개 상태다.
- 코딩·금융·고객 지원·연구·인시던트 대응 등 지연 민감 워크플로에 우선 적용을 테스트 중이다.
- 성능 수치는 OpenAI 자체 측정이며, 독립적인 제3자 벤치마크는 아직 없다.
왜 중요한가
추론 속도는 실시간 에이전트와 대화형 서비스의 핵심 제약 중 하나다. 14배 속도 향상이 실제로 검증되면, 현재 응답 지연 때문에 AI를 도입하지 못한 실시간 서비스 영역(라이브 고객 응대, 코드 자동완성, 실시간 분석)에서 채택이 급격히 늘어날 수 있다. 다만 가격이 공개되지 않은 만큼 비용 대비 효용은 추후 확인이 필요하다.
더 보기
- OpenAI introduces 'Ultrafast' mode for GPT-5.6 Sol — TechCrunch
- Previewing Ultrafast mode (공식 발표) — OpenAI