메타 차기 모델 'Watermelon', 내부 벤치마크에서 GPT-5.5 수준 달성
메타 수퍼인텔리전스 랩스 수장 Alexandr Wang이 사내 타운홀에서 차기 플래그십 모델 Watermelon이 GPT-5.5와 동등한 성능을 보였다고 밝혔다. 전 세대 대비 약 10배 더 많은 컴퓨팅을 투입했다.
- Meta
- LLM
- Benchmark
- Model Release
2건의 기사
메타 수퍼인텔리전스 랩스 수장 Alexandr Wang이 사내 타운홀에서 차기 플래그십 모델 Watermelon이 GPT-5.5와 동등한 성능을 보였다고 밝혔다. 전 세대 대비 약 10배 더 많은 컴퓨팅을 투입했다.
OpenAI가 제약·바이오 전문가 173명이 만든 750개 과제 벤치마크 LifeSciBench를 발표했다. 최고 성능 모델도 합격률 약 33%에 그쳐 AI의 실제 과학 연구 역량이 아직 제한적임을 드러냈다.