과학 벤치마크 리더십이 GPT-6 Astra로 전환
이 성능은 Fable 5.1 비용의 3분의 1 미만으로 달성되었으며, 과학 작업 분야에서 리더십의 중요한 변화를 의미합니다.
Fable 5.1은 실제 과학 애플리케이션에서 이전 모델인 Fable 5보다 상당한 개선을 보였지만, Astra의 효율성이나 출력 품질에는 미치지 못했습니다. Theo는 OpenAI의 후처리 우수성이 이러한 상당한 과학적 발전의 원동력일 가능성이 높다고 분석합니다.
"낮은 Astra는 54.3점을 얻었고 단 11달러만 들었으며, Anthropic이 처음으로 목록에 올린 벤치마크에서 최대 Fable 5.1보다 3분의 1 미만의 가격으로 더 높은 순위를 차지했습니다."


