728x90 반응형 claudefable1 GPT-6 Astra, 얼마나 강해졌을까? 7개 벤치마크를 아주 쉽게 풀어봤습니다 GPT-6 Astra, 얼마나 강해졌을까? 7개 벤치마크를 아주 쉽게 풀어봤습니다OpenAI가 공개한 GPT-6 Astra의 성능표를 보면 숫자가 꽤 인상적입니다. GPT-5.6 Sol뿐 아니라 Anthropic의 Claude Fable 5.1과 비교해도 여러 영역에서 높은 점수를 기록했습니다. 특히 과학 연구, 업무 자동화, 수학, 3D 설계, 새로운 문제를 스스로 파악하는 능력에서 큰 차이가 보입니다. OpenAI 역시 Astra를 과학·전문 업무·코딩·컴퓨터 사용·추상 추론 등에서 크게 발전한 모델로 소개하고 있습니다. (OpenAI)그런데 Terminal-Bench, FrontierMath, ARC-AGI 같은 이름만 보면 도대체 뭘 테스트한 것인지 알기 어렵죠. 이번 글에서는 첨부된 이미지에 등.. 2026. 9. 4. 이전 1 다음 728x90 반응형