본문 바로가기
728x90
반응형

GPT5.6Sol2

GPT-6 Astra, 얼마나 강해졌을까? 7개 벤치마크를 아주 쉽게 풀어봤습니다 GPT-6 Astra, 얼마나 강해졌을까? 7개 벤치마크를 아주 쉽게 풀어봤습니다OpenAI가 공개한 GPT-6 Astra의 성능표를 보면 숫자가 꽤 인상적입니다. GPT-5.6 Sol뿐 아니라 Anthropic의 Claude Fable 5.1과 비교해도 여러 영역에서 높은 점수를 기록했습니다. 특히 과학 연구, 업무 자동화, 수학, 3D 설계, 새로운 문제를 스스로 파악하는 능력에서 큰 차이가 보입니다. OpenAI 역시 Astra를 과학·전문 업무·코딩·컴퓨터 사용·추상 추론 등에서 크게 발전한 모델로 소개하고 있습니다. (OpenAI)그런데 Terminal-Bench, FrontierMath, ARC-AGI 같은 이름만 보면 도대체 뭘 테스트한 것인지 알기 어렵죠. 이번 글에서는 첨부된 이미지에 등.. 2026. 9. 4.
OpenAI가 말하는 ‘Astra’의 등장 OpenAI가 말하는 ‘Astra’의 등장해킹 능력이 인간 전문가 수준을 넘어선 AI, 그래서 더 강한 안전장치가 필요하다2026년 9월 1일, OpenAI가 조금 특별한 글을 공개했습니다.제목은 「Path to Astra: critical capabilities and frontier safeguards」.우리말로 하면 “Astra로 가는 길: 핵심 능력과 프론티어 안전장치” 정도로 이해할 수 있습니다.그런데 이 글은 단순히 새로운 AI 모델의 성능을 자랑하는 발표문이 아닙니다.오히려 반대에 가깝습니다.“Astra는 너무 강력해졌기 때문에, 공개하기 전에 훨씬 더 강한 안전장치가 필요했다.”OpenAI가 이번 글에서 강조한 핵심 메시지입니다.1. Astra는 도대체 무엇일까?OpenAI가 공개한 자료에.. 2026. 9. 2.
728x90
반응형