Skip to content
AI 인텔리전스Jul 30, 2026AI 인텔리전스
기사

OpenAI는 GPT-5.6 Sol 모델이 ARC-AGI-3 벤치마크에서 Anthropic의 Opus 5를 능가한다고 주장하지만, 이는 OpenAI 자체 API 기능을 사용할 때만 그렇습니다.

공식 테스트 환경에서는 모델 점수가 훨씬 낮아 벤치마크 비교에 대한 논쟁을 촉발했습니다.

Data Cube AI 편집팀출처: The Decoder
01

출처 브리프

OpenAI는 GPT-5.6 Sol 모델이 ARC-AGI-3 벤치마크에서 Anthropic의 Opus 5를 능가한다고 주장하지만, 이는 OpenAI 자체 API 기능을 사용할 때만 그렇습니다. 공식 테스트 환경에서는 모델 점수가 훨씬 낮아 벤치마크 비교에 대한 논쟁을 촉발했습니다.