모델을 '탐문'해 알아낸 GPT-5.6과 Opus 5의 비밀 훈련 데이터

Exploring Claude/GPT Knowledge Cutoffs and Pre-Training Timelines

모델을 '탐문'해 알아낸 GPT-5.6과 Opus 5의 비밀 훈련 데이터

프론티어 모델의 사전 훈련 데이터를 추정하는 방법을 소개한다. 위키피디아의 일일 사실 퀴즈를 통해 각 모델의 지식 차단 시점을 측정하고, 모델이 스스로를 어떻게 인식하는지 분석한다. 그 결과, Anthropic의 Opus 4.7 이후 모델들이 2025년 12월 말에 끝난 동일한 훈련 데이터를 사용했고, OpenAI의 GPT-5.6 제품군은 2026년 2월 말에 끝난 별도의 체크포인트에서 비롯되었음을 발견했다. 또한 Opus 5의 공식 지식 차단 시점(2026년 5월)이 실제 지식과 불일치하며, Claude 모델들이 GPT-4로 자주 오인되는 등 흥미로운 패턴을 보여준다.

OpenAI 모델은 다른 연구소의 모델로 자신을 식별한 적이 없지만(잠깐 Tesla Model S를 제외하면), Anthropic의 Sonnet 5는 정기적으로 GPT-4로 자신을 식별합니다.

같은 날의 다른 소식

2026-08-10