DeepSeek 자기 인터뷰: AI 비서의 내부를 역설계하다

DeepSeek: Reverse Engineering an AI Assistant by Interviewing Itself

DeepSeek 자기 인터뷰: AI 비서의 내부를 역설계하다

manish.sh 블로그의 'Inside LLMs' 시리즈에서, 저자는 DeepSeek 챗봇에게 자신의 아키텍처에 대해 인터뷰하고, 그 답변을 공개된 논문과 대조합니다. DeepSeek는 관찰, 추론, 추측을 명확히 구분하며 답변했지만, 자신의 가중치나 내부 과정은 볼 수 없다고 인정했습니다. 흥미롭게도, 256명의 전문가와 671B/37B 파라미터 같은 공개된 사양에 대해서는 추측이라고 답했지만, V3 논문에는 명확히 문서화되어 있습니다. 저자는 아키텍처 수치는 arXiv 논문을, 행동과 프롬프트 직관은 챗봇을 참고하라고 조언합니다.

DeepSeek는 자신이 말할 내용을 말하면서 발견한다고 말했습니다. 즉, "let me think..."은 별도의 사고 과정이 아니라 같은 엔진에서 생성된 더 많은 토큰일 뿐입니다.

같은 날의 다른 소식

2026-08-11