DeepSeek, 552B MoE 모델 V4.1-Flash 공개…KV 캐시는 4분의 1로

DeepSeek v4.1 Flash

DeepSeek, 552B MoE 모델 V4.1-Flash 공개…KV 캐시는 4분의 1로

DeepSeek이 새로운 아키텍처 계열의 가장 작은 모델 V4.1-Flash를 공개했다. 552B 파라미터 MoE에 비대칭 Causal Encoder–Decoder 구조를 적용해 입력에는 8B, 출력에는 16B의 활성 파라미터만 사용한다. KV 캐시는 이전 세대 대비 HBM 4분의 1, SSD 8분의 1로 줄어 에이전트 비용 부담을 크게 낮췄다. DeepSeek API에서 deepseek-flash로 바로 사용할 수 있으며, 오픈소스 커뮤니티와의 추론 지원 협력도 예고했다.

새로운 Causal Encoder–Decoder 아키텍처: 입력에는 8B, 출력에는 16B의 활성 파라미터만 사용합니다.

이 날의 다른 글

2026-09-10