ShapeLearn, Qwen 3.8 27B 양자화로 품질-속도 한계를 다시 그리다
Shapelearn Qwen 3.8 27B (13.1 GB VRAM)
ByteShape가 Qwen 3.8 27B의 전체 ShapeLearn 양자화 모델을 공개했다. GPU-5는 13.1GB VRAM으로 BF16 기준 99.63% 품질을 달성하며 6개 GPU 비교에서 모두 품질-속도 프런티어에 올랐다. GPU-4는 11.0GB로 98.72%를 기록하며 더 빠르다. MTP 또는 DFlash2 추측 디코딩을 적용하면 모든 모델에서 처리량이 향상된다.
GPU-5는 기본 권장 사항으로, BF16의 종합 벤치마크 점수 중 99.63%에 도달합니다.