D-FINE-seg: 객체 탐지·인스턴스·시맨틱 분할을 하나의 모델로 통합한 실시간 프레임워크
D-FINE-seg – detection, instance and semantic segmentation in one model

D-FINE-seg는 객체 탐지, 인스턴스 분할, 시맨틱 분할을 하나의 코드베이스와 설정 플래그(task: detect | segment | sem_seg)로 처리하는 실시간 프레임워크입니다. N부터 X까지 5가지 모델 크기를 지원하며, 데이터 준비부터 학습(DDP, EMA, AMP, mosaic), 내보내기(ONNX, TensorRT, OpenVINO, CoreML, LiteRT), 다중 백엔드 추론까지의 종단 간 워크플로우를 제공합니다. Cityscapes 벤치마크에서 YOLO26과 RF-DETR을 능가하는 정확도를 보이면서도 파라미터 수는 2~3배 적고, RGB+열화상 등 다중 채널 입력을 지원합니다.
COCO 사전 학습 가중치가 자동 다운로드되어, 처음부터가 아닌 학습된 마스크 디코더에서 시작하여 미세 조정할 수 있습니다.