D-FINE-seg:1つのモデルで物体検出・インスタンス・セマンティックセグメンテーションを実現

D-FINE-seg – detection, instance and semantic segmentation in one model

D-FINE-seg:1つのモデルで物体検出・インスタンス・セマンティックセグメンテーションを実現

D-FINE-segは、物体検出、インスタンスセグメンテーション、セマンティックセグメンテーションを1つのコードベースで行えるリアルタイム推論フレームワークです。設定フラグを切り替えるだけで3つのタスクに対応し、モデルサイズはNからXまで5種類。CityscapesではYOLO26やRF-DETRを上回る精度を、2〜3倍少ないパラメータで達成。ONNX、TensorRT、OpenVINO、CoreML、LiteRTへのエクスポートと、マルチバックエンドでの推論・ベンチマークに対応しています。RGB+熱画像などのマルチチャンネル入力もサポート。

Cityscapesでは、YOLO26とRF-DETRを検出・インスタンスセグメンテーションのF1で上回り、セマンティックセグメンテーションのmIoUでもリードし、リアルタイムレイテンシでありながらパラメータ数は2〜3分の1です。

この日のほかの記事

2026-07-25