Hetzner、LLM推論APIの実験を開始
Hetzner is working on LLM Inference

Hetznerが、自社インフラ上で動作するOpenAI互換の推論API「Hetzner Inference」の実験を開始した。現在は無料で、モデルはQwen/Qwen3.6-35B-A3B-FP8のみ。実験段階であり、SLAや課金はない。筆者が試したところ、応答速度は高速で、テキストと画像の両方を処理できる。しかし、この製品の真の意義はモデルではなく、Hetznerが低マージンのインフラ製品として推論市場に参入する可能性を示唆している点にある。今後のハードウェア展開が鍵となる。
Hetznerが推論をテストしているのは、モデルそのものよりも、その背後にある戦略が興味深いからだ。