Black Forest LabsのFLUX 3 Image、bounding boxでピクセル単位まで制御

Black Forest Labsが画像生成モデルFLUX 3 Imageを公開した。キャンバスは縦横0〜1000のグリッドとして扱われ、bounding boxで要素の位置を指定し、シーン全体のプロンプトと組み合わせて画像を構成できる。ゼロからの生成にも対応し、商用weightsの相談も受け付けている。
Control every pixel.
- vunderba
ここで彼らが強調していることの一つは、画像内の特定の要素を好きな位置に配置できるようにするUXまわりだと思う。全体の構図の中でコンポーネントの位置がとても重要な場合、これはそれをずっと簡単にしてくれるようで、どことなくInvokeAIを思い出させる。
6月にリリースされたオープンウェイトモデルのIdeogram V4もこれができる[1]けれど、さまざまなバウンディングボックスを記述するのに比較的面倒なJSON構造を使わなければならない。なので間違いなくちょっと厄介だ。
おそらく私は、彼らがFlux.2 / Kleinでやったようにオープンウェイトになるまで(できれば早く)待つことになるだろう。
[1] - https://docs.ideogram.ai/using-ideogram/getting-started/prom...
- vergessenmir
私たちはみんなオープンウェイトかローカルモデルのリリースを待っているのだと思う。
- htrp
https://news.ycombinator.com/item?id=49031796
前回の投稿から何が新しいの?GA?