FLUX 3 Image, bounding box로 픽셀 하나까지 통제한다

Black Forest Labs가 FLUX 3 Image를 공개했다. 이미지를 처음부터 구성할 때 bounding box로 각 요소의 위치와 크기를 지정하고, 캔버스는 가로세로 모두 0에서 1000까지의 좌표계로 다뤄 레이아웃을 정밀하게 제어한다. 장면 프롬프트와 박스만으로 이미지를 생성하는 방식으로, 생성형 이미지 모델의 통제권을 사용자에게 넘기는 것이 핵심이다.
Lay out the image exactly how you want using bounding boxes.
- vunderba
여기서 그들이 강조하는 것 중 하나는 이미지에서 특정 요소를 원하는 위치에 배치할 수 있게 해주는 UX인 것 같아요. 전체 구성에서 컴포넌트들의 위치가 매우 중요하다면, 이게 그걸 훨씬 쉽게 만들어 주는 것 같고 InvokeAI가 떠오르네요.
6월에 공개된 오픈 웨이트 모델인 Ideogram V4도 이걸 할 수 있지만 [1], 모든 다른 바운딩 박스를 설명하기 위해 상대적으로 번거로운 JSON 구조를 사용해야 해요. 그래서 확실히 좀 귀찮은 일이죠.
아마 Flux.2 / Klein 때처럼 오픈 웨이트로 풀릴 때까지(곧 풀리길 바라며) 기다릴 것 같아요.
[1] - https://docs.ideogram.ai/using-ideogram/getting-started/prom...
- vergessenmir
우리 모두 오픈 웨이트나 로컬 모델 공개를 기다리고 있는 것 같아요.
- htrp
https://news.ycombinator.com/item?id=49031796
지난 포스트 이후로 뭐가 새로운가요? GA인가요?