FLUX 3: el nuevo modelo multimodal de Black Forest Labs que aprende del mundo real
Black Forest Labs presenta FLUX 3, su primer modelo fundacional multimodal que aprende conjuntamente de imágenes, vídeos y audio en una arquitectura unificada. El modelo genera vídeo con audio nativo de hasta 20 segundos, edita imágenes con alta precisión de texto y predice acciones para robótica. En evaluaciones preliminares, supera a modelos como Runway Gen-4.5 y Luma Ray 3.2 en preferencia humana. Disponible en acceso anticipado.
Las modalidades dejan de ser entidades separadas y se convierten en evidencia sobre una única realidad subyacente.