FlowInOne — фреймворк для генерации изображений в едином визуальном потоке.
Представлен фреймворк FlowInOne для мультимодальной генерации изображений в один визуальный поток.
В отличие от многих моделей, зависящих от текстовых инструкций, FlowInOne преобразует задачи в визуальные подсказки. Он работает по принципу «изображение на входе — изображение на выходе» и обрабатывает разные задачи: от создания изображений по тексту до сложного редактирования с учетом физических законов.
В основе фреймворка используются Stable Diffusion VAE, визуальный энкодер Janus-Pro-1B и другие компоненты.
Исходный код проекта доступен на GitHub и Hugging Face.

