JoyAI-Image
https://github.com/jd-opensource/JoyAI-Image
jd-opensource
/JoyAI-Image
Qwen-Image-Edit
と同じようなアーキテクチャで、空間理解とカメラ操作を重点的に再学習したモデル
OpenSpatial
3Dデータや複数視点画像から、物体の位置・距離・前後関係、カメラの向きなどを自動で質問応答データへ変換する
約1,130万件のデータでQwen3-VL-8Bをファインチューニングし、3D空間を理解できるようにする
https://gyazo.com/21d4e16dff9060b7e8e718c820f42972
競合に比べて、物体移動、物体回転、カメラ移動に強い
Model Zoo
https://huggingface.co/jdopensource/JoyAI-Image-Edit
jdopensource/JoyAI-Image-Edit
https://huggingface.co/jdopensource/JoyAI-Image-Edit-Plus-Diffusers
jdopensource/JoyAI-Image-Edit-Plus-Diffusers
複数の参照画像を使えるようにしたver
https://github.com/Comfy-Org/ComfyUI/pull/14428
ComfyUIコアに実装
🦊JoyAI-Image
関連
Qwen-Image-Edit-2511-Multiple-Angles-LoRA
画像編集
image2image