マルチモーダル GitHub LabVLALabVLAは、Qwen3-VL-4B-Instructビジョン言語モデルを、DiTフローマッチングアクションエキスパートと独自のπ0.5レシ… #CLI #GPU必須 #Python ★ 83 ⑂ 4 MIT 2026-07-04