پروژه SceneMosaic؛ از یک عکس به چندین صحنه سه‌بعدی آماده شبیه‌سازی… — VIRSUN — TG.ME

🏠🧩 پروژه SceneMosaic؛ از یک عکس به چندین صحنه سه‌بعدی آماده شبیه‌سازی

پروژه SceneMosaic از HKU و UESTC تلاش می‌کند سرعت روش‌های Image-to-3D را با منطق فیزیکی Agentها ترکیب کند. از یک تصویر مرجع ابتدا اشیا بازسازی و از نظر فیزیکی پایدار می‌شوند، سپس چندین چیدمان متفاوت و معتبر از همان صحنه تولید می‌شود.

نکته جالب، استفاده از VLM Agentهای Critic–Actor است؛ Agentها نماهای Orthographic صحنه را بررسی می‌کنند، خطاهایی مثل اجسام معلق، برخورد اشیا یا چیدمان نامعقول را اصلاح کرده و همزمان Layoutهای جدید پیشنهاد می‌دهند.

برای افزایش تنوع نیز صحنه به بخش‌های محلی تقسیم می‌شود؛ هر بخش مستقل تغییر می‌کند و در پایان ترکیب‌های متفاوت اما معتبر انتخاب می‌شوند.

⏱️ طبق اعلام سازندگان، ساخت صحنه پایه حدود ۸ دقیقه و تولید هر Variant اضافی حدود ۲ دقیقه زمان می‌برد.

🔥 هدف فقط «تبدیل عکس به 3D» نیست؛ بلکه ساخت چندین محیط سه‌بعدی متنوع و از نظر فیزیکی قابل استفاده برای Simulation است.

https://rxjfighting.github.io/SceneMosaic/

https://github.com/rxjfighting/SceneMosaic

@rss_ai_ir
❤️ حمایت از کانال:
https://daramet.com/Virsun

#SceneMosaic #ImageTo3D #ImageToScene #3DGeneration #VLM #AIAgents #Simulation #SpatialAI #Robotics #هوش_مصنوعی
👍17👌14🔥10🙏7❤5
September 15, 2026 761 7