🎬🧩 ابزار جدید ComfyUI برای ماسکگذاری و ویرایش پایدار ویدئو؛ بدون پرش و درزهای آزاردهنده
پکیج سفارشی MaskVidExperiments برای کار حرفهای با Mask در ویدئوهای ComfyUI ساخته شده؛ مخصوصاً زمانی که میخواهید یک شیء متحرک را جداگانه پردازش کنید و بعد نتیجه را دقیقاً به ویدئوی اصلی برگردانید.
مشکل رایج در چنین Workflowهایی این است که ماسک در طول زمان کمی میلرزد، شیء برای چند فریم پشت مانع میرود یا از مرکز Crop خارج میشود و نتیجه نهایی دچار:
پرش، Flicker، تغییر اندازه Crop یا درزهای قابلمشاهده
میشود.
🔥 این پکیج چند ابزار برای حل همین مشکلات دارد.
قابلیت Subject Crop یک Crop پایدار دور سوژه میسازد؛ یعنی به نویز Mask، Occlusionهای کوتاه یا گمشدن موقت سوژه واکنش عصبی نشان نمیدهد و فقط حرکت واقعی و پایدار شیء را دنبال میکند.
بعد از پردازش، ابزار Subject Uncrop نتیجه را با دقت پیکسلی به موقعیت اصلی برمیگرداند و لبهها را نرم میکند تا مرز ویرایش در تصویر دیده نشود.
🧹 قابلیت Mask Cleanup نیز برای تمیزکردن ماسکهای ویدئویی طراحی شده است.
نقاط اضافی، لکههای چشمکزن و Artifactهایی که بین فریمها ظاهر و ناپدید میشوند حذف میشوند، درحالیکه خود سوژه اصلی حفظ میشود.
🧠 بخش فنی جالبتر مربوط به Mask To Latent Space است.
در بسیاری از Pipelineهای ویدئویی، ماسک ابتدا در فضای Pixel ساخته میشود اما مدل در فضای Latent کار میکند.
اگر ماسک فقط با Resize معمولی کوچک شود، مرزها ممکن است Blur شوند و ناحیه Inpainting دقیق نباشد.
این ابزار ماسک را براساس ساختار VAE به فضای Latent میبرد تا ناحیه ویرایش دقیقتر باقی بماند.
مثلاً برای کاری مثل:
🚗 خودرو → 🐕 سگ ژرمن شپرد
در ویدئوی LTX، محدودهای که باید بازتولید شود تمیزتر و کنترلشدهتر خواهد بود.
🎵 حتی برای صوت هم قابلیت مشابهی وجود دارد.
ابزار Audio Mask To Latent اجازه میدهد فقط بخشهای زمانی مشخصی از Audio Latent دوباره تولید شوند؛ قابلیتی که برای مدلهایی مانند MiniMax H3 و LTX-2 میتواند کاربردی باشد.
✨ قابلیت Differential Diffusion (Soft) نیز روی مرز Mask در طول مراحل Denoising کار میکند تا Edgeها نرمتر و از نظر زمانی پایدارتر باشند.
بهطور خلاصه Workflow میتواند چیزی شبیه این باشد:
🎥 ویدئو → 🎯 ماسک سوژه → ✂️ Crop پایدار → 🤖 ویرایش مولد → 🧩 Uncrop دقیق → 🎬 خروجی بدون لرزش و درز
💡 این نوع ابزارها شاید از یک مدل جدید Video Generation کمتر سر و صدا کنند، اما در کار واقعی بسیار مهماند.
چون مشکل اصلی ویرایش ویدئو با AI اغلب این نیست که مدل «نمیتواند» چیزی را تغییر دهد؛ مشکل این است که تغییر باید در صدها فریم، پایدار و دقیق باقی بماند.
و MaskVidExperiments دقیقاً روی همین بخش سخت Workflow تمرکز کرده است.
https://github.com/drozbay/MaskVidExperiments
@rss_ai_ir
❤️ حمایت از کانال:
https://daramet.com/Virsun
#هوش_مصنوعی #ویرایش_ویدئو #کامفی_یوآی #ماسک #تقسیم_بندی #تولید_ویدئو #ComfyUI #MaskVidExperiments #VideoEditing #Segmentation #Inpainting #LTX #MiniMaxH3 #GenerativeAI #AI
پکیج سفارشی MaskVidExperiments برای کار حرفهای با Mask در ویدئوهای ComfyUI ساخته شده؛ مخصوصاً زمانی که میخواهید یک شیء متحرک را جداگانه پردازش کنید و بعد نتیجه را دقیقاً به ویدئوی اصلی برگردانید.
مشکل رایج در چنین Workflowهایی این است که ماسک در طول زمان کمی میلرزد، شیء برای چند فریم پشت مانع میرود یا از مرکز Crop خارج میشود و نتیجه نهایی دچار:
پرش، Flicker، تغییر اندازه Crop یا درزهای قابلمشاهده
میشود.
🔥 این پکیج چند ابزار برای حل همین مشکلات دارد.
قابلیت Subject Crop یک Crop پایدار دور سوژه میسازد؛ یعنی به نویز Mask، Occlusionهای کوتاه یا گمشدن موقت سوژه واکنش عصبی نشان نمیدهد و فقط حرکت واقعی و پایدار شیء را دنبال میکند.
بعد از پردازش، ابزار Subject Uncrop نتیجه را با دقت پیکسلی به موقعیت اصلی برمیگرداند و لبهها را نرم میکند تا مرز ویرایش در تصویر دیده نشود.
🧹 قابلیت Mask Cleanup نیز برای تمیزکردن ماسکهای ویدئویی طراحی شده است.
نقاط اضافی، لکههای چشمکزن و Artifactهایی که بین فریمها ظاهر و ناپدید میشوند حذف میشوند، درحالیکه خود سوژه اصلی حفظ میشود.
🧠 بخش فنی جالبتر مربوط به Mask To Latent Space است.
در بسیاری از Pipelineهای ویدئویی، ماسک ابتدا در فضای Pixel ساخته میشود اما مدل در فضای Latent کار میکند.
اگر ماسک فقط با Resize معمولی کوچک شود، مرزها ممکن است Blur شوند و ناحیه Inpainting دقیق نباشد.
این ابزار ماسک را براساس ساختار VAE به فضای Latent میبرد تا ناحیه ویرایش دقیقتر باقی بماند.
مثلاً برای کاری مثل:
🚗 خودرو → 🐕 سگ ژرمن شپرد
در ویدئوی LTX، محدودهای که باید بازتولید شود تمیزتر و کنترلشدهتر خواهد بود.
🎵 حتی برای صوت هم قابلیت مشابهی وجود دارد.
ابزار Audio Mask To Latent اجازه میدهد فقط بخشهای زمانی مشخصی از Audio Latent دوباره تولید شوند؛ قابلیتی که برای مدلهایی مانند MiniMax H3 و LTX-2 میتواند کاربردی باشد.
✨ قابلیت Differential Diffusion (Soft) نیز روی مرز Mask در طول مراحل Denoising کار میکند تا Edgeها نرمتر و از نظر زمانی پایدارتر باشند.
بهطور خلاصه Workflow میتواند چیزی شبیه این باشد:
🎥 ویدئو → 🎯 ماسک سوژه → ✂️ Crop پایدار → 🤖 ویرایش مولد → 🧩 Uncrop دقیق → 🎬 خروجی بدون لرزش و درز
💡 این نوع ابزارها شاید از یک مدل جدید Video Generation کمتر سر و صدا کنند، اما در کار واقعی بسیار مهماند.
چون مشکل اصلی ویرایش ویدئو با AI اغلب این نیست که مدل «نمیتواند» چیزی را تغییر دهد؛ مشکل این است که تغییر باید در صدها فریم، پایدار و دقیق باقی بماند.
و MaskVidExperiments دقیقاً روی همین بخش سخت Workflow تمرکز کرده است.
https://github.com/drozbay/MaskVidExperiments
@rss_ai_ir
❤️ حمایت از کانال:
https://daramet.com/Virsun
#هوش_مصنوعی #ویرایش_ویدئو #کامفی_یوآی #ماسک #تقسیم_بندی #تولید_ویدئو #ComfyUI #MaskVidExperiments #VideoEditing #Segmentation #Inpainting #LTX #MiniMaxH3 #GenerativeAI #AI