← أحدث الأبحاث
💻 computer science

InfinityEdit: Infinite Video Editing with a Lightweight Edit-Ignition Adapter

تقدم الورقة البحثية InfinityEdit، وهو مُكيِّف خفيف الوزن لمولدات الفيديو مسبقة التدريب يتيح تحريراً غير محدود ومبنياً على التعليمات للفيديو المتدفق من خلال ضمان الاستمرارية الزمنية الوفية واستقرار جودة التوليد عبر تسلسل لانهائي من طلبات التحرير.

المؤلفون الأصليون: Yunze Tong, Mushui Liu, Canyu Zhao, Shiyi Zhang, Didi Zhu, Peng Zhang, Wanggui He, Jinlong Liu, Ying Chen, Hao Jiang, Pipei Huang, Bo Zheng

نُشر 2026-08-24
📖 5 دقيقة قراءة🧠 قراءة متعمّقة

المؤلفون الأصليون: Yunze Tong, Mushui Liu, Canyu Zhao, Shiyi Zhang, Didi Zhu, Peng Zhang, Wanggui He, Jinlong Liu, Ying Chen, Hao Jiang, Pipei Huang, Bo Zheng

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أنك تشاهد بثًا مباشرًا لمباراة كرة قدم، وفجأة تمنيت لو أن الملعب بأكمله بدا وكأنه لوحة مائية، أو أردت أن تهبط الكاميرا فجأة من السماء لتتبع الكرة. في عالم الذكاء الاصطناعي، عادة ما يكون إنشاء مثل هذه التغييرات عملية جامدة. يمكن للأدوات الحالية أن تأخذ مقطع فيديو قصيرًا ومنتهيًا وتعدله، لكنها تعامل المقطع كصندوق مغلق. يمكنها إعادة كتابة ما هو موجود بالفعل، لكنها لا تستطيع بسهولة التطلع إلى المستقبل لتغيير ما سيحدث بعد ذلك. إذا استمر الفيديو في العمل، فإن القواعد القديمة تتوقف عن العمل، ويختفي النمط الجديد أو زاوية الكاميرا الجديدة. هذا القصور يجعل من الصعب تحرير البث المباشر أو المشاهد المستمرة حيث لا تزال القصة قيد التطور.

لقد عالج فريق من الباحثين هذه المشكلة من خلال تطوير طريقة جديدة لتحرير مقاطع الفيديو التي لا تنتهي أبدًا. أطلقوا على نهجهم اسم "تحرير الفيديو اللانهائي" (infinite video editing). فبدلاً من إجبار الفيديو على التناسب مع فترة زمنية ثابتة، تسمح طريقتهم للذكاء الاصطناعي بتطبيق تغيير ما — مثل نمط بصري جديد أو حركة كاميرا — ثم الاستمرار في توليد إطارات جديدة تواصل ذلك التغيير بشكل طبيعي إلى الأبد. النظام لا يعيد كتابة الماضي فحسب؛ بل يتعلم كيف يحمل التعديل إلى المستقبل، مما يضمن بقاء الفيديو متسقًا وعالي الجودة حتى مع وصول تعليمات جديدة واحدة تلو الأخرى.

بدأ الباحثون بإدراك أن محرري الفيديو الحاليين يعملون بناءً على افتراض بسيط: وهو أن الفيديو قد انتهى بالفعل. فهم يأخذون مقطعًا مصدريًا وينتجون نسخة معدلة بنفس الطول تمامًا. هذا يعمل جيدًا للأفلام القصيرة أو منشورات وسائل التواصل الاجتماعي، لكنه يفشل عندما يكون الفيديو عبارة عن تدفق مستمر، مثل مباراة مباشرة أو تغذية كاميرا مراقبة. في هذه الحالات، يستمر الفيديو في النمو. إذا أردت تغيير نمط اللقطات في منتصف الطريق، يجب أن يمتد التعديل ليشمل كل إطار جديد يظهر. الطرق القديمة لا تستطيع فعل ذلك لأنها مصممة للنظر إلى الوراء نحو مقطع ثابت، وليس إلى الأمام نحو تدفق مفتوح النهايات.

ولحل هذه المشكلة، قام الفريق أولاً ببناء طريقة لتعليم الحواسيب كيفية التعامل مع هذا التحدي المحدد. لقد أنشأوا مجموعة ضخمة من الأمثلة التدريبية؛ حيث أخذوا فيديوهات موجودة وربطوها بتعليمات لكيفية تغييرها، مثل "اجعل هذا يبدو كقصة مصورة" أو "حرك الكاميرا للأسفل". والأهم من ذلك، أنهم لم يطلبوا من الكمبيوتر فقط تغيير الإطارات الموجودة، بل قاموا بتوليد مقاطع فيديو جديدة تستمر من اللقطات الأصلية مع تطبيق التغيير المطلوب. علم هذا النظام أن التعديل ليس مجرد مرشح (فلتر) يُطبق على لقطة ثابتة، بل هو اتجاه جديد يأخذه المسار الدرامي. لقد قاموا بتصفية هذه البيانات بعناية لضمان أن تبدو مقاطع الفيديو الجديدة واقعية وأن يتم تطبيق التغييرات بشكل صحيح دون كسر انسيابية المشهد.

ومع توفر هذه البيانات، قدموا نظامًا جديدًا يسمى "InfinityEdit". يعمل هذا النظام عن طريق إرفاق "مهايئ" (adapter) صغير وخفيف الوزن بمولد فيديو قوي بارع جدًا في صنع فيديوهات طويلة. تخيل المولد الرئيسي كفنان ماهر يمكنه رسم تدفق مستمر من الصور، والمهايئ كفرشاة خاصة يمكنها تغيير نمط الرسم أثناء العمل. يظل المولد الرئيسي "مجمدًا"، مما يعني أن معرفته الجوهرية بكيفية إنشاء فيديو مستقر وعالي الجودة لا تتغير أبدًا. المهايئ هو الجزء الوحيد الذي يتعلم؛ فهو يتمركز بين المولد وتعليمات المستخدم، ويكون مستعدًا للتدخل فقط عند وصول طلب تعديل جديد.

عندما يرسل المستخدم تعليمات، يتم تفعيل المهايئ لقطعة قصيرة واحدة فقط من الفيديو. يأخذ التعليمات وتاريخ الفيديو الأخير ويولد جزءًا جديدًا من الإطارات يطبق التغيير. يعمل هذا الجزء الجديد كجسر؛ فبمجرد إنشاء هذا الجزء المعدل الأول، يتوقف المهايئ عن العمل، ويتولى المولد الرئيسي المهمة مرة أخرى. ولأن المولد الرئيسي ينظر الآن إلى الإطارات المعدلة حديثًا كجزء من تاريخه، فإنه يستمر في الفيديو بشكل طبيعي بالنمط الجديد أو بزاوية الكاميرا الجديدة. لقد تم "إشعال" التعديل، والنظام يحمله للأمام تلقائيًا. يمكن تكرار هذه العملية بلا نهاية؛ فإذا وصلت تعليمات ثانية لاحقًا، يستيقظ المهايئ مرة أخرى لتطبيق التغيير الجديد، ويستمر المولد من هناك.

وجد الباحثون أن هذا النهج يحل مشكلتين رئيسيتين عادة ما تعيب توليد الفيديو الطويل. الأولى هي الاتساق؛ ففي العديد من الأنظمة، إذا حاولت تعديل فيديو يتم توليده بالفعل، فإن التغييرات غالبًا ما تتلاشى أو تضيع مع تقدم الفيديو، وقد تعود الإطارات الجديدة إلى مظهرها الأصلي. يمنع "InfinityEdit" حدوث ذلك عن طريق إعادة ضبط نقطة مرجعية رئيسية في كل مرة يحدث فيها تعديل، مما يضمن بقاء الفيديو مرتبطًا بآخر تغيير تم، والحفاظ على استقرار النمط أو زاوية الكاميرا طالما استمر الفيديو.

التحدي الثاني هو الجودة؛ فعندما يقوم الكمبيوتر بتوليد فيديو إطارًا تلو الآخر، يمكن أن تتراكم الأخطاء الصغيرة بمرور الوقت، مما يجعل الصورة تبدو ضبابية أو مشوهة. درب الباحثون المهايئ الخاص بهم على التعامل مع التاريخ غير المثالي؛ فقد أعطوا النظام عمدًا أمثلة حيث كانت الإطارات السابقة معيبة قليلاً، لتعليمه كيفية التعافي وإنتاج نتائج نظيفة حتى لو لم يكن المدخل مثاليًا. هذا التدريب يسمح للنظام بالبقاء مستقرًا حتى بعد جولات عديدة من التعديل، مما يمنع الفيديو من التدهور مع زيادة طوله.

في اختباراتهم، طبق النظام بنجاح مجموعة متنوعة من التعديلات على تدفقات الفيديو المستمرة. استطاع تغيير النمط البصري للمشهد، أو تغيير حركة الكاميرا، أو تعديل مظهر الأشياء، ثم الاستمرار في توليد الفيديو مع بقاء تلك التغييرات قائمة. أظهرت النتائج أن الفيديو ظل مخلصًا للتعليمات ولم يعد إلى حالته الأصلية. تعامل النظام مع هذه التغييرات بشكل متكرر دون فقدان الجودة، مما أثبت أنه من الممكن تحرير تدفق الفيديو أثناء حدوثه، بدلاً من الانتظار حتى ينتهي الفيديو.

يفتح هذا العمل الباب أمام نوع جديد من التفاعل مع الفيديو. فبدلاً من تحرير منتج نهائي، يمكن للمستخدمين الآن توجيه الفيديو أثناء إنشائه. وسواء كان ذلك عبر إعادة تصميم نمط بث رياضي مباشر في الوقت الفعلي أو تغيير منظور كاميرا افتراضية أثناء تسجيل طويل، فإن هذه التكنولوجيا توفر وسيلة لإبقاء التعديل حيًا بينما تتكشف القصة. لقد أثبت الباحثون أنه من خلال الجمع بين مولد مستقر ومُدرب مسبقًا ومهايئ مرن وخفيف الوزن، يمكننا إنشاء أدوات لتحرير الفيديو لا يحدها الزمن، مما يتيح تدفقًا لانهائيًا حقًا من الإمكانيات الإبداعية.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →