تخطَّ إلى المحتوى الرئيسي
ToolPotion

Lumiere

Lumiere هو نموذج انتشار زمني مكاني من Google Research لتوليد مقاطع فيديو واقعية ومتنوعة ومتماسكة. يقوم بتصنيع مدة الفيديو بالكامل في تمريرة واحدة، مما يتيح مهام متقدمة من النص إلى الفيديو، ومن الصورة إلى الفيديو، وملء الفيديو، والتوليد الأسلوبي مع اتساق زمني مثير للإعجاب.

زيارة الرابط

الوصف

Lumiere هو نموذج انتشار متطور من النص إلى الفيديو طورته Google Research، وهو مصمم لمعالجة تحدي تصنيع الحركة الواقعية والمتنوعة والمتماسكة في مقاطع الفيديو. على عكس النماذج السابقة التي تولد إطارات رئيسية ثم تستخدم دقة زمنية فائقة، يستخدم Lumiere بنية Space-Time U-Net مبتكرة. تقوم هذه البنية بتوليد المدة الزمنية الكاملة للفيديو في تمريرة واحدة، مما يضمن اتساقًا زمنيًا عالميًا فائقًا.

من خلال دمج تقليل وتكبير العينات المكانية والزمانية، والاستفادة من نموذج انتشار مُدرب مسبقًا من النص إلى الصورة، يقوم Lumiere بتوليد مقاطع فيديو منخفضة الدقة بمعدل إطارات كامل مباشرة عبر مقاييس زمنية مكانية متعددة. يسهل هذا النهج مجموعة واسعة من تطبيقات إنشاء المحتوى وتحرير الفيديو. يتفوق Lumiere في توليد الفيديو من النص، حيث ينتج نتائج مثيرة للإعجاب من المطالبات النصية. كما أنه يدعم تحويل الصورة إلى فيديو، مما يسمح للمستخدمين بتحريك الصور الثابتة.

علاوة على ذلك، يتيح Lumiere وظائف تحرير فيديو متقدمة مثل ملء الفيديو، حيث يمكن ملء مناطق معينة من الفيديو أو تعديلها. تتمثل إحدى القدرات الرئيسية في التوليد الأسلوبي، حيث يمكن للمستخدمين تطبيق نمط مستهدف على مقاطع الفيديو التي تم إنشاؤها باستخدام صورة مرجعية واحدة. تسمح هذه الميزة بالتحويلات الإبداعية، مثل جعل مقاطع الفيديو تبدو كـ "ملصق"، "ذهب ذائب ثلاثي الأبعاد"، "كرتون مسطح"، "تصيير ثلاثي الأبعاد"، "رسم خطي"، "متوهج"، أو "رسم بالألوان المائية". يمكن للنموذج أيضًا تحريك مناطق معينة من الصورة لإنشاء صور سينمائية، مما يضيف حركة دقيقة إلى المحتوى الثابت.

يهدف البحث وراء Lumiere إلى تمكين المستخدمين المبتدئين بأدوات إنشاء محتوى مرئي إبداعية ومرنة. ومع ذلك، يقر المطورون بإمكانية إساءة الاستخدام في إنشاء محتوى مزيف أو ضار ويؤكدون على أهمية تطوير أدوات للكشف عن التحيز وتخفيف حالات الاستخدام الضارة لضمان النشر المسؤول.

أبرز ملامح Lumiere

  • بنية Space-Time U-Net لتوليد الفيديو بتمريرة واحدة

  • تصنيع حركة واقعية ومتماسكة

  • توليد الفيديو من النص بناءً على المطالبات

  • تحويل الصورة إلى فيديو

  • قدرات ملء الفيديو

  • توليد الفيديو الأسلوبي باستخدام صور مرجعية

  • إنشاء صور سينمائية عن طريق تحريك مناطق الصورة

  • إخراج فيديو بمعدل إطارات كامل

  • معالجة مقاييس زمنية مكانية متعددة

  • الاستفادة من نماذج الانتشار المدربة مسبقًا من النص إلى الصورة

البدء مع Lumiere

  1. الوصول إلى النموذج: الحصول على الوصول إلى نموذج Lumiere.

  2. المصادقة: إعداد بيانات اعتماد المصادقة اللازمة.

  3. إعداد البيئة: تكوين بيئة التطوير الخاصة بك.

  4. التكامل عبر API: استخدام واجهة برمجة التطبيقات (API) المقدمة لمهام توليد الفيديو.

  5. تحديد المطالبات: إدخال الأوصاف النصية للمحتوى المرئي المطلوب.

  6. تحديد الأساليب: توفير صور مرجعية للتوليد الأسلوبي.

  7. تحرير مقاطع الفيديو: استخدام ميزات الملء أو تحريك المناطق.

  8. تحسين الإخراج: ضبط المعلمات للحصول على جودة الفيديو والاتساق المطلوبين.

حالات استخدام Lumiere

  • إنشاء الفيديو من النص
  • تحريك الصور
  • تحرير الفيديو
  • التنميط الفني
  • إنشاء الصور السينمائية
  • إنشاء المحتوى
  • نماذج مرئية أولية
  • الاستكشاف الإبداعي

الأسئلة الشائعة من Lumiere

تقييمات Lumiere

جاري التحميل...

أدوات ذكاء اصطناعي شائعة مثل Lumiere

نماذج الذكاء الاصطناعي

Imagen Video هو نظام لتوليد الفيديو المشروط بالنص طورته Google Research. يستفيد من سلسلة من نماذج الانتشار للفيديو لإنشاء مقاطع فيديو عالية الدقة من مطالبات نصية، مما يوفر دقة…

مولّدات الفيديو بالذكاء الاصطناعي

نماذج الذكاء الاصطناعي

VideoPoet هو نموذج لغوي كبير من Google Research قادر على توليد الفيديو بدون تدريب مسبق (zero-shot). يقوم بتحويل نماذج اللغة التنبؤية الذاتية إلى مولدات فيديو عالية الجودة، ويدعم…

مولّدات الفيديو بالذكاء الاصطناعي

Ray3.2 هو نموذج فيديو ذكاء اصطناعي متعدد الاستخدامات يحول النية الإبداعية إلى سير عمل فيديو قابل للتوسع. يوفر تحكمًا معززًا، واستمرارية، وإخراج سينمائي عبر عدة سير عمل، بما في ذلك…

مميزةمولّدات الفيديو بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

يحول Stable Video Diffusion Online الصور والنصوص إلى مقاطع فيديو قصيرة باستخدام نموذج ذكاء اصطناعي متقدم. هذه الأداة التجريبية البحثية توسع إمكانيات إنشاء المحتوى لوسائل الإعلام…

مولّدات الفيديو بالذكاء الاصطناعي

مستودعات GitHub للذكاء الاصطناعي

TokenFlow هو تطبيق PyTorch لتحرير الفيديو المتسق باستخدام نماذج الانتشار المدربة مسبقًا من النص إلى صورة. يتيح تحرير الفيديو المدفوع بالنص دون تدريب إضافي، مع الحفاظ على التخطيط…

محرّرات الفيديو بالذكاء الاصطناعي

نماذج الذكاء الاصطناعي

Veo 3.1 من Google DeepMind هو نموذج رائد في توليد الفيديو يقدم واقعية محسنة، تحكمًا إبداعيًا، وقدرات على اتباع التعليمات. يدعم توليد الفيديو من النص، توليد الفيديو من الصورة،…

مولّدات الفيديو بالذكاء الاصطناعيالإعلام والترفيه

تطبيقات الذكاء الاصطناعي

VideoAI هو مولد فيديو بالذكاء الاصطناعي يحول النصوص والصور إلى مقاطع فيديو باستخدام نماذج رائدة مثل Kling وWan وSeedance وVeo. كما يقدم أدوات للصور وتوليد موسيقى بالذكاء الاصطناعي…

مولّدات الفيديو بالذكاء الاصطناعيالإعلام والترفيه

تطبيقات الذكاء الاصطناعي

Flux Video AI يحول الصور والنصوص إلى مقاطع فيديو سينمائية تصل مدتها إلى 15 ثانية. يوفر ذكاءً اصطناعيًا متقدمًا لإنشاء مقاطع فيديو من الصور ومن النصوص، ويقدم مرئيات واقعية احترافية…

مولّدات الفيديو بالذكاء الاصطناعي