تخطي إلى المحتوى

LTX-2.5: فيديو AI مفتوح الأوزان في 6.8 ث

Darius Z. بقلم Darius Z. 8 دقائق للقراءة
شاشة كمبيوتر تعرض خط زمني للفيديو مع عتاد GPU لإطلاق نموذج LTX-2.5 مفتوح الأوزان لتوليد الفيديو بالذكاء الاصطناعي

يحتوي على روابط تابعة

أطلقت Lightricks نموذج LTX-2.5 (إل تي إكس 2.5) مفتوح الأوزان لتوليد الفيديو والعوالم في 11 أغسطس، مع ادعاء سرعة يتحدى كل المنافسين المغلقين: مقطع مدته 10 ثوانٍ بدقة 720p يُولَّد في 6.8 ثانية على عتاد NVIDIA. النموذج مجاني للمؤسسات التي لا يتجاوز إيرادها السنوي 10 ملايين دولار، يأتي مع تكامل ComfyUI منذ اليوم الأول، وسبق أن تجاوزت عائلة نماذج LTX 33 مليون تنزيل. بالنسبة لمنشئي المحتوى في المنطقة العربية، يفتح التشغيل المحلي باباً لتجاوز قيود زمن الاستجابة على واجهات برمجة التطبيقات السحابية البعيدة جغرافياً.

النقاط الرئيسية

  • يولّد فيديو 10 ثوانٍ في 6.8 ثانية على رقائق NVIDIA GB200، أسرع من التشغيل الفعلي للمقطع
  • أوزان مفتوحة على Hugging Face، مجانية للمؤسسات التي لا يتجاوز إيرادها السنوي $10M
  • تكامل ComfyUI أصلي منذ اليوم الأول مع سير عمل النص إلى فيديو والصورة إلى فيديو واللقطات المتعددة
  • توليد اللقطات المتعددة أصلياً يحافظ على اتساق الشخصيات والمشاهد والصوت عبر القصات
  • تكلفة $0.90 لكل مقطع 10 ثوانٍ عبر واجهة برمجة التطبيقات المُدارة، أقل من معظم المنافسين المغلقين

قارن مولّدات فيديو الذكاء الاصطناعي

اطّلع على أداء Kling AI مقابل البدائل مفتوحة المصدر من حيث سرعة توليد الفيديو وجودته وتسعيره.

اقرأ مراجعة Kling AI ←

ماذا يقدّم LTX-2.5

أعادت Lightricks بناء كل مرحلة في خط أنابيب التوليد بدلاً من ترقيع ميزات على نواة LTX-2.3 القديمة. خمسة تغييرات هيكلية تحدّد هذا الإصدار.

يقلّل Diffusion Video Decoder من الشوائب في اللقطات عالية الحركة ويعيد بناء التفاصيل الدقيقة كالنصوص وملامح الوجه دون التضحية بنسبة ضغط النموذج. كانت إصدارات LTX السابقة تتعثر مع حركة الكاميرا السريعة؛ يخصّص هذا المفكّك قدرة الحساب حسب تعقيد المشهد.

توليد اللقطات المتعددة أصلياً ينتج تسلسلاً كاملاً كمخرج واحد. تبقى الشخصيات والبيئات والإضاءة والصوت متسقة عبر القصات دون حاجة لدمج ما بعد الإنتاج. للمنشئين الذين يبنون محتوى قصيراً أو لوحات قصة، يُزيل هذا مشكلة الاستمرارية التي تُعاني منها التوليدات لقطة بلقطة.

عمود Gemma 4 اللغوي المخصّص ومحسّن المطالبات المخصّص يتعاملان مع مطالبات متعددة الشخصيات المعقّدة بدقة أكبر. تقول Lightricks إن محسّن المطالبات يحسّن الالتزام بالأوصاف الطويلة والمفصّلة بشكل ملحوظ مقارنةً بالسلف.

كما يشحن النموذج نقطة فحص مسبقة التدريب للذكاء الاصطناعي الفيزيائي والروبوتات، ما يمنح الفرق قاعدة للضبط الدقيق على بيانات متخصّصة. نسخة مقطّرة تقدّم جودة شبه كاملة بتكلفة أقل ووقت استدلال مخفّض، محسّنة خصيصاً لـ NVIDIA RTX GPUs مع متطلبات VRAM أقل.

6.8s سرعة التوليد (مقطع 10 ثوانٍ، استضافة ذاتية)
$0.90 تكلفة واجهة برمجة التطبيقات (10 ثوانٍ، الطبقة السريعة)
33M+ إجمالي التنزيلات (الأكثر استخداماً)
16 GB الحد الأدنى لـ VRAM (بطاقات RTX الاستهلاكية)

ما مدى سرعته فعلياً؟

رقم 6.8 ثانية يحتاج سياقاً. قاسَت Lightricks هذه السرعة على رقاقتي NVIDIA GB200 فائقتين في حالة ثابتة، عتاد لا يملكه معظم المنشئين المستقلين. عبر واجهة برمجة التطبيقات المُدارة من Lightricks، استغرق نفس المقطع 10 ثوانٍ 23.7 ثانية بدقة 1080p.

كلا الرقمين يمثلان فجوة كبيرة عن المنافسة. أظهرت قياسات Lightricks من طرف إلى طرف لواجهات برمجة تطبيقات المنافسين على مهمة الصورة إلى فيديو ذاتها: Gemini Omni Flash من Google عند 52 ثانية، Veo 3.1 عند 70 ثانية، MiniMax H3 عند 180 ثانية، Seedance 2.5 من ByteDance عند 317 ثانية، وKling AI 3.0 Pro من Kuaishou عند 398 ثانية.

مقارنة تكلفة توليد فيديو بالذكاء الاصطناعي: مقطع 720p مدته 10 ثوانٍ مع صوت (أغسطس 2026)

النموذج التكلفة لكل مقطع الميزة الرئيسية
Veo 3.1 Lite (Google) $0.50 أرخص سعر لواجهة برمجة تطبيقات مغلقة
LTX-2.5 Fast (Lightricks) $0.90 النموذج الوحيد مفتوح الأوزان؛ استضافة ذاتية مجانية تحت $10M
Veo 3.1 Fast (Google) $1.00 أرخص مسار إلى 4K عبر واجهة برمجة تطبيقات مغلقة
Gemini Omni Flash (Google) $1.00 رائد الجودة في الساحات المستقلة
FLUX 3 Video (Black Forest Labs) $1.70 أول من يقدّم مقاطع 20 ثانية مع صوت
HappyHorse 1.0 (Alibaba) $1.82 درجات جودة قوية في الساحات
Veo 3.1 Premium (Google) $4.00 النموذج الوحيد مع تمديد المقطع بعد التوليد الأول

في الجودة، شاركت Lightricks اختبارات تفضيل عمياء أبلغت عنها الشركة تُظهر معدل فوز 67%، متقدمة على Seedance 2.5 عند 65% وGemini Omni Flash عند 55%. هذه النتائج لم تُتحقَّق منها بشكل مستقل. ساحة Artificial Analysis للنص إلى فيديو، أقرب شيء لأرضية محايدة، ترتّب Gemini Omni Flash أولاً ولم تُقيّم LTX-2.5 بعد.

شراكة ComfyUI

اختارت Lightricks ComfyUI منصة إطلاقها لسبب وجيه. أداة سير العمل القائمة على العقد، التي بدأت كواجهة Stable Diffusion مفتوحة المصدر في 2023، أصبحت البيئة المعيارية لاختبار ونشر نماذج الوسائط التوليدية الجديدة. جمعت Comfy Org 17 مليون دولار وتخدم الآن كطبقة النماذج الأولية لجزء كبير من منظومة أدوات الإبداع بالذكاء الاصطناعي المفتوحة.

التكامل منذ اليوم الأول يعني ثلاث قوالب سير عمل مدمجة فوراً: Text-to-Video وImage-to-Video وFirst/Last-Frame-to-Video. يمكن للمنشئين تشغيل النموذج محلياً بأوزان مُنزَّلة أو استخدام عقد LTX API للتوليد السحابي دون GPU محلي.

كان زيف فاربمان، الرئيس التنفيذي لـ Lightricks، صريحاً بشأن الاستراتيجية: ‘جزء كبير من عملائنا يبدأ رحلته داخل Comfy، لذا الدعم منذ اليوم صفر هو عملياً قناة اكتساب عملائنا.’

معلومات:

أوزان LTX-2.5 مستضافة في مستودع Hugging Face مقيَّد. تحتاج إلى قبول الترخيص وانتظار موافقة الوصول قبل التنزيل. يتطلب النموذج 16 GB على الأقل من VRAM للاستدلال المحلي.

رهان الأوزان المفتوحة

يجلس نموذج ترخيص Lightricks بين المصدر المفتوح بالكامل وواجهة برمجة التطبيقات المغلقة. يسمح ترخيص LTX-2.x Community License للمؤسسات التي لا يتجاوز إيرادها السنوي 10 ملايين دولار باستخدام النموذج وتعديله واستضافته ذاتياً وترخيصه من الباطن مجاناً. الشركات الأكبر تتفاوض على تراخيص مدفوعة. حتى فوق العتبة، يبقى التقييم في بيئات غير إنتاجية مجانياً.

صاغ فاربمان الاستراتيجية مقابل اتجاه الصناعة نحو واجهات برمجة التطبيقات المغلقة: ‘حوالي وقت إطلاق Sora، أدركنا أن كل اللاعبين الكبار يغلقون نماذجهم. العمل عبر واجهات برمجة التطبيقات لا يناسب كثيراً من الشركات.’ حجته أن نماذج الفيديو لها مساحة حالات استخدام أوسع جوهرياً من نماذج اللغة، ما يجعل الوصول إلى الأوزان أكثر حرجية للتخصيص.

تأتي الانفتاح مع حدود. يشمل الترخيص ليس فقط نقاط الفحص المضبوطة دقيقاً ومحوّلات LoRA بل أيضاً التقطيرات وأي نموذج مُدرَّب على مخرجات LTX-2.5 الاصطناعية. شركة تولّد بيانات تدريب بـ LTX-2.5 لتدريب نموذج منفصل، بحسب تعريف الترخيص، أنشأت مشتقاً ملزماً بنفس الاتفاق.

جرّب توليد فيديو Kling AI

أنشئ مقاطع فيديو بالذكاء الاصطناعي بإخراج 4K أصلي وتحكم بالحركة وتسلسلات متعددة اللقطات. ابدأ بالخطة المجانية.

جرّب Kling AI مجاناً ←

أين يضع هذا السوق؟

يصل LTX-2.5 إلى سوق تغيّر بسرعة منذ تغطيتنا في يناير لـ NVIDIA RTX وLTX-2. أصبح لدى مساحة فيديو الذكاء الاصطناعي مفتوحة الأوزان نموذجاً ينافس في السرعة ويقترب من المنافسين المغلقين في الجودة، مع بقائه مجانياً لمعظم المنشئين المستقلين.

الإصدار جزء من حملة NVIDIA في أغسطس حول ‘الذكاء الاصطناعي المحلي’، ويُطلَق إلى جانب نموذج الوكيل Nemotron 3.5 Lightning. الرسالة المشتركة: النماذج المفتوحة التي تعمل محلياً تصبح بنية إنتاج افتراضية لا حلاً بديلاً.

للمنشئين الذين يدفعون حالياً أسعاراً لكل مقطع على منصات مغلقة، يقدّم LTX-2.5 بديلاً واضحاً إذا كان لديهم العتاد. ولمن لا يملكون GPUs محلية، تضع واجهة برمجة التطبيقات المُدارة عند $0.90 لكل مقطع الخيار ثاني الأرخص بعد Veo 3.1 Lite من Google.

سيكون رد فعل المنافسين مثيراً للمتابعة. Kling AI، الذي أطلق مؤخراً توليد 4K أصلي وميزات اللقطات المتعددة، استغرق 398 ثانية في معايير Lightricks لنفس المهمة التي أكملها LTX-2.5 في أقل من 7 ثوانٍ على عتاد متميز. ما إذا كانت فجوة السرعة هذه ستترجم إلى تبنٍ من المنشئين يعتمد على اتساق الجودة، وهو ما لم تؤكده المعايير المستقلة بعد.

الأسئلة الشائعة

هل LTX-2.5 مجاني للاستخدام؟

نعم، للمؤسسات التي لا يتجاوز إيرادها السنوي المتكرر 10 ملايين دولار. يمكنك تنزيل الأوزان المفتوحة من Hugging Face واستضافتها ذاتياً على عتادك واستخدامها تجارياً دون رسوم ترخيص. المؤسسات فوق العتبة تتفاوض على ترخيص مدفوع مع Lightricks.

ما سرعة LTX-2.5 مقارنةً بـ Kling AI وSeedance؟

تدّعي Lightricks 6.8 ثانية لمقطع 10 ثوانٍ على عتاد NVIDIA GB200، مقابل 317 ثانية لـ Seedance 2.5 و398 ثانية لـ Kling 3.0 Pro في مهمة الصورة إلى فيديو ذاتها. عبر واجهة برمجة التطبيقات المُدارة، يولّد LTX-2.5 نفس المقطع في 23.7 ثانية بدقة 1080p.

كيف أشغّل LTX-2.5 في ComfyUI؟

حدّث ComfyUI إلى أحدث إصدار، واطلب الوصول إلى مستودع Lightricks/LTX-2.5 المقيَّد على Hugging Face، واقبل الترخيص، ونزّل ملفات النموذج إلى مجلد models في ComfyUI. ثلاث قوالب سير عمل (Text-to-Video وImage-to-Video وFirst/Last-Frame-to-Video) متاحة فوراً. تحتاج 16 GB على الأقل من VRAM.

ما هو نموذج فيديو ذكاء اصطناعي مفتوح الأوزان؟

النموذج مفتوح الأوزان ينشر معاملاته المُدرَّبة علناً، ما يتيح لأي شخص تنزيله وتشغيله وضبطه دقيقاً محلياً. على عكس المصدر المفتوح (الذي يعني عدم وجود قيود استخدام)، تأتي نماذج مفتوحة الأوزان مثل LTX-2.5 بتراخيص مخصّصة قد تقيّد الاستخدام التجاري فوق عتبات إيراد معيّنة أو تحدّد التزامات العمل المشتق.

هل يمكن لـ LTX-2.5 توليد فيديو مع صوت؟

نعم. يولّد LTX-2.5 فيديو وصوتاً متزامنين في تمريرة واحدة. ميزة اللقطات المتعددة تحافظ أيضاً على اتساق الصوت عبر القصات، ما يجعلها مناسبة للتسلسلات السردية وإنتاج المحتوى القصير.

هل يناسب LTX-2.5 منشئي المحتوى في العالم العربي؟

نعم، خصوصاً للفرق في دول الخليج ومصر والمغرب العربي التي تبحث عن بدائل للمنصات السحابية ذات زمن الاستجابة المرتفع. التشغيل المحلي على RTX GPUs يقلّل الاعتماد على خوادم بعيدة، ويمكن ضبط محسّن المطالبات لقبول أوصاف بالعربية الفصحى أو باللهجات في سير عمل ComfyUI.

المصادر

  1. LTX-2.5 can generate a 10-second AI video in just 6.8 seconds on Nvidia superchips - VentureBeat, 11 أغسطس 2026
  2. The Video Production Stack Now Fits on One Desk: LTX-2.5 Launches - MarkTechPost, 11 أغسطس 2026
  3. LTX-2.5 Targets Real-Time Video Generation - Open Source For You, 12 أغسطس 2026
  4. LTX-2.5 ComfyUI Documentation - ComfyUI Docs
  5. Lightricks/LTX-2.5 Model Repository - Hugging Face

هل كانت هذه المقالة مفيدة؟

0:00