الوصف

🖼️ اسم الأداة:
Mochi 1 (Genmo AI)

🔖 التصنيفات:

  • نص وصور الى فيديو
  • توليد صور من نص
  • فيديو ومونتاج وموشن
  • أفكار فيديو وسيناريو
  • البرمجة والتطوير
  • المستودعات والنمذجة

✏️ ما الذي تقدّمه هذه الأداة؟

Mochi 1 هو نموذج مفتوح المصدر لإنشاء الفيديوهات باستخدام الذكاء الاصطناعي، تم تطويره بواسطة Genmo بهدف توفير نموذج متقدم لإنشاء الفيديو من النصوص مع جودة حركة عالية وفهم قوي للأوامر النصية.

يعتمد النموذج على تقنية Text-to-Video، حيث يستطيع تحويل الوصف النصي إلى فيديوهات متحركة، مع التركيز على:

  • فهم تعليمات المستخدم بدقة.
  • إنتاج حركة واقعية داخل الفيديو.
  • الحفاظ على تفاصيل المشهد والعناصر البصرية.

يستخدم Mochi 1 بنية Asymmetric Diffusion Transformer (AsymmDiT)، وهو نموذج انتشار Diffusion Model يحتوي على 10 مليارات معامل (10B Parameters)، وتم تدريبه من الصفر كنموذج مفتوح لإنشاء الفيديو.

كما يتضمن المشروع نموذج ضغط فيديو خاصًا باسم AsymmVAE يساعد على معالجة الفيديوهات بكفاءة، ويعمل على ضغط البيانات البصرية لتقليل متطلبات المعالجة.

يوفر Mochi 1:

  • إنشاء فيديوهات من النصوص.
  • تشغيل النموذج محليًا.
  • إمكانية تخصيص النموذج عبر Fine-tuning باستخدام LoRA.
  • إمكانية دمجه مع أدوات ومشاريع أخرى مثل ComfyUI.

تم إصدار النموذج تحت ترخيص Apache 2.0، مما يسمح باستخدامه وتطويره ضمن المشاريع المختلفة وفق شروط الترخيص.


⭐ ما الذي تقدّمه فعليًا بناءً على تجربة المستخدمين؟

  • إنشاء فيديوهات بالذكاء الاصطناعي من أوصاف نصية.
  • إنتاج حركة فيديو عالية الجودة مع التزام جيد بالأوامر النصية.
  • توفير نموذج مفتوح المصدر يمكن للباحثين والمطورين تعديله وتشغيله محليًا.
  • إمكانية تخصيص النموذج باستخدام LoRA لتدريبه على فيديوهات خاصة.
  • توفير واجهة تشغيل عبر Gradio وإنشاء الفيديوهات من خلال سطر الأوامر CLI.
  • دعم التكامل البرمجي عبر API داخل المستودع.

وفق المستودع الرسمي، يدعم Mochi تشغيل النموذج على وحدات معالجة رسومية متعددة، كما يمكن تشغيله على بطاقة واحدة لكنه يحتاج إلى موارد كبيرة، حيث تشير الوثائق إلى الحاجة لحوالي 60GB VRAM عند التشغيل على GPU واحد في النسخة الأصلية.


🤖 هل تتضمّن الأتمتة؟

نعم، يعتمد Mochi 1 على أتمتة إنشاء الفيديو باستخدام الذكاء الاصطناعي.

تشمل الأتمتة:

  • تحويل النصوص إلى فيديوهات تلقائيًا.
  • تنفيذ عملية التوليد بالكامل عبر النموذج دون تدخل يدوي في الرسوم المتحركة.
  • إمكانية دمج النموذج داخل تطبيقات أو أنظمة إنتاج محتوى عبر API.
  • دعم إنشاء سير عمل مخصص للمطورين والباحثين.

💰 نموذج التسعير:

مجاني ومفتوح المصدر.

لا تعتمد Mochi 1 على اشتراك مدفوع، حيث يتم توفير:

  • الكود المصدري.
  • أوزان النموذج.
  • أدوات التشغيل.

يمكن تشغيله محليًا أو استخدامه عبر بيئات تدعم النموذج.


🆓 تفاصيل الخطة المجانية:

الميزةالتفاصيل
السعرمجاني
نوع الاستخداممفتوح المصدر
الكود المصدريمتوفر
أوزان النموذجمتوفرة
الترخيصApache 2.0
التشغيلمحليًا بعد تثبيت المتطلبات
التخصيصدعم LoRA Fine-tuning

 


💳 تفاصيل الخطط المدفوعة:

الخطةالسعرالمزايا
لا توجد خطط مدفوعةغير متوفرالنموذج مفتوح المصدر ولا يقدم اشتراكات مدفوعة

🧭 طريقة الوصول إلى الأداة:

الطريقةمتوفرة
الموقع الإلكتروني✔ عبر Genmo Playground
GitHub Repository
تشغيل محلي
API
تطبيق مستقلغير مذكور
إضافةغير مذكور

يمكن الوصول إلى المشروع عبر مستودع GitHub الرسمي، حيث يوفر ملفات التثبيت والتشغيل وأمثلة الاستخدام.


🔗 رابط التجربة أو الموقع الرسمي:

https://github.com/genmoai/mochi

 
 
 

تفاصيل التسعير

يتوفر Mochi 1 (Genmo AI) بشكل مجاني ومفتوح المصدر، حيث لا يعتمد على نموذج اشتراك أو خطط مدفوعة. يتيح المشروع للمستخدمين الوصول إلى الكود المصدري، وأوزان النموذج، وأدوات التشغيل تحت ترخيص Apache 2.0، مما يسمح باستخدامه وتطويره وتعديله ضمن المشاريع المختلفة. يمكن تشغيل النموذج محليًا بعد تجهيز المتطلبات التقنية اللازمة، أو دمجه داخل بيئات وأدوات أخرى مثل ComfyUI أو عبر واجهات برمجية (API). ولا توجد حاليًا أي خطط مدفوعة رسمية مرتبطة بـ Mochi 1، إذ يتم توفير النموذج بالكامل كمشروع مفتوح للمطورين والباحثين.