انتقل إلى المحتوى

شروح

تحويل النص إلى فيديو أنمي: كيف يعمل مولد أنمي بالذكاء الاصطناعي، وأين يقصر

يحوّل مولد أنمي بالذكاء الاصطناعي الوصف النصي إلى مقطع قصير برسمه إطارًا بعد إطار انطلاقًا من أنماط تعلّمها، فيمنحك وصف واحد خمس ثوانٍ جيدة لكن بشخصية مختلفة في كل مرة. وللحصول على حلقة كاملة تحتاج إلى خط إنتاج يرسم كل لقطة انطلاقًا من صور معتمدة للشخصيات والأماكن والأسلوب نفسها، وهكذا يعمل Animey.

بقلم فريق Animey6 دقائق للقراءة

«مولد أنمي بالذكاء الاصطناعي» و«تحويل النص إلى فيديو أنمي» من أكثر العبارات بحثًا حول الأنمي والذكاء الاصطناعي، ومعظم الأدوات التي تقف خلفها تفعل الشيء نفسه: تكتب جملة فتحصل على مقطع. يبيّن هذا الشرح ما يحدث بين الخطوتين، وما يستطيعه الوصف النصي الواحد وما لا يستطيعه، وكيف يحوّل Animey، استوديو أنمي بالذكاء الاصطناعي من Softforge Digital، مقاطع كثيرة إلى حلقة واحدة متسقة. ويصف الأدوات كما هي في سبتمبر 2026.

كيف يصنع نموذج تحويل النص إلى فيديو مقطعًا

يبدأ نموذج الفيديو من تشويش عشوائي ويزيله خطوة بعد خطوة حتى تظهر إطارات تطابق كلماتك، مسترشدًا بكل ما رآه أثناء تدريبه. فهو لا يبحث عن أي شيء، بل يخترع صورة معقولة لـ«فتاة ساعية تركض فوق أسطح المنازل» ويحافظ على ترابط الإطارات فيما بينها لبضع ثوانٍ. تصنع معظم النماذج مقاطع مدتها من 5 إلى 15 ثانية، بدقة 720p أو 1080p، بصيغة أفقية أو عمودية.

خمس ثوانٍ من وصف واحد: ساعية بوشاح أحمر تركض فوق الأسطح عند الغسق بينما تتبعها الكاميرا من الجانب. صُنع لهذا المقال بنموذج تحويل نص إلى فيديو، دون أي صور مرجعية.

في لقطة واحدة قد تكون النتيجة مبهرة: الحركة سلسة، والإضاءة صحيحة، والوشاح يتطاير في الريح. لكن المشكلة تظهر مع اللقطة الثانية.

الوصف نفسه، شخصية مختلفة

أرسلنا وصف الصورة نفسه ثلاث مرات، كلمة بكلمة: «فتاة ساعية مراهقة بشعر فضي قصير وعينين كهرمانيتين، ترتدي سترة ساعي كحلية ووشاحًا أحمر، تقف على سطح عند الغسق وخلفها فوانيس ورقية». ولم يتغير سوى البذرة العشوائية.

التشغيل الأول: الساعية بسروال قصير مع حقيبة ظهر وطردالتشغيل الثاني: الساعية بسروال طويل مع حقيبة كتفالتشغيل الثالث: ساعية أصغر حجمًا بقفازين وحقيبة مختلفة
وصف واحد وثلاثة تشغيلات: الشعر والوشاح يطابقان الكلمات، لكن الزي والحقيبة والبنية والمدينة تتغير كلها.

كل صورة تطابق الوصف، ولا تُظهر أي منها الشخصية نفسها. تثبّت الكلمات بضع سمات، ويملأ النموذج كل ما عداها بطريقة مختلفة في كل مرة: قَصّة السترة، وسروال قصير أو طويل، وحقيبة ظهر أو حقيبة كتف، وشكل الوجه. في مقطع واحد لا يلاحظ أحد ذلك. أما في حلقة من اثنتي عشرة لقطة، فيرى الجمهور اثنتي عشرة ساعية مختلفة.

ما لا يستطيعه الوصف النصي وحده

وصف واحد مقابل خط إنتاج استوديو (Animey، سبتمبر 2026)
الحاجةوصف واحدفي Animey
الوجه نفسه والزي نفسه في كل لقطةيتغير في كل تشغيلكل لقطة تُرسم من اللوحة المرجعية المعتمدة
المكان نفسه طوال المشهديُعاد رسمه من الكلمات كل مرةيُرسم وفق خلفيات المكان المعتمدة
أسلوب فني واحد للمسلسلينحرف مع كل وصفتثبّته بطاقة أسلوب معتمدة
حوار بصوت الشخصيةنادر، وبصوت جديد كل مرةصوت واحد مختار لكل شخصية ولغة
حلقة مكتملةمقاطع تُركَّب يدويًاملف MP4 مُصيَّر مع الترجمة

لا شيء من هذا عيب في نموذج بعينه. فنموذج الفيديو يصنع مقطعًا واحدًا في كل مرة ولا يتذكر المقطع السابق. لذلك يجب أن تأتي الاستمرارية من خارج النموذج، من صور تُعرض عليه في كل مرة يرسم فيها.

كيف يحافظ خط إنتاج الاستوديو على ثبات الحلقة

حلّت استوديوهات التحريك هذه المشكلة قبل الذكاء الاصطناعي بزمن طويل بفضل ورقة النموذج: رسوم لكل شخصية من عدة زوايا ينسخ عنها كل فنان. ويطبّق Animey الفكرة نفسها على نماذج الصور والفيديو، بهذا الترتيب:

  1. يحصل المسلسل على بطاقة أسلوب، وهي صورة نموذجية بأحد الأساليب الفنية الثمانية، تعتمدها مرة واحدة.
  2. تحصل كل شخصية على لوحة مرجعية من ستة مناظر (أمامي وثلاثة أرباع وجانبي وخلفي والوجه والتعابير) مقابل رصيدين، مرسومة بذلك الأسلوب. وتعتمدها حين تتطابق المناظر كلها.
  3. يحصل كل مكان على خلفياته، لقطة تأسيسية واسعة وزاويتين أخريين، مقابل رصيد واحد للمجموعة.
  4. تحصل كل لقطة على إطار مفتاحي: صورة ثابتة للحظتها الأولى، مرسومة من لوحات شخصياتها وخلفية المكان وبطاقة الأسلوب، حتى 16 صورة مرجعية. ولا يصف النص إلا الوضعية والتعبير والكاميرا.
  5. في المستوى القياسي، ينطلق نموذج الفيديو من ذلك الإطار المفتاحي ويضيف إليه الحركة. فالمظهر يأتي من الرسم لا من الكلمات.

ولأن الإطار المفتاحي صورة، يمكنك فحصه قبل أن تدفع ثمن الحركة: رسم الإطارات المفتاحية مجاني حتى خمس مرات لكل لقطة في اليوم، واللقطة القياسية ذات الثواني الخمس، بإطارها المفتاحي وحوارها المنطوق وتحريكها، تكلّف رصيدًا واحدًا. ويتعمق شرح الاتساق أكثر في اللوحات المرجعية.

نسبة اللقطات القياسية التي احتُفظ بها من محاولتها الأولى

يُنشر بعد الإطلاق. سنقيس هذا الرقم على حلقات حقيقية ونضيفه هنا مع تاريخه.

المصدر: بيانات استخدام Animey، الربع الأول بعد الإطلاق

كيف تختار مولد أنمي بالذكاء الاصطناعي

تعتمد الأداة المناسبة على ما تريد صنعه. اطرح هذه الأسئلة قبل أن تختار:

  • مقطع واحد أم مسلسل؟ لمقطع واحد لافت يكفي أي نموذج جيد لتحويل النص إلى فيديو. أما للحلقات فابحث عن اللوحات المرجعية وخطوات الاعتماد.
  • هل يمكنك فحص صورة ثابتة قبل دفع ثمن الحركة؟ التحريك يكلّف أكثر بكثير من الرسم.
  • من يتكلم؟ ابحث عن أصوات تختارها لكل شخصية ولكل لغة، وعن ترجمة بأكثر من لغة.
  • ما الذي يحق لك صنعه؟ الشخصيات الأصلية أرض آمنة، ويرفض Animey الأشخاص الحقيقيين والأعمال القائمة، كما يوضح دليل حقوق النشر.
  • ما الذي تحصل عليه في النهاية؟ حلقة مُصيَّرة مع ترجمة، أم مجلد من المقاطع تركّبه بنفسك.

لتجربة خط الإنتاج كاملًا على حلقة مدتها دقيقة، اتبع دليل نصف اليوم، أو أنشئ حسابًا مجانيًا وابدأ بأرصدة التجربة العشرة.

أسئلة يجيب عنها المقال

ما أفضل مولد أنمي بالذكاء الاصطناعي؟
يعتمد ذلك على الهدف. يكفي نموذج عام لتحويل النص إلى فيديو لمقطع واحد، أما لمسلسل تظهر فيه الشخصيات نفسها في كل لقطة فاستخدم أداة ترسم كل لقطة من لوحات مرجعية وخلفيات أماكن وبطاقة أسلوب معتمدة، كما يفعل Animey.
هل يستطيع الذكاء الاصطناعي تحويل النص إلى فيديو أنمي؟
نعم، يحوّل نموذج تحويل النص إلى فيديو الوصف إلى مقطع مدته نحو 5 إلى 15 ثانية. أما الحلقة الكاملة فتحتاج إلى مقاطع كثيرة متوافقة فيما بينها، وهذا يتطلب صورًا مرجعية ونصًا ومحررًا أو خط إنتاج استوديو.
لماذا تبدو شخصية الأنمي التي ولّدتها بالذكاء الاصطناعي مختلفة في كل مقطع؟
لأن الوصف لا يثبّت إلا بضع سمات، والنموذج يخترع الباقي في كل تشغيل. وعرض الصور المعتمدة نفسها للشخصية على النموذج في كل مرة، أي اللوحة المرجعية، يحافظ على ثبات الوجه والزي.
كم تكلّف صناعة فيديو أنمي باستخدام Animey؟
تكلّف اللقطة القياسية ذات الثواني الخمس رصيدًا واحدًا، يشمل إطارها المفتاحي وحوارها المنطوق وتحريكها، وتبدأ تكلفة حلقة مدتها دقيقة من 17 رصيدًا مع شخصيتين ومكان واحد. أما التصيير والترجمة فمجانيان.

ابدأ مسلسلك الخاص

صِف عالمك، وابتكر شخصياتك، وخطّط لحلقتك الأولى مشهدًا بمشهد.

ابدأ مجانًا
كل المقالات