ميدجورني أم شات جي بي تي أم نانو بنانا؟ مقارنة للمصممين 2026

مقارنة بين Midjourney وChatGPT وNano Banana بالمعايير لا بالدرجات: الأسلوب والتعديل والنص العربي والسرعة والحقوق والخصوصية، محدّثة حتى أكتوبر 2026.

إن أردت الإجابة في سطر واحد: Midjourney للشكل، وChatGPT للبريف، وNano Banana للتعديل. Midjourney (ميدجورني) مبنية حول الذوق والأسلوب. وChatGPT (شات جي بي تي) هو الأسهل حين تريد أن تشرح فكرتك بكلام عادي ثم تعدّل خطوة بخطوة. أما Nano Banana (نانو بنانا، ويكتبها البعض نانو بانانا) فهو الاسم الذي تطلقه Google على نماذج الصور في Gemini (جيميناي، أو جيميني)، وهو الأقوى حين تبدأ من صورة حقيقية أو منتج حقيقي يجب أن يبقى كما هو بينما يتغير كل ما حوله.

هذه هي الإجابة المختصرة. أما الإجابة المفيدة فتتوقف على المهمة: لوحة إلهام، أو صورة منتج، أو بوست سوشيال ميديا، أو صور حملة كاملة، أو تعديل صورة موجودة. كل مهمة منها تشير إلى أداة مختلفة. والأدوات الثلاث تغيّرت كثيرًا خلال 2026، لذلك كل ما في هذا المقال مؤرخ بأكتوبر 2026 ومأخوذ من صفحات الشركات نفسها: الوثائق والشروط والإعلانات الرسمية. لا درجات، ولا اختبارات معملية.

ماذا ستجد هنا؟ وضع كل أداة اليوم، ثم مقارنة بخمسة معايير: جودة الصورة والتحكم في الأسلوب، والتعديل والاتساق، والنص داخل الصورة بالحروف اللاتينية والعربية، والسرعة وسير العمل، والحقوق والخصوصية. بعدها جدول مقارنة، ثم كيف أختار حسب المهمة. وإن أردت نظرة أوسع تشمل Firefly وIdeogram وRecraft وغيرها، فستجدها في أفضل مواقع تصميم الصور بالذكاء الاصطناعي، والمقالان جزء من دليلي عن الذكاء الاصطناعي في التصميم الجرافيكي.

أين تقف الأدوات الثلاث في أكتوبر 2026؟

الإصدارات تتغير بسرعة، فلنبدأ بالوضع الحالي.

  • Midjourney: أصبح الإصدار V8.2 هو الافتراضي في 24 يوليو 2026. وفي 27 أغسطس أطلقت Midjourney نموذج تعديل (Edit Model) لإصدارات V8، يعدّل الصور بتعليمات مكتوبة، ويقبل حتى 4 صور مرجعية في المرة الواحدة، ويغيّر جزءًا من الصورة أو يوسّع حدودها. وتقول وثائقها إنه يحل محل أدوات Omni Reference وCharacter Reference وRetexture القديمة. وتعمل Midjourney من موقعها على الويب أو من Discord.
  • ChatGPT: توليد الصور يعيش داخل المحادثة نفسها. أطلقت OpenAI نسخة ChatGPT Images 2.0 في أبريل 2026، ثم أضافت في سبتمبر إلى واجهتها البرمجية (API) نموذج GPT Image 2.5 بنسختين: Sunburst للأعمال التي تحتاج دقة في التعديل، وFlare للتوليد السريع اليومي.
  • Nano Banana: عائلة نماذج الصور في Gemini. Nano Banana 2 (واسمه التقني Gemini 3.1 Flash Image) صدر في فبراير 2026 وهو النموذج العام لكل المهام، وNano Banana Pro (أي Gemini 3 Pro Image) للمهام الأعقد، وNano Banana 2 Lite الأسرع والأرخص للمطورين. تجدها في تطبيق Gemini، وفي منتجات Google مثل البحث وFlow وGoogle Ads، وعبر Gemini API. كما تتيح Adobe نماذج Nano Banana كخيار شريك داخل Generative Fill في Photoshop. شرحت العائلة كاملة، وكيف تكتب لها البرومبت، في برومبتات نانو بنانا للمصممين.

المعيار الأول: جودة الصورة والتحكم في الأسلوب

الأدوات الثلاث تستطيع أن تصنع صورة جميلة. السؤال الحقيقي للمصمم: كيف أوجّهها إلى ما أريده؟

Midjourney تمنحك أكبر عدد من أدوات الذوق. مرجع الأسلوب (Style Reference) ينقل روح صورة إلى صور جديدة، ولوحات الإلهام (Moodboards) تبني أسلوبًا من صور تختارها، والتخصيص (Personalization) يتعلم ذوقك من الصور التي تقيّمها. وتقول Midjourney إن V8.2 ركّز على الجماليات وجودة الصورة. وحين يقف طابعها الافتراضي في طريقك، تشير وثائقها إلى وضع Raw الذي يزيل هذا الطابع ويقرّب الناتج من نص البرومبت.

ChatGPT يُوجَّه بالتعليمات. دليل OpenAI نفسه يقول إن البرومبت المفيد غالبًا جملة إلى ثلاث جمل واضحة: الغرض من الصورة، والعنصر الرئيسي، والمكان، والتكوين، والإضاءة، وأي قيود. وللأسلوب ترفق صورة مرجعية وتحدد ما تأخذه منها: الصورة الأولى هي المنتج، والثانية مرجع الأسلوب.

Nano Banana يُوجَّه كما تكتب بريفًا لمصوّر. تتحدث Google عن التحكم في الإضاءة وزاوية الكاميرا والتركيز وتدريج الألوان (Color Grading)، ودليلها للمطورين يوصي بمصطلحات التصوير مثل wide-angle وmacro وlow-angle. ويقبل عددًا كبيرًا من الصور المرجعية، يصل إلى 14 صورة في نماذج Gemini 3 بحسب وثائق Google، وهذا مفيد حين يعيش الأسلوب في مجموعة صور لا في كلمات.

إن كنت لا تعرف الشكل بعد، فابدأ بـ Midjourney. وإن كنت تستطيع وصفه بدقة، فسيتبعك ChatGPT وNano Banana بحرفية أكبر.

المعيار الثاني: التعديل والاتساق

هنا يحدث عمل المصمم فعلًا: أن يبقى المنتج الحقيقي، أو الوجه الحقيقي، أو التصميم الحقيقي كما هو، ويتغير فقط ما طلبته.

Nano Banana بُني لهذا منذ نسخته الأولى. قدّمته Google في أغسطس 2025 كنموذج يجري تعديلات موجّهة باللغة الطبيعية ويدمج عدة صور في صورة واحدة. ويسمّي دليلها أحد أساليبه «القناع الدلالي» (Semantic Masking): تكتب «غيّر الكنبة فقط، وأبقِ كل شيء آخر كما هو»، فيعدّل ذلك الجزء وحده. وتقول Google إن نماذجها تحافظ على ثبات الشخصيات والعناصر عبر سير العمل، وتضيف بصراحة في صفحة النموذج أنه قد لا يصيب في كل مرة.

ChatGPT يعدّل داخل المحادثة: ترفق الصورة، وتقول بالضبط ما يتغير وما يبقى، ويمكنك تحديد منطقة من الصورة ووصف التعديل فيها وحدها. ويمكنك أيضًا الجمع بين أكثر من صورة مرجعية مع تسمية كل منها بترتيبها. لكن وثائق OpenAI للمطورين تعترف بأن النموذج قد يتعثر أحيانًا في الحفاظ على شخصية متكررة أو عنصر من الهوية ثابتًا عبر توليدات متعددة.

Midjourney كانت الأضعف بين الثلاث في تعديل صورة موجودة، وقد غيّر عام 2026 ذلك. نموذج التعديل في V8 يعمل بالتعليمات ويقبل حتى 4 مراجع، وتحديث سبتمبر يقول إن التعديل الموضعي صار يغيّر فقط البكسلات التي تحددها. لكن Midjourney نفسها تشير إلى «حالات حدّية كثيرة» ما زالت تعمل عليها، فجرّبه على صورك قبل أن تبني عليه مشروعًا لعميل.

وفي المنتجات قاعدة واحدة تنطبق على الثلاث: قد يحافظ النموذج على شكل العبوة ولونها بما يكفي لفكرة أولية، لكن الملصق والشعار والمكونات، والاسم العربي تحديدًا، يجب أن تأتي من ملف التصميم الأصلي.

المعيار الثالث: النص داخل الصورة، اللاتيني والعربي

العناوين الإنجليزية القصيرة أصبحت في متناول الأدوات الثلاث، بشرط المراجعة. أما العربية فقصة أخرى.

  • Midjourney: ضع الكلمات بين علامتي تنصيص مزدوجتين. ودليل النصوص الرسمي يقول إن النص يعمل بأفضل شكل مع الحروف اللاتينية القياسية والعبارات القصيرة، ويقترح وضع Raw أو تقليل قيمة Stylize أو استخدام المحرر لإصلاح الأخطاء الصغيرة. وتقول Midjourney إن كتابة النصوص تحسنت في V8.
  • ChatGPT: دليل OpenAI يطلب نصًا قصيرًا بين علامتي تنصيص، مع وصف نوع الخط وحجمه ولونه ومكانه، وتهجئة الأسماء غير المألوفة حرفًا حرفًا. وتقول وثائق المطورين إن النموذج ما زال قد يتعثر في دقة موضع النص ووضوحه، ويوصي دليل ChatGPT بمراجعة كل كلمة وإنهاء التايبوجرافي المهم في برنامج تصميم.
  • Nano Banana: تقول Google إنه يكتب نصًا مقروءًا ويترجم النص داخل الصورة ويكيّفه لكل سوق. لكن صفحة النموذج تحذّر من أنه قد يتعثر في الوجوه الصغيرة ودقة الإملاء والتفاصيل الدقيقة، ورسم Google البياني لأخطاء النص حسب اللغة يضم العربية. وتضيف وثائق المطورين نصيحة مفيدة: يعمل Gemini أفضل إذا ثبّتّ النص أولًا ثم طلبت صورة تحمله.

ملاحظة تهم القارئ العربي: كتابة البرومبت نفسه بالعربية شيء، ورسم الحروف العربية داخل الصورة شيء آخر. وثائق Gemini API تضع العربية (ar-EG) ضمن اللغات التي يعمل بها النموذج بأفضل أداء، لكن هذا يخص فهم طلبك، لا دقة الحروف التي يرسمها.

والنتيجة: حتى أكتوبر 2026 لم أجد صفحة رسمية لأي من الثلاث تعد بكتابة عربية موثوقة. الحروف المنفصلة، والنقاط في غير مكانها، والكلمات المعكوسة ما زالت شائعة. لذلك، لأي عمل سينشره العميل، ولّد الصورة بمساحة فارغة مخططة واكتب العربي بنفسك. شرحت الطريقة كاملة في الكتابة بالعربي على صور الذكاء الاصطناعي.

المعيار الرابع: السرعة وسير العمل

مكان الأداة لا يقل أهمية عما تصنعه.

Midjourney تعمل من موقعها ومن Discord. كل برومبت يعطيك عدة بدائل للمقارنة، وتصف Midjourney إصدار V8.1 بأنه أسرع نماذجها حتى الآن. لكن شروطها تمنع استخدام أدوات آلية لتوليد الصور، فهي ليست أداة تربطها بخط إنتاج آلي. مكانها جلسات الاستكشاف، لا الإنتاج بالجملة.

ChatGPT يعمل داخل محادثة على الويب والكمبيوتر والهاتف، بجوار المحادثة التي قد تكتب فيها البريف أو نصوص البوستات نفسها. ويمكن للاستوديوهات والمطورين استخدام نماذج الصور ذاتها عبر API من OpenAI.

Nano Banana هو الأوسع انتشارًا: في تطبيق Gemini، وفي منتجات Google مثل البحث وFlow وGoogle Ads، وفي AI Studio وGemini API وVertex AI للفرق التي تبني أدواتها. وداخل Generative Fill في Photoshop تعمل به على طبقة بدل صورة مسطحة.

المعيار الخامس: الحقوق والخصوصية والخطط

اقرأ هذا الجزء مرتين قبل أي عمل لعميل. كل ما يلي من الشروط وصفحات المساعدة الحالية لكل شركة في أكتوبر 2026، وهو قراءة للشروط لا استشارة قانونية.

Midjourney: تقول شروطها السارية منذ 27 مايو 2026 إنك تملك الصور التي تصنعها إلى أقصى حد يسمح به القانون، مع استثناء: الشركة التي تتجاوز إيراداتها مليون دولار أمريكي في السنة، أو الموظف فيها، يجب أن يشترك في خطة Pro أو Mega ليملك ما يصنعه. وأنت تمنح Midjourney ترخيصًا واسعًا على البرومبتات والصور التي ترفعها أو تولّدها. والأهم لعمل العملاء أن Midjourney مفتوحة افتراضيًا: صورك قد تظهر في صفحة Explore، ويمكن لغيرك إعادة استخدامها. ووضع Stealth يخفيها على الموقع، لكنه متاح فقط في خطتي Pro وMega، وما تصنعه في قناة Discord مشتركة يراه كل من فيها. هوية لم تُطلق بعد لعميل في الرياض أو القاهرة لا مكان لها في معرض عام.

ChatGPT: تقول شروط OpenAI إنك تملك الناتج في العلاقة بينك وبينها. ولا يوجد معرض عام؛ الصور تبقى في محادثاتك ومكتبة صورك. وفي الخطط الشخصية قد تُستخدم المحادثات لتحسين نماذج OpenAI ما لم توقف ذلك من إعدادات Data Controls، وتقول OpenAI إنها لا تدرّب نماذجها على بيانات خطط Business وEnterprise وAPI افتراضيًا. وتضيف أن الصور المولّدة في ChatGPT تحمل بيانات Content Credentials وعلامة SynthID غير مرئية.

Nano Banana: تقول شروط Google إنها لن تدّعي ملكية ما تولّده، وتضيف شروط Gemini API أنها قد تولّد المحتوى نفسه أو محتوى مشابهًا لغيرك. وفي تطبيق Gemini قد يقرأ مراجعون بشريون بعض المحادثات، وتنصح Google بعدم إدخال معلومات سرية ما دام حفظ النشاط مفعّلًا. وتقول Google إن محادثات حسابات العمل في Google Workspace مع Gemini لا تُراجع ولا تُستخدم للتدريب دون إذن، وفي الـ API تُستخدم بيانات الفئة المجانية وحدها لتحسين منتجاتها. وكل صورة تحمل علامة SynthID غير مرئية وبيانات Content Credentials. أما العلامة المائية الظاهرة فإعداد يمكن إيقافه في تطبيق Gemini، إلا في بضع دول لا يظهر فيها هذا الإعداد إلا لمشتركي AI Ultra.

وفي كل الأحوال، امتلاك الملف لا يعني أنك تستطيع حمايته. في عدة دول قد لا تحظى الصورة المولّدة بالكامل بحماية حقوق المؤلف، وأتناول ذلك في مقال هل صور الذكاء الاصطناعي عليها حقوق؟.

جدول المقارنة

ملخص لما توثّقه كل شركة، وليس ترتيبًا للأفضل.

المعيارMidjourneyChatGPTNano Banana (Gemini)
تشتهر بـالشكل والذوق واستكشاف الأسلوبالبريف والتعديل بالمحادثةتعديل الصور الحقيقية بالوصف
التحكم في الأسلوبمرجع الأسلوب ولوحات الإلهام والتخصيص ووضع Rawالتعليمات مع صور مرجعيةلغة التصوير وصور مرجعية كثيرة
التعديلEdit Model منذ أغسطس 2026، حتى 4 مراجع، وتعديل أجزاء وتوسيعترفق الصورة وتحدد المنطقة وتصف التعديلالقناع الدلالي ودمج عدة صور
الاتساقعبر المراجع ونموذج التعديل، مع حالات حدّيةتحذير من تعثر الشخصيات وعناصر الهوية المتكررةنقطة قوة رئيسية، مع تنبيه من Google
النصبين علامتي تنصيص، والأفضل بالحروف اللاتينيةنص قصير بين علامتي تنصيص، مع مراجعة كل كلمةنص مقروء وترجمة، مع تحذير من الإملاء
النص العربيلا وعد رسميلا وعد رسميلا وعد رسمي، والعربية ضمن رسم أخطاء Google
أين تعملالموقع وDiscordتطبيقات ChatGPT وAPIتطبيق Gemini ومنتجات Google وAPI وPhotoshop
الخصوصية الافتراضيةعامة، والإخفاء في Pro وMegaمحادثات خاصة، مع إيقاف التدريب يدويًا في الخطط الشخصيةمحادثات خاصة، مع مراجعة بشرية محتملة في الحسابات الشخصية
الملكيةلك، مع شرط الشركات الكبيرةلكGoogle لا تدّعيها، وقد يتكرر ناتج مشابه
علامات المصدرلم تتناولها الصفحات التي قرأتهاContent Credentials وSynthIDSynthID وContent Credentials وعلامة ظاهرة اختيارية

كيف أختار حسب المهمة

لوحة الإلهام (Moodboard)

Midjourney. لوحات الإلهام ومرجع الأسلوب والتخصيص فيها صُنعت للعثور على اتجاه، وطابعها الافتراضي القوي ميزة في هذه المرحلة. لكن اخلط صورها بمراجع حقيقية من السوق: واجهات محلات، وعبوات من رفوف السوبرماركت، وخامات تلمسها بيدك، وإلا ستشبه لوحتك لوحات الجميع. وإن كان العميل لا يعرف ما يريد بعد، فـ ChatGPT مفيد في مرحلة أبكر: ناقش البريف معه، ثم صُغ الاتجاه بكلمات قبل أن تولّد أي صورة.

صورة المنتج (Product Shot)

ابدأ من صورة حقيقية أو رندر 3D للمنتج الفعلي، ثم عدّل حوله. Nano Banana أولًا، وChatGPT بديلًا؛ كلاهما يأخذ صورتك ويغيّر المكان أو الإضاءة أو الخلفية. نموذج التعديل في Midjourney يستطيع ذلك الآن أيضًا، لكن جرّبه على منتجاتك قبل الاعتماد عليه. ومهما كانت الأداة، أعد وضع الملصق الحقيقي فوق الصورة بعد ذلك؛ فعلبة تمور فاخرة يخرج اسمها ناقصًا حرفًا لا تصلح لأي رف.

بوست السوشيال ميديا

هناك حالتان. سطر إنجليزي قصير على خلفية بسيطة: يستطيع ChatGPT أو Nano Banana وضعه داخل الصورة، مع مراجعة كل حرف. أما البوست العربي، أو عرض رمضان الذي سيتغير الأسبوع القادم، فولّد له خلفية بمساحة فارغة مكان العنوان، واكتب النص نصًا حيًّا في برنامج التصميم. هكذا يتغير العرض في دقيقة دون توليد جديد.

صور الحملة

هنا الاتساق أهم من أي كادر منفرد. ثبّت الشكل بالمراجع (مرجع الأسلوب ولوحات الإلهام في Midjourney، أو مجموعة ثابتة من الصور المرجعية في Nano Banana)، واستخدم فقرة أسلوب ثابتة في كل برومبت، وأنهِ كل الصور في خط معالجة واحد للألوان والخطوط. شرحت فكرة فقرة الأسلوب الثابتة في كتابة البرومبت للمصممين. الصور المرجعية الكثيرة في Nano Banana تساعد على ثبات المنتج والأشخاص عبر السلسلة، وMidjourney تساعد على ثبات الجو العام.

تعديل صورة موجودة

Nano Banana أو ChatGPT، وإن أردت طبقات وأقنعة تتحكم فيها بنفسك، فـ Generative Fill في Photoshop مع نموذج شريك. اكتب ما يجب أن يبقى كما هو بوضوح يساوي وضوح ما يجب أن يتغير. وإن كانت الصورة لعميل، فراجع إعدادات الخصوصية في الحساب الذي ترفع منه قبل الرفع.

من عملي

في سلاسل الفيديو التي أُخرجها في SkillUp MENA (استوديو فيديو الذكاء الاصطناعي)، توليد الصور خطوة في سلسلة: السيناريو، ثم الصور، ثم الحركة، ثم الصوت، ثم المونتاج. والذكاء الاصطناعي أداة في يدي في كل خطوة منها. وهذا العمل يوضح درسًا واحدًا: المهم ليس أجمل كادر منفرد، بل كادرات كثيرة تبدو كأنها من عالم واحد. لذلك أزن المراجع والتعديل والاتساق قبل جودة الصورة الخام حين أقارن بين هذه الأدوات.

والأمر نفسه في المشاهد التي تُبنى حول تصاميم حقيقية. في صفحة مشروع كبابجي السلطان، صُنعت بعض مشاهد التيك أواي والمنيو بالذكاء الاصطناعي حول التصاميم الحقيقية، وعلى كل منها علامة تقول إنها مشهد بالذكاء الاصطناعي. أيًّا كانت الأداة التي تختارها من الثلاث، ضع هذه العلامة حين تعرض الصور المولّدة.

الخلاصة

Midjourney وChatGPT وNano Banana لم تعد ثلاث نسخ من الشيء نفسه. Midjourney هي المكان الأقوى للعثور على شكل، وChatGPT هو الأسهل في البريف والتعديل بالكلام، وNano Banana هو الأقوى في تعديل ما هو موجود والحفاظ على ثباته، والأوسع حضورًا داخل أدوات أخرى. لا أحد منها يكتب العربية بشكل موثوق حتى الآن، والفرق بينها في الخصوصية الافتراضية أكبر من الفرق في صورها. اختر حسب المهمة، وراجع شروط الخطة، واترك الحروف والملصقات والقرار النهائي في يدك.

إن كنت تريد حملة أو هوية يسرّع فيها الذكاء الاصطناعي العمل ويبقى كل قرار فيها مصمَّمًا بعناية، حدّثني عن مشروعك.

أسئلة شائعة

أيهما أحسن للمصمم: ميدجورني ولا شات جي بي تي؟

لا توجد أداة تفوز في كل مهمة. Midjourney مبنية حول الشكل والذوق، بمراجع الأسلوب ولوحات الإلهام والتخصيص. وChatGPT أقوى حين تريد أن تشرح ما تريده بكلام عادي وتعطي تعليمات دقيقة وتعدّل داخل المحادثة. اختر حسب النقطة التي تبدأ منها وما ستسلّمه في النهاية.

هل نانو بنانا أحسن من ميدجورني؟

كل منهما قوي في شيء مختلف. Nano Banana، أي نماذج الصور في Gemini من Google، هو الأقوى في تعديل صورة حقيقية بالوصف والحفاظ على المنتج أو الشخص ثابتًا عبر التعديلات. أما Midjourney فأقوى في استكشاف اتجاه بصري جديد. ويمكن أن يستخدم المشروع الواحد الاثنين في مرحلتين مختلفتين.

مين فيهم بيكتب عربي صح على الصورة؟

حتى أكتوبر 2026 لا تعد أي منها بذلك. Midjourney تقول إن النص يعمل أفضل بالحروف اللاتينية، وGoogle تحذّر من أخطاء الإملاء، وOpenAI توصي بمراجعة كل كلمة. ولّد الصورة بلا نص، واكتب العربي بنفسك في برنامج تصميم.

هل صور Midjourney بتبقى عامة للكل؟

نعم، افتراضيًا. تصف Midjourney نفسها بأنها مجتمع مفتوح افتراضيًا، فقد تظهر صورك في صفحة Explore على موقعها. ووضع Stealth يخفيها على الموقع، لكنه متاح فقط في خطتي Pro وMega، وما تصنعه في قناة Discord مشتركة يبقى ظاهرًا لمن فيها.

ينفع أستخدم صور الأدوات دي تجاريًا لعميل؟

غالبًا نعم، بشروط. Midjourney تقول إنك تملك ما تصنعه، لكن الشركات الكبيرة يجب أن تشترك في Pro أو Mega لتملكه. وشروط OpenAI تقول إنك تملك الناتج، وGoogle تقول إنها لن تدّعي ملكيته لكنها قد تولّد محتوى مشابهًا لغيرك. اقرأ الشروط الحالية قبل أي عمل لعميل.

بقلم

محمد متولي

مصمم منذ 2010: هوية بصرية، وخط عربي، وتغليف، وواجهات مستخدم، وموشن، وأبني منتجات والذكاء الاصطناعي أداة في يدي.

المزيد عني →

لنبنِ شيئاً لا يُنسى.