تنتهي معظم مقالات «النموذج X مقابل النموذج Y» بتحفّظ: «يعتمد على حالة استخدامك.» هذه المقالة تحاول ألّا تفعل ذلك. نحن نستخدم الثلاثة بانتظام. إليك ما كنّا سنقوله لصديق سأل.
باختصار — اختر حسب ما تصنعه فعلًا
| إذا كنت تصنع… | استخدم |
|---|---|
| ملصقات، إعلانات، تصاميم تسويقية فيها نص | GPT Image 2 |
| تعديلات على صور موجودة | GPT Image 2 |
| محتوى متعدّد اللغات (صيني، ياباني، كوري، عربي…) | GPT Image 2 |
| رسوم مفاهيمية، رسم فنّي راقٍ، أسلوب سينمائي حالم | Midjourney |
| حشو بصري رخيص وسريع يُرمى | DALL·E 3 |
| استكشاف فنّي عالي الحجم بميزانية محدودة | Midjourney (اشتراك) |
| أي شيء تحتاج فيه أن تتبع الصورة تعليماتك بالضبط | GPT Image 2 |
بقية هذه المقالة هي السبب وراء ذلك الجدول.
كيف اختبرنا
شغّلنا الأوامر نفسها عبر النماذج الثلاثة (GPT Image 2 عبر imagesv2، و DALL·E 3 عبر ChatGPT، و Midjourney v6 عبر Discord) في فئات: ملصقات بنص، نماذج منتجات، تعديلات صور، رسوم، تصاميم متعدّدة اللغات. لم نكن نقيس زمن التشغيل — كنّا ننظر إلى أين كان كل نموذج مفيدًا وأين كان محبِطًا.
كتابة النص: ليست منافسة
كانت هذه مشكلة صعبة لكل نموذج. الآن حلّها GPT Image 2 عمليًا، وهي لا تزال مكسورة في الآخرَين.
اختبار بسيط: اطلب من الثلاثة ملصق فيلم بعنوان «Journey to the Stars» في الأعلى و*«Coming Summer 2026»* في الأسفل.
- GPT Image 2 يُنتج ملصقًا بكلا سطري النص مكتوبَين صحيحًا، في الموضعين الصحيحين، بخطّ يطابق الأجواء السينمائية.
- DALL·E 3 يُنتج ملصقًا بشيء على شكل حروف في الأعلى يكاد—لكنه لا—يكتب العنوان، وكلام بلا معنى في الأسفل.
- Midjourney يُنتج ملصقًا جميلًا بنص مزيّف تمامًا.
إذا احتاج مخرجك كلمات داخل الصورة، فهذه هي الفئة الوحيدة المهمّة وهي تُنهي الجدل.
تعديل الصور: نموذج واحد فقط يستطيع
ترفع صورة موجودة، تشير إلى منطقة، وتقول ما الذي تريد تغييره.
- GPT Image 2 يفعل هذا أصلًا. «أضِف كوب قهوة على الطاولة»، «غيّر القميص إلى الكحلي»، «اجعل الخلفية شاطئًا» — وتبقى بقية الصورة سليمة.
- DALL·E 3 لا يدعم هذا إطلاقًا. لا يمكنك إلا إعادة التوليد من الصفر.
- Midjourney لديه تنويعات، وتنويع مناطق، وترقية — مفيد لاستكشاف الفنّ، لا لـ«أصلِح هذا الشيء الواحد في صورتي الموجودة».
للقطات التجارة الإلكترونية، وصور العقارات، ونماذج المنتجات، وتنقيح الصور الشخصية، GPT Image 2 هو الخيار الجادّ الوحيد.
الجودة الجمالية: لا يزال لدى Midjourney روح
هنا يصبح الأمر أقل أحادية.
دأب Midjourney بهدوء على تدريب ذوق محدّد جدًا في نموذجه لسنوات: إضاءة سينمائية، أجواء تصويرية، لوحات ألوان تبدو وكأنها أتت من فيلم أو كتاب فنّ. حين تطلب من Midjourney رسمًا أو قطعة فنّ مفاهيمي، يصنع شيئًا يبدو وكأن إنسانًا صنعه.
أما GPT Image 2 و DALL·E 3 فأكثر حرفية بالمقارنة. يعطيانك ما طلبته — بدقّة — لكنهما لا يُضيفان مفاجأة جمالية. المخرج صحيح. ومخرج Midjourney جميل أحيانًا.
إذا كنت تصنع مطبوعات فنّية، أو أغلفة كتب، أو فنّ مفاهيم لألعاب RPG، أو لقطات سينمائية حالمة، فلا يزال Midjourney الأداة الصحيحة. وهو أيضًا الأداة المفضّلة للمصمّمين الذين يستخدمون الذكاء الاصطناعي للإلهام ثم يُعيدون رسم النتائج يدويًا.
اتّباع التعليمات: GPT Image 2 بفارق واضح
خُذ أمرًا من خمس جُمَل: «لقطة بزاوية واسعة لزقاق طوكيو صغير، طفلان بمظلّتين حمراوين في المقدّمة، لافتات نيون تنعكس في البِرَك، مطر خفيف، ضوء وقت الغروب، حُبيبات فيلم طفيفة.»
- GPT Image 2 يقدّم شيئًا قريبًا من العناصر الستة كلها.
- DALL·E 3 يُبقي ثلاثة أو أربعة، يُسقط الباقي، ويُضيف عناصر إضافية لم تطلبها.
- Midjourney يُبقي الأجواء لكنه يفسّر التفاصيل بحرّية — جميل، وأحيانًا لا يشبه ما كتبته إطلاقًا.
لعمل العملاء، أو المحتوى ذي العلامة، أو أي شيء يهمّ فيه «أردتُه أن يفعل ذلك الشيء الذي طلبته»، GPT Image 2 هو ما تلجأ إليه.
المحتوى متعدّد اللغات: GPT Image 2، لا غير
إذا احتجت نصًا بالصينية أو اليابانية أو الكورية أو العربية أو الهندية أو أي شيء خارج الأبجدية اللاتينية داخل الصورة، فالنموذجان الآخران غير صالحَين. سيُنتجان حروفًا مزيّفة تبدو مقنعة. أما GPT Image 2 فيُنتج نصًا صحيحًا مقروءًا بعشرات اللغات، غالبًا بجانب الإنجليزية.
للعلامات العاملة عبر أسواق متعدّدة — تجارة إلكترونية DTC، محتوى كي-بوب وجي-بوب، ملصقات أنمي ترويجية، حملات رأس السنة الصينية — يغيّر هذا اقتصاديات الإنتاج. نموذج واحد، تنويعات بعدّة لغات، في دقائق.
وقفة مع واقع الأسعار
للنماذج الثلاثة أشكال تسعير مختلفة جدًا:
- GPT Image 2 — الدفع لكل توليد. على imagesv2، هذا قائم على الرصيد، وشفّاف قبل أن تنقر. تصل الخطط السنوية إلى نحو $0.0033 لكل رصيد في Pro، و$0.0021 في Ultra. راجِع تفصيل الأسعار.
- DALL·E 3 — لكل صورة عبر واجهة OpenAI أو مشمول في ChatGPT Plus. الأرخص إن كنت تولّد بضع صور شهريًا فقط.
- Midjourney — اشتراك شهري فقط ($10/شهر للأساسي حتى $120/شهر لـ Pro للساعات السريعة والتزامن). قيمة رائعة إن كنت تولّد مئات الصور شهريًا؛ وقيمة سيّئة إن كنت تولّد عشرًا.
للمستخدمين العَرَضيين، تتيح لك حزمة الـ$14.90 لمرة واحدة على imagesv2 (1000 رصيد، لا تنتهي صلاحيتها) تجنّب الاشتراكات الثلاثة كلها والتجربة فحسب.
السرعة
- GPT Image 2 — متوسّطة. يُعطي النموذج الأولوية للدقّة على الإنتاجية الخام، وهي المقايضة الصحيحة لمعظم العمل الإنتاجي.
- DALL·E 3 — أسرع، بسقف جودة أدنى.
- Midjourney — سريع في الطبقات المدفوعة (15 «ساعة سريعة» شهريًا في الأساسي؛ و Pro غير محدود عمليًا)، بتوليد متزامن قوي. إن كنت تكرّر عشرات التنويعات في الجلسة، فهذا يهمّ.
أين يفوز كلٌّ منها
لضغط كل ما سبق في رأي يمكنك تسليمه لزميل:
استخدم GPT Image 2 حين تحتاج أن يكون المخرج صحيحًا. التصاميم التسويقية، نماذج المنتجات، الملصقات بنص حقيقي، تعديل الصور، المحتوى متعدّد اللغات، أي شيء ستُطلقه فعلًا. هذا هو الافتراضي لمعظم العمل الاحترافي اليوم.
استخدم Midjourney حين تحتاج أن يكون المخرج جميلًا. فنّ المفاهيم، الرسوم، لوحات الإلهام، أي شيء تكون فيه الجمالية هي المنتج ولا تهمّ فيه الأخطاء الصغيرة. لا يزال ملك الذوق.
استخدم DALL·E 3 حين تكون أصلًا داخل ChatGPT وتحتاج مرئيًا سريعًا. لا بأس به. وهو مشمول في اشتراكك الحالي. لا تُفكّر فيه أكثر من اللازم.
جرّب GPT Image 2 على عملك أنت
أسرع طريقة لتعرف ما إذا كان GPT Image 2 يناسب سير عملك هي أن تُمرّر أحد مشاريعك الحقيقية عبره. اذهب إلى الـ playground في imagesv2، وشغّل الأمر الذي اعتدت أن تدفع لمصمّم ليصوغه، وقارِن. تظهر تكلفة الرصيد قبل أن تؤكّد، فيمكنك التجربة دون مفاجآت.
إن أردت التحقّق من البداية إلى النهاية قبل الاشتراك، بـ$14.90 تشتري 1000 رصيد. هذا كافٍ لاختبار النموذج على عشرات التصاميم الحقيقية — كافٍ لتعرف.
