التصميم الغرافيكي

توليد الصور بالذكاء الاصطناعي

توليد الصور بالذكاء الاصطناعي يعني أن نموذجا يبني من وصفك النصي صورة لم تكن موجودة من قبل. والجزء الصعب ليس التوليد، بل إيصال تلك الصورة إلى ما يمكن تسليمه لعميل.

  • الدرس 11 من 12
  • مبتدئ
  • مجاني، دون تسجيل

من جملة واحدة إلى ملف يمكن تسليمه

  1. 1

    الفكرة

    ما الذي يفترض أن تفعله هذه الصورة ولمن. جملة واحدة. وقبل أن تملكها لا يمكن الحكم على أي خرج.

  2. 2

    الموجز والموجّه

    ستة قيود صريحة: الموضوع، والحركة، والإطار، والإضاءة، والخامة، واللوحة. واترك واحدا يختره النموذج.

  3. 3

    التوليد

    الخطوة الوحيدة التي يؤديها النموذج. وإعادة تشغيل الموجّه نفسه تعطي صورة أخرى، لا صورة أفضل.

  4. 4

    الاختيار وتثبيت المظهر

    احتفظ بالناتج الصحيح صورة مرجعية وابن بقية المجموعة منه. هنا تبدأ المجموعة بالتطابق.

  5. 5

    التحرير

    القصّ واللون النهائي وأي نص يفترض أن يجلس على الصورة. النص الفارسي يُضاف هنا لا داخل النموذج.

  6. 6

    التسليم

    الصيغة والأبعاد والوزن الصحيحة، مع قرار عن إخبار العميل باستعمال الذكاء الاصطناعي من عدمه.

الخطوة الثالثة هي الوحيدة التي يؤديها النموذج. والخمس الأخرى عملك أنت، وفيها يُصنع الفرق بين صورة طريفة وملف قابل للتسليم.

آخر مراجعة: تُراجع الحقائق وأسماء الأدوات في هذا الدرس مقابل مصادرها في هذا التاريخ.

ماذا يفعل نموذج الصور فعلا

نموذج تدرّب على ملايين الصور والأوصاف يبني من جملتك صورة جديدة. هو لا يبحث، ولا يأخذ ملفا من مكان ما، ولا يعثر على صورة؛ كل بكسل في الخرج يُصنع في تلك اللحظة.

لهذا الفارق نتيجة عملية تتخطاها أكثر الدروس. شغّل الموجّه نفسه مرتين تحصل على صورتين مختلفتين، لا على صورة أفضل. فالعادة الشائعة، أي الضغط على زر التوليد حتى يخرج أحد النواتج جيدا، هي في الحقيقة شراء حظ. والرافعة الحقيقية في موضع آخر.

تلك الرافعة هي الصورة المرجعية: صورة أو أكثر ترسلها مع الموجّه ليأخذ منها النموذج الشكل والأسلوب والشخصية. وهي الطريق الوحيد لبقاء منتج أو شخص كما هو عبر عشر صور متتالية، وهي ما يملأ الفجوة بين صورة طريفة ومجموعة صور قابلة للتسليم. وسقف عدد الصور المرجعية يختلف بين النماذج، وأرقامه في القسم التالي.

وأمر آخر لا يُرى في اليوم الأول: هذه النماذج تؤدي عملين منفصلين وليست متساوية فيهما. توليد صورة من نص عمل، وتحرير صورة موجودة عمل آخر، وترتيب النماذج في الاثنين مختلف. فإن كان عملك تحريرا في أغلبه، فترتيب التوليد من النص ليس جوابا لسؤالك.

وآخر ما يستحق أن يُقال من البداية: الخرج إطار، لا ملف تسليم. القصّ والصيغة والوزن واللون النهائي وأي نص يفترض أن يجلس على الصورة تبقى كلها عملك أنت. والصورة التي تذهب من النموذج مباشرة إلى موقع العميل تكون عادة أثقل مما ينبغي، وليست تماما ما طُلب.

أي النماذج لديها أرقام فعلا اليوم

يرتّب قسم الذكاء الاصطناعي في هذا الموقع ستة نماذج صور بأوزان ومصادر معلنة، ولن نعيد بناء ذلك الجدول هنا؛ ترتيب نماذج توليد الصور في مكانه. وما ينبغي أن يأخذه المصمم منه ثلاثة أسطر.

السطر الأول: GPT Image 2 هو اليوم النموذج الوحيد الذي يكسب اللوحتين المقيستين معا، التوليد من النص والتحرير. السطر الثاني: Nano Banana Pro، نموذج غوغل الغالي، يجلس تحت نموذجها الرخيص Nano Banana 2 ويكلّف ضعفه. السطر الثالث: من هذه الستة، واحد فقط ينشر أوزانا مفتوحة يمكنك تشغيلها على عتادك.

أعدنا قراءة الأسعار من صفحة كل صانع يوم كتابة هذا الدرس، وطابقت الخمسة كلها ما هو مسجّل في قسم الذكاء الاصطناعي. الأرخص هو FLUX.2 klein 4B بسعر 0.014 دولار للصورة. وGPT Image 2 بسعر 0.053 دولار في الجودة المتوسطة و0.211 دولار في العالية، أي أربعة أضعاف. وNano Banana 2 بسعر 0.067 دولار لصورة 1K، وFLUX.2 max يبدأ من 0.07 دولار، وNano Banana Pro بسعر 0.134 دولار.

ولسقف الصور المرجعية أرقامه المنشورة، وهو للعمل المتكرر أهم من الترتيب: يقبل Nano Banana 2 حتى عشر صور أشياء، وNano Banana Pro ستا، وFLUX.2 حتى ثمانيا على الواجهة البرمجية، وklein 4B حتى أربعا. فإن كان على منتج ثابت أن يتكرر عبر مجموعة، فهذا العمود هو الذي يقرر عنك، لا عمود الجودة.

وأمر لا يُعرف إلا بالتشغيل: الصف الذي جاء أولا في لوحة الصدارة يسمّي إعدادا، لا نموذجا. فصف GPT Image 2 الأول هو الجودة المتوسطة، صاحب 0.053 دولار. واختر الجودة العالية تصبح كلفتك أربعة أضعاف دون أي درجة مقيسة خلف ذلك الاختيار.

سعر الصورة الواحدة، من صفحة كل صانع

دولار للصورة الواحدةأرخص درجة معلنة لكل نموذج
  1. FLUX.2 klein 4B 0.014 دولار
  2. GPT Image 2، جودة متوسطة 0.053 دولار
  3. Nano Banana 2، صورة 1K 0.067 دولار
  4. FLUX.2 max 0.07 دولار
  5. Nano Banana Pro 0.134 دولار

هذا العمود يقيس السعر وحده لا الجودة: فأرخص صف هنا هو السادس في ترتيب الجودة. والألوان متطابقة عمدا كي لا يُقرأ الشريط القصير على أنه نموذج أفضل.

لماذا لا يظهر Midjourney في أي جدول لنا

Midjourney في كل قوائم التوصيات وليس في جدولنا في أي موضع. لا لأنه سيئ، بل لأننا لم نقرأ منه شيئا.

جرّبنا مجددا يوم كتابة هذا الدرس: الصفحة الرئيسية والتوثيق وحتى ملف robots.txt في موقع Midjourney، ثلاثتها تعيد الرمز 403 لخادمنا. فلا يمكن قراءة صفحة أسعاره، ولا شروط استخدامه، ولا حتى القاعدة التي يفترض أن نلتزم بها. وللمقارنة، مواقع توثيق OpenAI وغوغل وBlack Forest Labs تفتح كلها من الخادم نفسه.

والأهم: ليس لـMidjourney صف في أي من لوحتي قياس الصور. قرأ قسم الذكاء الاصطناعي في هذا الموقع تلك اللوحتين آخر مرة في 12 آب 2026: سبعة وسبعون نموذجا مقيسة في التوليد من النص وثلاثة وخمسون في التحرير، ولم يكن اسمه في أي منهما. فلا حقائق لدينا ولا شواهد، ولا نبني صفا بلا أرقام.

موقفنا بهذه البساطة: إن قرأت في مكان ما أن أداة ما هي الأفضل، فاسأل أين الرقم. قائمة بعشر أدوات بلا عمود مقيس هي محتوى لمحركات البحث، لا دليل شراء. وهذه ليست حجة ضد Midjourney؛ بل ضد أي توصية بلا مصدر، بما فيها توصياتنا يوم نتوقف عن ذكر مصدر.

كيف تكتب موجّه صورة

الموجّه الجيد ليس وصفا، بل موجزا. فبدل كتابة جملة شاعرية واحدة، تثبّت ستة أمور صراحة وتترك الباقي للنموذج: الموضوع، وما يفعله، والإطار ومسافة الكاميرا، والإضاءة، والخامة أو الأسلوب، ولوحة الألوان. واترك أيا من هذه الستة يختره النموذج عنك، ولن تعرف ماذا اختار إلا حين ترى الخرج.

والجزء الذي نادرا ما يُقال: تكديس الصفات لا يفعل شيئا عادة. فعبارة «جودة فائقة، 8K، سينمائي، حائز جوائز» صف كلمات لا يضيف قيدا حقيقيا. أما رقم أو نسبة حقيقية فتعمل أكثر بكثير: إطار أفقي، الموضوع في الثلث الأيسر، فراغ في أعلى الإطار للنص. هذه أمور تكتشف أنها كانت ضرورية لحظة وضعك الصورة داخل تصميم.

اكتب القيود السلبية أيضا، لكن أبقها قصيرة. فقائمة طويلة بما لا تريده تطول بقدر قائمة ما تريده، وأثرها غير قابل للتوقع مسبقا. أمران أو ثلاثة تفسد فعلا في كل مرة تكفي.

والخطوة الأخيرة، وهي التي تصنع الفارق فعلا: حين يخرج ناتج بالمظهر الصحيح أخيرا، احتفظ به صورة مرجعية وابن بقية المجموعة منه. لهذا يوجد عمود المرجع في القسم السابق، وهو الطريق الوحيد لتخرج عشر صور في مجموعة متشابهة. ومن لا يعرف هذا يرمي النرد من الصفر في كل مرة.

ورقة موجّه الصورة

قبل الضغط على زر التوليدستة قيود

ما يجب أن يحمله الموجّه

  • الموضوع وما يفعله
  • الإطار ومسافة الكاميرا، أفقي أم رأسي
  • الإضاءة: من أين تأتي وكم هي قاسية
  • الخامة أو الأسلوب: تصوير، رسم، تجسيد ثلاثي
  • لوحة الألوان، ويفضل بأكواد العلامة
  • الفراغ الذي تحتاجه للنص

ما يهدر عملية توليد

  • صف صفات: عالي الجودة، سينمائي، حائز جوائز
  • نص فارسي تتوقع أن يكتبه النموذج
  • إعادة تشغيل الموجّه نفسه أملا بنتيجة أفضل
  • قائمة طويلة من القيود السلبية

هذه الورقة لا تضمن خرجا جيدا؛ بل تمنع النموذج فقط من أن يقرر نيابة عنك فتكتشف الأمر لاحقا.

النص الفارسي داخل الصورة، حيث ينكسر هذا

هذا للمصمم الإيراني أهم سؤال ممكن، والجواب الصادق أن لا صانع نشر رقما عنه.

تصف غوغل النص في نماذجها بأنه «متقدم». وتكتب OpenAI أن الخرج قد يبقى متعثرا في النص. ويسمّي Black Forest Labs أحد إصداراته «متخصصا في الطباعة». ثلاث صفات، وصفر قياس، ولا واحد من الثلاثة يقول شيئا عن الفارسية أصلا. ونحن أيضا لم نختبر هذه النماذج الستة على الفارسية، ولن نطبع رقما حتى نفعل.

لكن ثمة توصية عملية لا تحتاج رقما، وتأتي من سنوات من وضع الصور على مواقع فارسية: لا تولّد النص داخل الصورة. ابن الصورة بلا أي حروف وضع النص فوقها في أداة التصميم أو مباشرة بـCSS. تربح ثلاثة أمور دفعة واحدة: أشكال حروف صحيحة، وإمكان ترجمة الصورة نفسها إلى لغة أخرى، ونصا يستطيع محرك البحث وقارئ الشاشة قراءته فعلا.

وثمة حالات لا ينفع فيها هذا، كنص يجب أن يجلس على سطح منحن أو داخل المشهد. وحتى هناك، الجواب ليس أن تأمل أن يصيب النموذج؛ الجواب مرور تحرير في أداة تصميم.

لمن الصورة التي صنعتها للتو

للعمل الشخصي ليس هذا سؤالا جادا. أما للعمل الذي تُصدر له فاتورة، فيجب أن يُعرف الجواب قبل صنع الصورة لا بعد تسليمها.

في الشروط الإضافية لواجهة Gemini البرمجية تقول غوغل صراحة إنها لن تدّعي ملكية المحتوى الذي تولّده، ثم تضيف الجملة الثانية فورا: أنت تقرّ بأن غوغل قد تولّد المحتوى نفسه أو ما يشبهه لآخرين وتحتفظ بكل الحقوق في ذلك. فما تحصل عليه ملكية لا حصرية. ولشعار تجاري، هذا الفرق هو القصة كلها.

ويكتب Black Forest Labs رخصه أوضح لأنه ينشر أوزان النماذج: فـFLUX.2 klein 4B تحت Apache 2.0، أي أن العمل التجاري حر، ويشتغل على بطاقة رسوميات بذاكرة نحو ثلاثة عشر غيغابايت. أما إصدار 9B من العائلة نفسها فتحت رخصتهم غير التجارية، وإصدار dev غير تجاري أيضا. اسم عائلة واحد وثلاثة شروط مختلفة؛ فإن قرأت في مكان ما أن FLUX مجاني، فاسأل أي FLUX.

وعن OpenAI وMidjourney علينا أن نذكر حدا يخصّنا: صفحتا شروط الاستخدام لديهما تعيدان 403 لخادمنا. توثيق OpenAI التقني يفتح ومنه وحده ننقل؛ ولا نكتب شيئا عمّا لم نقرأه. فإن صنعت صورة بأحدهما وستدخل في عمل عميل، فاقرأ الشروط من حسابك أنت.

ونقطة لا تحلّها أي رخصة: أن تملك شيئا ليس كأن يكون أصيلا. فالصورة التي صنعها نموذج يمكن أن تكون ملكك قانونا وتظل تشبه مئتي صورة أخرى أُنتجت بالنموذج نفسه في الأسبوع نفسه. ولهوية بصرية لعلامة، هذا في ذاته مخاطرة.

أين نستعمل هذه الصور وأين لا

موقفنا بسيط: صورة الذكاء الاصطناعي لا تحلّ محل التصوير، بل محل صور المكتبات الجاهزة.

حيثما كانت الصورة زينة ولا يبني أحد قرارا عليها، تتفوق هذه النماذج على أي مكتبة صور في السرعة والكلفة معا: مسودة أولى لفكرة تعرضها على عميل، وخلفية شريحة، وشكل توضيحي داخل مقال، ولوح مزاج. هناك تساوي السرعة شيئا ولا تساوي الأصالة شيئا.

وحيثما كانت الصورة تدّعي شيئا بنفسها، فلا. صورة المنتج التي يشتري العميل بناء عليها، وصورة الفريق، وقطعة معرض الأعمال، وكل صورة تقول «هؤلاء نحن» أو «هذه بضاعتك». الصورة المصنوعة في هذه المواضع ليست مشكلة قانونية فحسب؛ بل فجوة ثقة لا تُغلق بعد أن ينتبه إليها أحد.

وثمة طبقة ثالثة لا تذكرها أكثر الدروس أصلا: ما تنتجه هذه النماذج ليس بلا علامة عادة. فنماذج غوغل للصور تضع علامة مائية غير مرئية على كل خرج، وبعض الخدمات تلصق بالملف سجلا موقّعا أيضا. وإن أردت أن تعرف ماذا داخل الملف الذي ترفعه، فإن درس العلامة المائية للصور وSynthID يفتح هذا بالضبط.

وإن كان على الخرج أن يكون ملفا جاهزا للنشر لا إطارا خاما، فهذا ما يُعمل في خدمة التصميم الغرافيكي.

المسار السريع مع الذكاء الاصطناعي

المسار السريع هنا ليس «موجّها أطول». بل حركتان لا تكاد تظهران في الدروس: اكتب الموجز مرة واحدة ودع نموذجا نصيا يحوّله إلى ثلاثة موجّهات مختلفة فعلا، ثم بدل إعادة التشغيل، ثبّت الناتج الصحيح واسحب بقية المجموعة منه. الحركة الثانية هي ما يحوّل صورة مفردة إلى مجموعة. ويكفي نموذج سريع رخيص لتوسيع الموجز؛ واختيارنا الحالي في <a class="text-link" href="/ar/ai/">قسم الذكاء الاصطناعي</a>، وخذ نموذج الصور من <a class="text-link" href="/ar/ai/image/">ذلك الترتيب</a>.

  1. اكتب في جملة واحدة ما الذي يفترض أن تفعله هذه الصورة ولمن وأين ستجلس. واذكر الأبعاد وموضع النص هنا لا لاحقا.
  2. أعط الوصفة أدناه لنموذج نصي بمتغيراتك أنت وخذ ثلاثة موجّهات. ولا تحذف البندين الثالث والرابع؛ فهما ما يخرج المسار من التخمين.
  3. شغّل الموجّهات الثلاثة مرة واحدة واختر واحدا. وإن لم يكن أي منها صحيحا، فغيّر الموجز لا الموجّه: فالمشكلة تكون في الجملة الأولى دائما تقريبا.
  4. أعد الصورة المختارة صورة مرجعية وابن بقية المجموعة منها. صارت كل صورة جديدة نسخة من ذلك المظهر لا قرعة جديدة.
  5. وفي النهاية تحقق أنت من أمرين: أن النص على الصورة أُضيف خارج النموذج، وأن رخصة النموذج الذي استعملته تناسب ما ستُستعمل الصورة له.

وصفة جاهزة للنسخ

الدور: مدير فني يكتب موجز صورة للويب.

ما الذي يفترض أن تفعله هذه الصورة ولمن:
{اكتبه في جملة واحدة}

أين تجلس: {مثلا ترويسة صفحة خدمات، 1600 في 900، النص على النصف الأيسر}
لوحة العلامة: {أكواد الألوان}
ما يجب ألا يكون في الصورة أبدا: {أمران أو ثلاثة}

أعد الأقسام الأربعة هذه بالضبط:

1. ثلاثة موجّهات إنجليزية، فقرة لكل منها، يذكر كل منها القيود الستة صراحة:
   الموضوع، والحركة، والإطار ومسافة الكاميرا، والإضاءة، والخامة أو الأسلوب،
   ولوحة الألوان. وعلى الثلاثة أن تختلف في الخامة أو الأسلوب لا في الصفات.

2. لكل موجّه، اذكر أيا من القيود الستة لم أعطه أنا وملأته أنت بنفسك.

3. ثلاثة قيود سلبية على الأكثر، فقط ما يفسد فعلا في هذا الموضوع بالذات.

4. جملة واحدة: بعد أن أختار واحدا من الثلاثة وأعيده صورة مرجعية، أي خاصية فيه
   ينبغي أن أثبّتها كي تتطابق بقية المجموعة.

لا تضع أي نص داخل الصورة.

قبل أن تثق بالناتج: هذا المسار لا يحلّ ثلاثة أمور، وثلاثتها عمل إنسان. أولا، النص على الصورة: قال الموجّه ألا نص داخل الصورة، فكتابته تبقى عليك. ثانيا، الرخصة: تثبيت المظهر لا يجعل الصورة أصيلة، وإن كان الخرج لهوية علامة فجملة غوغل عن توليد محتوى مشابه لآخرين تبقى قائمة. ثالثا، ما داخل الملف نفسه: خرج هذه النماذج يحمل عادة علامة مائية أو سجلا موقّعا، وعليك أن تعرف أيهما قبل النشر.

الذكاء الاصطناعي في هذا العمل

هذا الدرس كله عن العمل بالذكاء الاصطناعي، فيتناول هذا القسم السؤال الذي يُطرح عادة في الآخر: أيها متاح من إيران أصلا، وماذا يحمل الخرج معه. موقفنا في جملة: <strong>النموذج الذي يمكن تنزيل أوزانه أقبل للدفاع في عمل العملاء من نموذج أفضل لا يوجد إلا خلف حساب أجنبي، ولو كانت جودته أدنى.</strong>

أدوات تساعد فعلا

  • GPT Image 2 اليوم هو النموذج الوحيد الذي يكسب اللوحتين المقيستين. وسعره في الجودة المتوسطة 0.053 دولار للصورة، وهو الإعداد الذي نال الترتيب. ولا تنشر OpenAI سقفا للصور المرجعية في توثيقها، وإيران ليست في قائمة الدول المدعومة لديها، فلا نعرف طريق دفع رسميا.
  • Nano Banana 2 أرخص طريق إلى نتيجة قريبة من المركز الأول، بسعر 0.067 دولار لصورة 1K وسقف عشر صور مرجعية، وهو الأعلى في هذا الجدول. وقائمة المناطق المتاحة لواجهة Gemini البرمجية التي نشرتها غوغل لا تضم إيران. وأمر يهمّ في القسم التالي: توثيق غوغل نفسه يقول إن كل صورة مولّدة تتضمن علامة SynthID المائية.
  • FLUX.2 العائلة الوحيدة هنا ذات الأوزان المفتوحة: نُشر klein 4B تحت Apache 2.0، ويشتغل على بطاقة رسوميات بذاكرة نحو ثلاثة عشر غيغابايت، والاستعمال التجاري به حر. فإن كان شرطك ألا تغادر الصورة جهازك وألا يلزم حساب أو بطاقة، فهذا الخيار الوحيد. وجودته دون قمة الجدول، وBlack Forest Labs لا ينشر قائمة دول مدعومة أيضا.
  • Nano Banana Pro هو هنا لأنه الشراء الخاطئ الشائع: نموذج غوغل الرائد بسعر 0.134 دولار، أي ضعف نموذجها الرخيص، وترتيبه دونه. فإن كنت تختار بين نموذجي غوغل، فالأرخص هو الجواب دائما تقريبا. وهذا أيضا، كأي خرج صور من غوغل، يحمل علامة SynthID المائية.

اين ينقلب ضدك

خطران محددان في هذا العمل، ولا واحد منهما عن الجودة.
أولا، ما يخرج مع الملف. يقول توثيق واجهة Gemini البرمجية صراحة إن كل الصور المولّدة تتضمن علامة SynthID المائية، أي علامة غير مرئية تستطيع غوغل نفسها كشفها. وهذا ليس غير قانوني ولا سريا؛ لكنه يعني أن موقعا ينشر عشرات هذه الصور يمكن التعرف عليه من الملفات نفسها. وإن أردت أن تعرف ماذا داخل الملف بالضبط ومن يستطيع قراءته، فإن الدرس التالي في هذا المسار يفتح ذلك.
ثانيا، ما لا تحلّه الرخصة. تقول غوغل في شروطها إنها لا تدّعي ملكية الخرج، ثم تقول فورا إنها قد تولّد المحتوى نفسه أو ما يشبهه لآخرين. ولصورة زخرفية لا أهمية لهذه الجملة؛ ولشعار أو هوية بصرية هي القصة كلها.
وعن الوصول من إيران لا نقترح أي التفاف. ولمعرفة وضع كل من هذه الأدوات، انظر الذكاء الاصطناعي في إيران ودليل الشراء.

المصادر: Google: image generation in the Gemini API Google: Gemini API pricing, per-image tiers Google: Gemini API Additional Terms, Use of Generated Content OpenAI: image generation guide, cost per image Black Forest Labs: FLUX.2 overview and licences Black Forest Labs: pricing per image

حدود هذه النصيحة

لم يشغّل هذا الدرس النماذج الستة جنبا إلى جنب على موجّه واحد، وكل أرقامه منشورة، فما تقرأه مقارنة توثيق لا اختبارنا نحن. وأربعة أمور غائبة عمدا. أي رقم عن جودة النص الفارسي داخل الصورة، لأن لا صانع ينشره ولم نقسه نحن. وأي شيء من شروط استخدام OpenAI أو Midjourney، لأن الصفحتين تعيدان 403 لخادمنا ولا نكتب عمّا لم نقرأه. وأي رقم عن مقدار ما يوفره هذا المسار من وقت، لأن لا مصدر لدينا ندافع عنه. وأي طريق للوصول من إيران، لأننا لا نعلّم ما لا نوصي به. وحد صادق آخر: الأسعار هنا هي أرخص درجة معلنة لكل نموذج، والدرجة ليست النموذج؛ فالنموذج نفسه في جودة أعلى قد يكلّف أربعة أضعاف.

من عملنا نحن

أننا لا نبني صفا بلا أرقام قرار، وهو قابل للفحص على هذا الخادم نفسه. يوم كتابة هذا الدرس جرّبنا مجددا: الصفحة الرئيسية لـMidjourney وتوثيقه وحتى ملف robots.txt لديه، ثلاثتها أعادت 403 لخادمنا. وفي الدقيقة نفسها فتحت توثيقات OpenAI وغوغل وBlack Forest Labs كلها بالرمز 200، أي أن المشكلة لم تكن في شبكتنا. وترى النتيجة في بيانات قسم الذكاء الاصطناعي في هذا الموقع: ملف Midjourney موجود، وحالته حية، وهو خال من أي حقيقة عمدا ولا صفحة له. ويمكنك إجراء الاختبار نفسه على أي أداة أوصاك بها أحد، ويأخذ دقيقة: افتح صفحة أسعارها وصفحة شروطها وانظر هل تفتحان أصلا.

اسئلة متابعة حقيقية

أي ذكاء اصطناعي هو الأفضل لتوليد الصور؟

إن لم تكن الميزانية هي القيد، فـGPT Image 2، لأنه النموذج الوحيد الذي يكسب اللوحتين المقيستين. وإن كانت الكلفة مهمة فـNano Banana 2 يقترب بأقل، وإن كان شرطك أن يشتغل النموذج على عتادك فـFLUX.2 klein 4B هو الخيار الوحيد. ثلاثة أجوبة لثلاثة شروط، ولا واحد منها أفضل بلا قيد.

هل يمكن استعمال صورة الذكاء الاصطناعي في موقع عميل؟

يعتمد على ما تدّعيه الصورة. للزينة والخلفيات والأشكال التوضيحية، نعم، وغالبا أفضل من مكتبة صور. ولصور المنتجات وصور الفريق وقطع معرض الأعمال، لا، لأن الصورة هناك ادعاء بذاتها. وقبل أي قرار اقرأ رخصة النموذج الذي استعملته؛ ففي هذه النماذج الخمسة ثلاث مجموعات شروط مختلفة.

هل يمكن استعمال هذه النماذج من إيران؟

بالنسبة إلى GPT Image 2 ونموذجي غوغل، إيران ليست في قائمة الدول المدعومة ولا طريق دفع رسميا. وبالنسبة إلى FLUX لم تُنشر قائمة دول أصلا. والمسار الوحيد الذي لا يحتاج حسابا أو بطاقة أجنبية هو تشغيل klein 4B محليا. ونحن لا نبيع حسابات ولا نقترح أي التفاف.