أفضل ذكاء اصطناعي لتوليد الصور
GPT Image 2 هو الأول اليوم، لأنه النموذج الوحيد الذي يفوز في لوحتي Arena معا: التوليد من النص والتحرير. لكن إن كانت التكلفة تهمك فـ Nano Banana 2 يقترب منه بأقل، وإن وجب التشغيل على عتادك أنت فصف واحد فقط من هذا الجدول مفتوح أمامك.
- ستة نماذج، جميعها مرتبة
- أرقام من وثائق الشركات ولوحات الصدارة
- خانة إيران بمنهج معلن
آخر تحقق: هذه صفحة مرجعية. نعيد التحقق منها من مصادر الشركة المطوّرة ونحدّثها عند صدور أي إصدار جديد. ما الذي تغيّر
ترتيب اليوم، مبني على ما نشر فعلا
درجتا اللوحتين مقروءتان من Arena، والأسعار والمواصفات من وثائق كل شركة. والخانة الفارغة تعني أن شيئا لم ينشر، لا أن الرقم صفر.
| الترتيب | الأداة | النتيجة | التوليد من النص 30 | تحرير الصور 20 | سعر الصورة 20 | المدخلات المرجعية 10 | انفتاح الأوزان 10 | الوصول من إيران 10 |
|---|---|---|---|---|---|---|---|---|
| 1 | GPT Image 2 الخيار الحالي | 73.5 | 1,381 المصدر | 1,463 المصدر | $0.053 للصورة الواحدة المصدر | غير موثّق | 0/3 لا أوزان منشورة. صفحة النموذج تسرد ثلاث نقاط نهاية للواجهة فقط ولا تذكر أي مسار تنزيل | محجوب / لا طريق يعمل قرأنا اليوم قائمة الدول المدعومة لواجهة OpenAI على developers.openai.com وإيران ليست فيها. أما openai.com نفسه فيعيد 403 لخادمنا، فهذه القائمة هي المستند الوحيد القابل للقراءة وهي تتحدث عن الواجهة لا عن تطبيق ChatGPT. لم يُجرَ اختبار شبكة من داخل إيران. |
| 2 | Nano Banana 2 | 65.5 | 1,264 المصدر | 1,385 المصدر | $0.067 للصورة الواحدة المصدر | 10 مدخل مرجعي المصدر | 0/3 لا أوزان منشورة، ولا تتيح غوغل أي مسار تنزيل لأي من نماذج الصور في Gemini | محجوب / لا طريق يعمل تسرد صفحة المناطق المتاحة لواجهة Gemini الدول التي تعمل فيها الواجهة، وإيران ليست في تلك القائمة. وهذه قراءة صفحة لا قياس شبكة. |
| 3 | Nano Banana Pro | 46.4 | 1,246 المصدر | 1,389 المصدر | $0.134 للصورة الواحدة المصدر | 6 مدخل مرجعي المصدر | 0/3 لا أوزان منشورة، ولا تتيح غوغل أي مسار تنزيل لأي من نماذج الصور في Gemini | محجوب / لا طريق يعمل تسرد صفحة المناطق المتاحة لواجهة Gemini الدول التي تعمل فيها الواجهة، وإيران ليست في تلك القائمة. وهذه قراءة صفحة لا قياس شبكة. |
| 4 | Seedream 5.0 Pro | 34.4 | 1,258 المصدر | 1,393 المصدر | غير موثّق | غير موثّق | غير موثّق | غير موثّق |
| 5 | FLUX.2 [max] | 34.0 | 1,162 المصدر | 1,262 المصدر | $0.070 للصورة الواحدة المصدر | 8 مدخل مرجعي المصدر | 0/3 لا أوزان لهذا العضو. تنشر بلاك فورست لابز أوزان klein دون max، وتذكر ذلك في جدول المقارنة الخاص بها | غير موثّق |
| 6 | FLUX.2 [klein] 4B | 30.0 | 1,030 المصدر | 1,188 المصدر | $0.014 للصورة الواحدة المصدر | 4 مدخل مرجعي المصدر | 3/3 أوزان تحت رخصة أباتشي 2.0 على Hugging Face، إضافة إلى نسخة Base غير مقطرة توجه إليها الشركة نفسها للتدريب الإضافي وLoRA مع دليل تدريب منشور | غير موثّق |
الخلية الفارغة تعني أننا لم نتمكن من التحقق من الرقم، لا أن الأداة حصلت على صفر.
كيف يُحسب هذا الترتيب
كل معيار أدناه له وزن ومصدر. غيّر وزنا فيُعاد حساب الجدول كله. لا يوجد ترتيب موضوع باليد في أي مكان من هذا المرجع.
| المعيار | الوزن | الدليل |
|---|---|---|
| التوليد من النص | 30 | Arena (Text to Image)تفضيل بشري على توليد صورة من موجه نصي. وله الوزن الأكبر لأنه ما يريده أكثر الناس من هذه النماذج |
| تحرير الصور | 20 | Arena (Image Edit)تفضيل بشري على تحرير صورة موجودة. حسب على حدة لأن اللوحتين لا تتفقان: عدة نماذج أعلى في إحداهما وأدنى في الأخرى |
| سعر الصورة | 20 | مواصفة معلنة من الشركةتكلفة صورة واحدة عند أرخص قياس تنشر له الشركة رقما. الأقل أفضل. وكل خانة مرتبطة بقياس محدد، وذلك القيد مكتوب في صفحة كل نموذج |
| المدخلات المرجعية | 10 | مواصفة معلنة من الشركةكم صورة مرجعية يقبلها التوليد الواحد. ولأجل شخصية أو منتج ثابت يهم هذا الرقم أكثر من أي شيء آخر |
| انفتاح الأوزان | 10 | مقياس مُعرَّف، مع سبب مكتوب لكل تقييممأخوذ من الرخصة التي نشرتها الشركة لا من رأينا: من واجهة فقط إلى أوزان مفتوحة برخصة حرة مع مسار موثق لإعادة التدريب |
| الوصول من إيران | 10 | عمود الوصول عندنا، بطريقته المعلنةلا يفرق هذا العمود اليوم بين أحد: المرشحون الثلاثة الذين لديهم مستند في الوضع نفسه. والشرح في المتن |
لماذا جاء GPT Image 2 أولا، بخانة فارغة
خمسون من مئة نقطة في هذا الجدول تخص لوحتي Arena، وهذا النموذج يفوز بهما معا. في التوليد من النص يسجل 1381.1 بينما الثاني عند 1263.8، وفي التحرير 1462.7 مقابل 1392.6. وهذه فوارق واسعة ولا يقترب أي من مجالي الثقة من النموذج التالي.
والمثير أنه فاز وعموده فارغ. لا تنشر OpenAI في أي موضع من وثائقها سقفا لعدد الصور المرجعية؛ ويمرر نموذج الشفرة أربع صور، لكن المثال ليس حدا، فتركنا تلك الخانة فارغة وخسر النموذج عشر نقاط. وحتى بعد خسارة العشر، ينهي متقدما بثماني نقاط على الثاني.
وثمة قيد مكتوب في اسم صف لوحة الصدارة نفسه ويهمل في أغلب المواضع: الصف الذي جاء أولا هو "gpt-image-2 (medium)"، أي مستوى الجودة المتوسط. والجودة العالية بالقياس نفسه تكلف 0.211 دولار، أي أربعة أضعاف، وليس لها صف في اللوحة أصلا. والرقم في عمود السعر عندنا هو 0.053 دولار، سعر الإعداد الذي نال الترتيب فعلا.
أرخص طريق إلى نتيجة جيدة
Nano Banana 2. هو مع Nano Banana Pro واحد من مرشحين اثنين فقط يملآن الأعمدة الستة كلها، وهو الوحيد الذي يجمع بين التغطية الكاملة والدرجة العالية. يكسب عمود المرجعيات كاملا بعشر صور أشياء، ويقل سعره عن صاحب المركز الأول.
ثم تأتي النتيجة التي ينبغي أن تغير قرار الشراء: Nano Banana Pro، وهو نموذج غوغل الرائد الغالي، يحل ثالثا هنا، دون نموذجها الرخيص. في التوليد من النص هو متأخر فعلا وتؤكد ذلك مجالات الثقة، وفي التحرير يتعادلان، وهو يكلف الضعف. فإن كنت تختار بين نموذجي غوغل، فالأرخص هو الجواب في الغالب دائما.
الصف الأخير هو الوحيد الذي يمكنك تنزيله
ينهي FLUX.2 klein 4B سادسا، ولا ينبغي قراءة ذلك على أنه سيئ. فهو يكسب عمود السعر كاملا عند 0.014 دولار، أي نحو ربع ما يكلفه الأول، وهو المرشح الوحيد الذي يسجل أي درجة في انفتاح الأوزان. أما الخمسة الآخرون فيسجلون صفرا هناك، لأن أيا منهم لم ينشر أوزانا.
إذن إن كان شرطك أن يعمل النموذج على عتادك أنت، فهذا الجدول لا يقدم ستة خيارات بل خيارا واحدا. يعمل على بطاقة رسوميات بنحو 13 غيغابايت من الذاكرة ورخصته أباتشي 2.0، أي أن العمل التجاري مسموح. جودته دون الصدارة بفارق واضح وعليك قبول ذلك؛ وفي المقابل لا يحتاج حسابا ولا بطاقة مصرفية ولا أن يكون اسم بلدك في قائمة أحد.
خانة إيران لا تفرق بين أحد هذا الشهر
يجب قول هذا صراحة لأن الجدول لا يظهره. ثلاثة مرشحين لديهم بيانات في هذا العمود: GPT Image 2 ونموذجا غوغل. وثلاثتهم في الوضع نفسه بالضبط، أي أن إيران غائبة عن قوائم الدول المدعومة لديهم ولا يوجد مسار دفع رسمي. وحين تتساوى كل القيم في عمود، يمنح المحرك الجميع الدرجة الكاملة. فلا يصنع هذا العمود أي فارق بين الثلاثة الأوائل.
وما يفعله فعلا هو خصم عشر نقاط من الثلاثة الآخرين، لا لأن وضعهم أسوأ بل لأن شركاتهم لم تنشر مستندا يقرأ. فبالنسبة لـ FLUX فتحنا اليوم فهرس الوثائق الكامل: لا يحوي صفحة شروط ولا قائمة دول، وعنوان الشروط على الموقع الرئيسي يعيد 404. ولم تنشر ByteDance ما يماثل ذلك لـ Seedream. فعمليا يقيس هذا العمود ما إذا كانت الشركة تنشر قائمة دول، وهو سؤال غير سؤال ما إذا كان الشيء يعمل من إيران. وإلى أن توجد مستندات أكثر، فهذا هو حاله ولا نخفيه.
معياران امتنعنا عن بنائهما
أولا، سقف الدقة. ثلاث شركات تكتب ثلاثة أشياء مختلفة والثلاثة لا تجتمع. تكتب غوغل "حتى 4K" لنماذجها ولا تطبع في أي موضع أبعادا بالبكسل لأي مستوى من 0.5K إلى 4K. وOpenAI هي الأدق: 3840 بكسل للضلع الأطول ومجموع بين 655,360 و8,294,400. وتقول بلاك فورست لابز 4 ميغابكسل. تسمية بلا رقم، ورقم دقيق، ووحدة ثالثة. لا يبنى عمود من هذا، فأبقينا القيم حقائق في صفحة كل نموذج ولم نبن عمودا.
ثانيا، النص داخل الصورة. وقد يكون هذا أهم سؤال على الإطلاق لمتحدثي الفارسية، وهو بالضبط ما لا ينشر أحد رقما عنه. تصف غوغل نصها بأنه متقدم. وتكتب OpenAI أن نموذجها قد يتعثر في النص. وتسمي بلاك فورست لابز flex متخصصا للتايبوغرافيا. هذه ثلاث صفات وليست قياسا واحدا. والعمود المبني على الصفات ليس عمودا. والمفتاح موجود في بنية بياناتنا ويبقى فارغا حتى يطبع أحدهم رقما.
لماذا لا وجود لـ Midjourney في الجدول أصلا
لأننا لم نقرأ منه شيئا. يعيد midjourney.com الرمز 403 لخادمنا: الصفحة الرئيسية وصفحة التحديثات ووثائقه سواء. وثمة فرق عن OpenAI يستحق التدوين: مع openai.com يجيب robots.txt على الأقل ولا يمنع الزحف، بينما midjourney.com/robots.txt هو نفسه 403، فحتى القاعدة التي يفترض أن نلتزم بها لا يمكن قراءتها.
وخلافا لـ OpenAI التي يتصدر نموذجها اللوحتين، لا يظهر Midjourney في أي من لوحتي الصور: سبعة وسبعون نموذجا في التوليد من النص، وثلاثة وخمسون في التحرير، واسمه ليس في أي منهما. فلا حقائق لدينا ولا أدلة، ولن نصنع صفا خاليا من الأرقام. وإن قرأت في مكان ما أن Midjourney هو الأفضل، فاسأل أين الرقم.
صف نال ترتيبه بنصف جدول
ينهي Seedream 5.0 Pro رابعا وقد ملأ عمودين فقط من ستة. فهو عال في اللوحتين، خامسا في التحرير وثامنا في التوليد من النص، وكفى ذلك ليتقدم على FLUX.2 max بأربعة أعشار النقطة، بينما ملأ FLUX أربعة أعمدة. اقرأ ذلك بحذر: موقع Seedream يعني أنه جيد في الشيئين اللذين قسناهما، لا أنه أفضل من FLUX.
وتلك الأعمدة الأربعة الفارغة ليست نسيانا منا أيضا. تفتح صفحة Seedream 5.0 Pro وهي مليئة بالنماذج، لكنها لا تحمل معرف نموذج ولا سعرا ولا سقفا مرجعيا ولا تاريخا. وصفحة Seedream 5.0 تعيد 200 ببدن فارغ. وتغطية هذا الصف 50 من 100 بالضبط، أي على الحد تماما: خانة فارغة أخرى وكان سيسقط من الجدول إلى قائمة "لا بيانات كافية" تحته.
متى لا تأخذ خيارنا الأول
- إن كنت تريد نصا فارسيا داخل الصورة فهذا الجدول لا يجيبك: لا تنشر أي شركة رقما عن جودة النص ولم نختبر هذه الستة على الفارسية بأنفسنا.
- إن كنت تريد اشتراكا شهريا بواجهة رسومية فهذه ليست الصفحة الصحيحة؛ هذا الجدول يقيس النماذج وأسعاره لكل صورة على الواجهة البرمجية.
- إن وجب التشغيل محليا وبلا إنترنت فالصف الأخير وحده يفيدك والبقية ليست خيارات أصلا.
- إن كانت صورتك تحتاج عدة شخصيات ثابتة فتجاهل ترتيب هذا الجدول واذهب مباشرة إلى عمود المرجعيات.
حيث تُقصّر
- لا عمود لسقف الدقة، لأن ثلاث شركات تنشر ثلاث وحدات غير متوافقة.
- لا عمود لجودة النص داخل الصورة، لأن أحدا لا ينشر رقما.
- لا تصنع خانة إيران أي فارق بين المرشحين الثلاثة الذين لديهم مستند.
- الأسعار مرتبطة بقياس محدد، وهي لـ FLUX بالميغابكسل، فرقم الجدول حد أدنى لا سعر صورة كبيرة.
- رتب Seedream 5.0 Pro بتغطية 50 بالمئة ويجب قراءة موقعه بهذا القيد.
- درجات Arena مرتبطة بإعدادات تشغيل: الصف الأول هو مستوى الجودة المتوسط وصف Nano Banana 2 يحمل لاحقة البحث في الويب.
- يغيب Midjourney لأن أي صفحة منه لا تفتح لخادمنا ولا صف له في أي من اللوحتين.
- لم نشغل هذه الستة جنبا إلى جنب على موجه واحد بأنفسنا؛ وكل رقم هنا منشور.
رأينا
إن وجب اختيار واحد ولم تكن الميزانية القيد الحاكم، فـ GPT Image 2 هو الخيار الأوضح في هذا الجدول ويفوز بفارق مريح. وإن كانت التكلفة تهم فخذ Nano Banana 2 وغالبا لن تلحظ الفرق في العمل اليومي. وإن كان شرطك أن يكون النموذج ملكك ولا يذهب إلى أي مكان، فـ FLUX.2 klein 4B هو الخيار الوحيد وتقبل مقابله جودة أدنى. ثلاثة أجوبة مختلفة لثلاثة قيود مختلفة، وليس أي منها أفضل بلا شروط.
أسئلة يطرحها الناس فعلا
ما أفضل ذكاء اصطناعي لتوليد الصور
GPT Image 2، لأنه النموذج الوحيد الذي يفوز في لوحتي Arena. وإن كان السعر يهم فـ Nano Banana 2 يقترب منه بمال أقل.
ما أرخص ذكاء اصطناعي لتوليد الصور
FLUX.2 klein 4B ابتداء من 0.014 دولار للصورة. وإن شغلته محليا فلن يكلفك شيئا للشركة، لأن أوزانه منشورة تحت أباتشي 2.0.
أي ذكاء اصطناعي يكتب نصا فارسيا داخل الصورة
لا نعلم، ولا تنشر أي شركة رقما عن ذلك. ثلاث منها تصف نصها بصفات مثل متقدم، لكن أيا منها لا يقول شيئا عن الفارسية. ولم نختبر ذلك بأنفسنا، وإلى أن نفعل لن نكتبه.
أي نموذج صور أستطيع تشغيله على حاسوبي
FLUX.2 klein 4B فقط، وأوزانه منشورة تحت أباتشي 2.0 ويعمل على بطاقة رسوميات بنحو 13 غيغابايت من الذاكرة. أما الخمسة الآخرون فلا ينشرون أوزانا إطلاقا.
هل يمكن استخدامها من إيران
بالنسبة لـ GPT Image 2 ونموذجي غوغل، إيران ليست في قائمة الدول المدعومة ولا يوجد مسار رسمي. وبالنسبة لـ FLUX وSeedream لم ينشر مثل هذا المستند أصلا. نحن لا نبيع حسابات ولا نقترح طرق التفاف.
لماذا Midjourney ليس في هذا الجدول
لأن موقعه يعيد 403 لخادمنا، حتى ملف robots.txt الخاص به، وليس له صف في أي من لوحتي الصور. لا حقائق لدينا ولا أدلة، فلن نبني صفا خاليا من الأرقام.
إن وجب أن تكون النتيجة صورة جاهزة للنشر لا مخرجا خاما، فهذا هو العمل الذي نقوم به في خدمة التصميم الغرافيكي