چه چیزی عوض شد
هر تغییر این مرجع با تاریخ و منبعش اینجا ثبت می شود، از نسخه تازه مدل ها تا تغییر وزن معیارهای رتبه بندی.
-
جا به جایی رتبه کدنویسی
هر دو لیدربوردی که رتبه بندی این سایت از آنها می خواند دوباره خوانده شدند و نتیجه بزرگ ترین جا به جایی تاریخ این مرجع بود. در به روزرسانی ۲ سپتامبر بورد WebDev، ردیف claude-fable-5.1-max با ۱۷۶۵ اول شد و ردیف بعدی، claude-opus-5-max، با ۱۶۸۷ می آید: هفتاد و هشت امتیاز فاصله، در ستونی که کل رده بالایش تا هفته پیش در بیست و دو امتیاز جا شده بود. پس اپوس ۵ بعد از سه هفته صدر دسته کدنویسی را از دست داد و امتیازش از ۷۷.۵ به ۶۲.۷ آمد. فایل فیبل ۵.۱ در ۲ سپتامبر نوشته بود که categories عمدا خالی است و به محض اینکه Arena رایش را بدهد پر می شود؛ همان شرط برقرار شد و مدل با دو ردیف شاهد وارد دسته های کدنویسی و چت شد. در دسته چت اما فیبل ۵ با ۱۵۰۷ اول ماند و ۵.۱ با ۱۵۰۴ دوم شد، یعنی سه امتیاز اختلاف بین یک مدل بازنشسته و جانشینش. عددهای هر نه نامزد قبلی هم به روز شدند: قوان ۳.۸ مکس در بورد متن از ۱۴۹۰ به ۱۴۸۰ افتاد و در دسته چت از چهارم به هشتم رفت، و کیمی کی۳ مکس با عدد دست نخورده ۱۶۷۴ در دسته کدنویسی از سوم به پنجم آمد چون نامزدهای تازه بالای سرش نشستند.
منبع: arena.ai
-
قیمت
قیمت جی پی تی ۵.۶ سول افتاد: ورودی از ۵ به ۴ دلار و خروجی از ۳۰ به ۲۰ دلار برای هر میلیون توکن، خوانده شده از صفحه قیمت خود اوپن ای آی. این تنها مدلی است که در این مرجع تا امروز ارزان شده و نه گران. همزمان ستون ایران این مدل هم پر شد و علتش یک اشتباه خود ما بود که اصلاح شد: نوشته بودیم فهرست کشورهای پشتیبانی شده فقط روی openai.com است و آن دامنه به سرور ما ۴۰۳ می دهد. دامنه هنوز ۴۰۳ می دهد، ولی همان فهرست روی developers.openai.com هم هست و باز است؛ حدود ۱۹۵ کشور و قلمرو نام برده شده و ایران در آنها نیست. ده وزن ستون ایران به اضافه افت قیمت، امتیاز این مدل در دسته چت را از ۵۴.۲ به ۶۵.۲ رساند، ولی یک پله پایین آمد و چهارم شد چون فیبل ۵.۱ بالای سرش وارد جدول شد.
منبع: developers.openai.com
-
صفحه تازه
سیزده مدل تازه به کاتالوگ اضافه شد و دو تایشان وارد جدول های رتبه بندی شدند. جی پی تی ۶ آسترا پرچمدار تازه اوپن ای آی است با ورودی ۱۰ و خروجی ۵۰ دلار و پنجره ۱.۰۵ میلیون توکن، و عمدا در هیچ جدولی نیست چون هیچ کدام از دو لیدربورد ردیفی به نامش ندارند. جمینای ۳.۸ فلش اولین مدل گوگل است که در جدول رتبه می گیرد، با ۱۴۹۴ در بورد متن، یعنی بالاتر از ردیف اپوس ۵. میوز اسپارک ۱.۳ و ۱.۲ از متا هم اضافه شدند و نکته شان این است که وزنشان منتشر نمی شود: سازنده ای که سال ها با انتشار وزن شناخته می شد، امروز مدل بالای خودش را بسته عرضه می کند. بقیه: کیمی کی۲.۷ کد، گراک ۴.۲۰، ویو ۳.۱ لایت، لیریا ۳.۵ پرو، جمینای ۳.۵ ترنسکرایب، الون میوزیک نسخه ۲ و اسکرایب نسخه ۲. دو مدل رونویسی عمدا در دسته صدا نیستند، چون rubric آن دسته ۶۵ وزنش روی کیفیت فارسی و کنترل صداست و هر دو درباره ساختن صدا هستند و نه شنیدن آن.
منبع: developers.openai.com
-
صفحه تازه کلود فیبل ۵.۱
صفحه کلود فیبل ۵.۱ نوشته شد، مدلی که ۱ سپتامبر ۲۰۲۶ منتشر شد. یافته اش این است که قیمت پایه اصلا تکان نخورده، ورودی ۱۰ و خروجی ۵۰ دلار مثل فیبل ۵، و تنها ردیفی که در جدول قیمت انتروپیک عوض شده خواندن از کش است: از یک دلار به بیست و پنج سنت. خود انتروپیک در پانویس همان جدول این را استثنا می نامد، چون ضریب کش برای همه مدل های کلود ۰.۱ برابر ورودی است و فقط برای فیبل ۵.۱ و میتوس ۵.۱ ضریب ۰.۰۲۵ است. جهش بنچمارک ها هم یکنواخت نیست و همین حرف اصلی صفحه شد: در پژوهش علمی عاملی از ۲۴.۷ به ۵۲.۶، در کدنویسی ترمینال از ۴۲.۰ به ۵۵.۸، ولی در CursorBench فقط از ۷۰.۵ به ۷۳.۴. مدل در هیچ جدول رتبه بندی این سایت نیست و این یک تصمیم است: rubric کدنویسی ۷۰ از ۱۰۰ وزنش روی دو لیدربورد Arena است و این مدل یک روزه هنوز در آنها رای نگرفته، پس گذاشتنش در دسته یعنی نمایش زیر جدول به عنوان رتبه بندی نشده. میتوس ۵.۱ هم به کاتالوگ اضافه شد و فیبل ۵ به legacy رفت.
منبع: www.anthropic.com
-
صفحه تازه ترجمه
دسته ترجمه نوشته شد، اولین دسته ترانش دو. یافته اش این است که در این دسته دو چیز از هم جدا افتاده اند: مدلی که فارسی را با اسم در فهرستش نوشته خریدنی نیست و مدلی که می شود گرفت و اجرا کرد فارسی را نام نبرده. Command A Translate تنها مدلی است که سازنده اش هم آن را مدل ترجمه معرفی کرده و هم هر چهار زبان این سایت را در یک فهرست ۲۳ تایی نام برده؛ لاما ۴ که پروانه تجاری دارد فهرست بسته دوازده زبانه دارد و فارسی و ترکی در آن نیستند. وزن باز بودن پروانه اینجا ۳۰ از ۱۰۰ است و در هیچ دسته دیگری این عدد نیست، چون در ایران همان API میزبانی شده است که کار نمی کند. یک معیار هم امتحان شد و برداشته شد: پنجره متن، چون نرمال سازی min-max وقتی کمترین مقدار ۸ هزار و بیشترین ۱۰ میلیون است یک تفاوت سی و دو برابری را ۰.۴ در برابر ۰.۲ نشان می داد.
منبع: docs.cohere.com
-
صفحه تازه کوهر
صفحه کوهر نوشته شد، سازنده ای که تا امروز فقط چند ردیف در کاتالوگ بود. یافته اش این است: کوهر تنها سازنده این مرجع است که فارسی را دانه دانه در فهرست زبان های یک مدل نوشته، در Command A Translate و در Aya Expanse 32B، و هر سه راه رسیدن به آن فارسی جدا جدا بسته است. مدل ترجمه قیمت ندارد، مدل وزن باز پروانه CC BY-NC دارد یعنی استفاده تجاری ممنوع، و مدلی که آپاچی ۲ است و می شود تجاری به کارش برد اصلا فارسی ندارد. جدا از این، قرارداد تجاری خود کوهر ایران را با اسم در تعریف Restricted Location نوشته، که با بقیه سازنده ها فرق دارد: بقیه ایران را از فهرست جا انداخته اند و کوهر اسمش را نوشته.
منبع: docs.cohere.com
-
صفحه تازه آمازون
صفحه آمازون نوشته شد. دو چیزی که برایشان نوشته شد: اول اینکه جدول مشخصات نوا در سلول «زبان های پشتیبانی شده» عدد «+۲۰۰» را می نویسد و پاورقی همان سلول پانزده زبان را نام می برد؛ عربی و ترکی در آن پانزده هستند و فارسی نه. همان الگوی الون لبز، این بار در پاورقی. دوم اینکه دسترسی نوا فهرست مرکزهای داده است و نه فهرست کشور، و در هیچ فهرستی یک منطقه خاورمیانه نیست؛ نزدیک ترین جایی که یک مدل نوا اجرا می شود بمبئی است یا فرانکفورت. قیمت نوا هم چاپ نشد چون صفحه قیمت بدراک اعداد را با جاوااسکریپت پر می کند.
منبع: docs.aws.amazon.com
-
صفحه تازه صداگذاری
دسته صداگذاری نوشته شد، با شش مدل رتبه دار و یک یافته که کل صفحه برای همان است: در الون لبز فارسی فقط در فهرست زبان های وی۳ است. فلش ۲.۵ فهرست ۳۲ زبانه دارد و مالتیلینگوال وی۲ فهرست ۲۹ زبانه، و فارسی در هیچکدام نیست. فلش ۲.۵ همان مدلی است که آدم به سمتش می رود چون سریع تر و ارزان تر است و سقف کاراکترش هشت برابر، پس خیلی ها متن فارسی می دهند، خروجی بد می گیرند و نتیجه می گیرند الون لبز فارسی بلد نیست. در این دسته معیار فارسی ۳۵ از ۱۰۰ وزن دارد، چون وقتی خروجی خودش صداست، مدلی که فارسی ندارد صفر است و نه کمی ضعیف تر.
منبع: elevenlabs.io
-
صفحه تازه الون لبز
صفحه الون لبز نوشته شد. جدا از موضوع فارسی، یک قید در صفحه قیمت خودشان هست که کمتر جایی نوشته می شود: پلن رایگان نه پروانه تجاری دارد و نه کلون صدا. یعنی می شود کل یک پروژه را رایگان تست کرد، صدا را بیرون کشید و بعد فهمید که حق استفاده از آن خروجی در کار پولی را نداشته اید. پروانه تجاری از پلن استارتر با ۶ دلار شروع می شود.
منبع: elevenlabs.io
-
صفحه تازه الون لبز وی۳
صفحه الون لبز وی۳ نوشته شد، مدلی که در جدول صداگذاری اول شده. قیدی که باید قبل از شروع پروژه بدانید: سقف کاراکترش پنج هزار است، یک هشتم فلش ۲.۵. یعنی همان مدلی که فارسی می خواند، برای متن بلند باید تکه تکه شود و تکه ها را خودتان به هم بچسبانید.
منبع: elevenlabs.io
-
صفحه تازه لاما ۴ اسکات
لاما ۴ اسکات و میسترال لارج ۳ صفحه گرفتند، دو مدلی که صفحه سازنده شان نمی توانست به آنها لینک بدهد. اسکات بزرگ ترین پنجره متن این مرجع را دارد، ده میلیون توکن، که ده برابر بزرگ ترین رقیبش است. لارج ۳ بزرگ ترین مدل وزن بازی است که اینجا ثبت شده، ۶۷۵ میلیارد پارامتر زیر آپاچی ۲. هر دو صفحه یک نکته مشترک را می گویند که کمتر جایی نوشته می شود: عدد پارامتر فعال هزینه محاسبه را می گوید و عدد کل مقدار حافظه را، و کسی که فقط اولی را می خواند سخت افزار را اشتباه سفارش می دهد.
منبع: huggingface.co
-
صفحه تازه میسترال
صفحه های میسترال و متا نوشته شدند، دو سازنده ای که تا دیروز فقط داده بودند. یافته میسترال: «باز» در این شرکت چهار معنی دارد و یکی از آنها استفاده تجاری را ممنوع می کند. لارج ۳ و اسمال ۴ و مینیسترال ۳ آپاچی ۲ اند، مدیوم ۳.۵ ام آی تی اصلاح شده است، و وکسترال تی تی اس سی سی بای ان سی ۴.۰ است. کسی که خوانده «میسترال همان بازه» و صدای محصولش را با وکسترال ساخته، پروانه را نقض کرده. ضمنا Le Chat و La Plateforme دیگر در مستندات خودشان نیستند و جایشان Vibe و Studio نشسته.
منبع: docs.mistral.ai
-
اصلاح مشخصات متا
متا برای لاما ۴ دقیقا دوازده زبان فهرست کرده و فارسی در آن نیست. عربی هست. این فهرست بسته است و «از جمله» ندارد، پس بر خلاف مورد میسترال اینجا نبودن فارسی استنباط نیست. دو عدد دیگر هم ثبت شد: تاریخ قطع دانش هر دو مدل اوت ۲۰۲۴ است که کهنه ترین بین مدل های زنده این مرجع است، و اسکات با ۱۰۹ میلیارد پارامتر پنجره ده میلیونی دارد در حالی که مووریک با ۴۰۰ میلیارد پارامتر پنجره یک میلیونی دارد.
منبع: huggingface.co
-
صفحه تازه
فهرست کامل مدل ها به این مرجع اضافه شد و همزمان نود و دو موجودیت تازه ثبت شد، از جمله چهار سازنده ای که تا دیروز اینجا اصلا نبودند: میسترال، کوهر، آمازون و متا. کاتالوگ از هجده مدل به هشتاد و نه رسید و هر سلولش امروز از صفحه خود سازنده خوانده شده. این مدل های تازه عمدا در هیچ دسته ای نیستند، یعنی هیچ جدول رتبه ای را تکان نداده اند: وارد کردن سی ردیف تازه به شش رتبه بندی منتشرشده با یک فرمان، متن آن صفحه ها را در همان لحظه دروغ می کرد.
-
قیمت دیپ سیک وی۴ فلش
قیمت دیپ سیک وی۴ فلش بالا رفت و این تا امروز تنها عددی است که در این مرجع بالا رفته. ۱۲ اوت ۰.۱۴ ورودی و ۰.۲۸ خروجی بود؛ حالا صفحه قیمت خودش دو ستون دارد، ۰.۲۲ و ۰.۶۶ در ساعت غیر اوج و ۰.۴۴ و ۱.۳۲ در ساعت اوج. ستون اوج را نوشته ایم، چون ساعت اوج دیپ سیک وسط ساعت کاری ایران می افتد. خود دیپ سیک جایگاه نباخت و هنوز ارزان ترین ردیف است، ولی چون فاصله اش کم شد سه ردیف دیگر در جدول کدنویسی بالا رفتند: قوان از پنجم به سوم، کیمی از سوم به چهارم و جی پی تی از چهارم به پنجم، بی آنکه هیچ کدام چیزی عوض کرده باشند.
منبع: api-docs.deepseek.com
-
اصلاح مشخصات
سورا از حالت «هیچ فکتی نداریم» بیرون آمد. این بخش دو بار تصمیم گرفته بود سورا را بی داده نگه دارد، چون openai.com به سرور ما ۴۰۳ می دهد و سطح توسعه دهنده اش هم سورا را نداشت. امروز داشت: صفحه مدل و فهرست قیمت هر دو جواب می دهند، پس شناسه، رزولوشن، وجه ورودی و خروجی و قیمت هر ثانیه ثبت شد. سورا ۲ پرو همچنان بی قیمت است، چون اوپن ای آی قیمتش را به شکل بازه چاپ می کند و بازه عدد نیست.
منبع: developers.openai.com
-
صفحه تازه ویو
صفحه خانواده ویو نوشته شد و یک تناقض در مستندات خود گوگل را ثبت کرد: جدول مدل ها ویو ۳ و ویو ۲ را «پایدار» علامت زده، و صفحه قیمت همان سایت هر دو را منسوخ اعلام کرده با تاریخ خاموشی ۳۰ ژوئن ۲۰۲۶ که وقتی این را می نویسیم گذشته است. تنها نسخه ای که ارزش استفاده دارد، ویو ۳.۱، «پیش نمایش» علامت خورده. ما نمی گوییم مدل ها خاموش شده اند؛ می گوییم برچسب «پایدار» در این خانواده به شما نمی گوید کدام را بسازید.
منبع: ai.google.dev
-
صفحه تازه سیدنس
صفحه خانواده سیدنس نوشته شد و پسرفت رزولوشن این خانواده حالا سند سومی هم دارد که از همه محکم تر است: در فهرست قیمت رانوی، سیدنس ۲.۰ چهار ردیف رزولوشن دارد که تا ۴K می رود و سیدنس ۲.۵ فقط دو ردیف دارد، ۴۸۰ و ۷۲۰. جدول قیمت جای تبلیغ نیست. خط زمانی خانواده هم از شناسه های خود بایت دنس آمده که تاریخ انتشار داخلشان است.
منبع: docs.dev.runwayml.com
-
صفحه تازه رانوی
صفحه های رانوی و بایت دنس و کوایشو نوشته شدند و آخرین استاب های این بخش را بستند. یافته رانوی: مدل خودش Gen-4.5 دوازده اعتبار در ثانیه است و سیدنسی که می فروشد در ۴K صد و پنجاه اعتبار، پس گران ترین ویدیوی مغازه اش دوازده برابر ارزان ترین مدل خودش است. و رانوی برای ویو ۳.۱ یک قیمت بدون صدا دارد که صفحه قیمت خود گوگل اصلا ندارد.
منبع: docs.dev.runwayml.com
-
صفحه تازه ساخت موسیقی
دسته ساخت موسیقی نوشته شد، با پنج نامزد که چهارتاشان رتبه دارند. یک ستون این جدول جایی در مقایسه های دیگر ندیدیم: تحویل فایل. سوال «کدام بهتر می خواند» جواب دارد و سونو می برد، ولی سوال دوم این است که آخر کار فایل به دست شما می رسد یا نه، و آنجا ترتیب عوض می شود. این تنها دسته ای است که عددهای کیفی اش از آرنا نمی آید، چون آرنا تخته موسیقی ندارد.
منبع: artificialanalysis.ai
-
صفحه تازه یودیو
صفحه یودیو نوشته شد، و یک جمله در مرکز راهنمای خودشان دلیل نوشتنش است: از ۲۹ اکتبر ۲۰۲۵، همزمان با قرارداد یونیورسال، دانلود صوت و ویدیو و استم غیرفعال شده. یعنی اشتراک پولی اش آهنگ می سازد و فایلی به دست شما نمی دهد. قیمت دلاری اش را نداریم چون udio.com همه چیزش با جاوااسکریپت رندر می شود و بدنه اش با curl خالی است، پس آن ستون خالی ماند.
منبع: help.udio.com
-
صفحه تازه سونو
صفحه سونو نوشته شد و صدر جدول موسیقی را گرفت: ۱۱۷۱ در آواز و ۱۱۸۸ در بی کلام، و بلندترین آهنگ با هشت دقیقه. چیزی که خریدار جا می اندازد و روی صفحه نوشته شده: اعتبار نه از روزی به روز بعد منتقل می شود و نه از ماهی به ماه بعد، و سقف دانلود جدا از سقف اعتبار است. پرو ۲۵۰۰ اعتبار می دهد و بیست دانلود در ماه.
منبع: suno.com
-
صفحه تازه چت و دستیار
دسته چت نوشته شد، با نه نامزد که همه شان رتبه دارند. تصمیمی که روی صفحه توضیح داده شده: این جدول مدل رتبه می دهد و نه اپ، چون هر پنج ستونش عددی است که فقط درباره مدل منتشر می شود. هزینه اش این است که چت جی پی تی و اپ کلود و اپ جمینای ردیف ندارند.
منبع: arena.ai
-
صفحه تازه
جی پی تی ۵.۶ سول به داده ها اضافه شد و نامزد جدول چت و جدول کدنویسی است: ۵ و ۳۰ دلار، پنجره ۱.۰۵ میلیون توکن، سقف خروجی ۱۲۸ هزار توکن. یک فرض قدیمی ما را هم اصلاح می کند. نوشته بودیم هیچ چیز از اوپن ای آی خواندنی نیست؛ درست این است که openai.com خواندنی نیست ولی developers.openai.com هست. پس مدل را می شود رتبه داد و اپ را نمی شود توصیف کرد. صفحه ندارد، چون صفحه کامل بدون حرف زدن درباره چت جی پی تی ممکن نیست.
منبع: developers.openai.com
-
جا به جایی رتبه کدنویسی
دو تصحیح داده ای جدول کدنویسی را جا به جا کرد. اول، لیدربورد متن کامل خوانده شد و معلوم شد ردیف جیالام ۵.۲ مکس (۱۴۷۰) و دیپ سیک وی۴ فلش (۱۴۳۵) از اول آنجا بوده و اجرای قبلی فقط بالای صفحه را دیده بود. دوم، جی پی تی ۵.۶ سول نامزد هشتم شد. اپوس ۵ از ۷۶.۰ به ۷۷.۵، کیمی از ۴۹.۹ به ۵۲.۴، قوان از ۴۹.۳ به ۵۱.۳، جیالام از ۲۰.۱ به ۲۵.۰، گراک از ۱۰.۸ به ۱۵.۶. تنها جا به جایی ترتیب: جی پی تی بین کیمی و قوان نشست.
-
صفحه تازه گراک ۴.۵
ایکس ای آی، خانواده گراک ۴ و گراک ۴.۵ اضافه شدند. عددی که بیشتر از همه ارزش نوشتن داشت: از ۲۰۰ هزار توکن به بالا کل توکن های همان درخواست با نرخ دو برابر حساب می شود، نه فقط توکن های اضافه. و تازه ترین عضو خانواده نصف پنجره متن عضو قبلی را دارد با بیش از دو برابر قیمت خروجی.
منبع: docs.x.ai
-
جا به جایی رتبه کدنویسی
با اضافه شدن گراک ۴.۵ به عنوان نامزد هفتم، امتیاز همه ردیف های جدول کدنویسی بالا رفت بی آنکه هیچ مدلی چیزی را عوض کرده باشد: اپوس ۵ از ۶۴.۱ به ۷۶.۰، فیبل ۵ از ۴۶.۱ به ۶۰.۶، کیمی از ۴۴.۱ به ۴۹.۹، قوان از ۳۴.۶ به ۴۹.۳، دیپ سیک از ۲۰.۰ به ۳۸.۱ و جیالام از ۲.۳ به ۲۰.۱. دلیلش نرمال سازی نسبی است: گراک کف سه ستون شد و کف هر ستون صفر می گیرد. ترتیب هیچ ردیفی عوض نشد.
-
صفحه تازه کلود فیبل ۵
صفحه فیبل ۵ نوشته شد. عددی که بیشتر از همه جا خورد: قطع دانش گران ترین مدل پرکاربرد انتروپیک ژانویه ۲۰۲۶ است و قطع دانش اپوس ۵ که نصف قیمت دارد می ۲۰۲۶. فاصله دو مدل در لیدربورد کد ۶۴ امتیاز است و در لیدربورد متن ۱۲ امتیاز، با جهت برعکس.
منبع: arena.ai
-
صفحه تازه کیمی کی۳ مکس
صفحه کیمی کی۳ مکس نوشته شد، با این توضیح که «کی۳ مکس» در کاتالوگ مونشات مدل نیست. پنجره متنش ۱۰۴۸۵۷۶ توکن است، یعنی دو به توان بیست، و همین اختلاف کمتر از پنج درصد با بقیه، کل ده وزن ستون پنجره متن را به آن می دهد. این را روی صفحه نوشته ایم چون ده امتیاز برتری واقعی نیست.
منبع: platform.kimi.ai
-
صفحه تازه جیالام ۵.۲ مکس
صفحه جیالام ۵.۲ مکس نوشته شد و تمیزترین شاهد ادعای «مکس یک پارامتر است» همین جا است: مستندات خود زد.ای مدل را glm-5.2 صدا می زند و max را مقدار reasoning_effort نشان می دهد. امتیاز کلش در جدول ۲.۳ است و پانزده وزن از صد برایش شاهد ندارد.
منبع: docs.z.ai
-
صفحه تازه دیپ سیک وی۴ فلش
صفحه دیپ سیک وی۴ فلش نوشته شد. خروجی ۰.۲۸ دلار، نزدیک نود برابر ارزان تر از اپوس ۵، و سقف خروجی ۳۸۴ هزار توکن که سه برابر مدل های انتروپیک است. امتیاز کلش در جدول ۲۰ است و هر بیست امتیاز از یک ستون می آید؛ ستون چهل وزنی لیدربورد را صفر می گیرد.
منبع: api-docs.deepseek.com
-
صفحه تازه جمینای ۳.۱ پرو
صفحه جمینای ۳.۱ پرو نوشته شد، همراه ستون ایران که از فهرست مناطق در دسترس Gemini API خوانده شد و ایران در آن نیست. این تنها نامزد جدول کدنویسی است که رتبه نمی گیرد: گوگل پنجره متنش را منتشر نکرده و ردیفش را در لیدربورد توسعه وب نخوانده ایم. قیمتش هم پلکانی است و مرزش ۲۰۰ هزار توکن.
منبع: ai.google.dev
-
اصلاح مشخصات کدنویسی
سه جمله صفحه کدنویسی دیگر درست نبود و در هر چهار زبان اصلاح شد. جیالام ۵.۲ مکس و دیپ سیک وی۴ فلش حالا رتبه دارند و تنها نامزد بی رتبه جمینای ۳.۱ پرو است؛ و از چهار مدل چینی جدول فقط قوان ۳.۸ مکس هنوز قیمت تاییدشده ندارد. وزن ها و رتبه ها دست نخورده اند.
منبع: arena.ai
-
صفحه تازه ساخت ویدیو
دسته ساخت ویدیو با چهار مدل راه افتاد و نسخه رتبه می دهد و نه محصول، چون یک مدل روی چند ابزار فروخته می شود. وزن ها: طول کلیپ ۳۰، رزولوشن ۲۵، ورودی مرجع ۲۰، کنترل صحنه ۱۵، ایران ۱۰. سیدنس ۲.۵ اول شد. زمان تولید معیار نشد چون هیچ سازنده ای عددش را منتشر نکرده، و قیمت هم نشد چون کلینگ در تنها فهرست دلاری موجود نیست.
منبع: www.volcengine.com
-
صفحه تازه سیدنس ۲.۵
سیدنس ۲.۵ ثبت شد: تا سی ثانیه در یک تولید و تا پنجاه ورودی مرجع (سی تصویر، ده ویدیو، ده صدا). نکته ای که در صفحه معرفی نیست و در مستندات API هست: سقف رزولوشن این مدل ۷۲۰p است، در حالی که سیدنس ۲.۰ تا ۴K می رفت.
منبع: www.volcengine.com
-
صفحه تازه کلینگ ویدیو ۳.۰
کلینگ ویدیو ۳.۰ ثبت شد: سه تا پانزده ثانیه، ۴K بومی از بیست و سوم آوریل، و صدای همزاد با پنج زبان گفتار. فارسی در آن پنج زبان نیست و همین برای خواننده فارسی مهم ترین عدد این صفحه است.
منبع: kling.ai
-
صفحه تازه کلینگ
صفحه کلینگ نوشته شد. پنج پلن با قیمت از راهنمای اعتبار خودشان، و این نکته که قیمت های اعلام شده تخفیف اولین اشتراک اند: استاندارد ۶.۹۹ دلار می خرید و ماه بعد ۸.۸ دلار تمدید می شود.
منبع: kling.ai
-
صفحه تازه ویو ۳.۱
ویو ۳.۱ ثبت شد: چهار، شش یا هشت ثانیه، صدای همیشه روشن، و تا سه تصویر مرجع. ۴K و 1080p فقط روی کلیپ هشت ثانیه اند و خروجی تمدید هم فقط 720p است.
منبع: ai.google.dev
-
صفحه تازه رانوی جن ۴.۵
رانوی جن ۴.۵ ثبت شد، با عددهایی که از شمای OpenAPI خودشان خوانده شد: دو تا ده ثانیه، سقف 720p، بدون پارامتر صدا. سقف ورودی مرجع منتشر نشده، پس آن سلول تایید نشده ماند و بیست وزن از دستش رفت.
منبع: docs.dev.runwayml.com
-
صفحه تازه مطالعه و یادگیری
دسته مطالعه با چهار نامزد راه افتاد و برخلاف دسته کدنویسی، محصول رتبه می دهد و نه نسخه مدل. وزن ها: قالب های هضم ۳۵، حجم منبع ۲۰، فضای کار ۲۰، زبان خروجی ۱۰، ایران ۱۵. جمنای نوتبوک اول شد. چت جی پی تی در جدول هست و رتبه ندارد، چون صفحه های اوپن ای آی از سرور ما ۴۰۳ می دهند.
منبع: support.google.com
-
صفحه تازه جمنای نوتبوک
جمنای نوتبوک ثبت شد، و همان جا معلوم شد گوگل نام NotebookLM را کنار گذاشته: صفحه رسمی و مرکز راهنما هر دو Gemini Notebook می نویسند. پلن رایگان: صد دفتر، پنجاه منبع در هر دفتر، نه قالب خروجی، و فارسی در فهرست زبان های خروجی.
منبع: notebooklm.google
-
صفحه تازه جمنای
صفحه جمنای با تمرکز روی حالت یادگیری هدایت شده نوشته شد. سقف ده فایل در هر پیام و هفتاد زبان از صفحه های خود گوگل آمده، و مرز این صفحه با جمنای نوتبوک هم از راهنمای گوگل: خروجی های پنل Studio در جمنای ساخته نمی شوند.
منبع: blog.google
-
صفحه تازه کلود
صفحه کلود نوشته شد. حالت یادگیری از صفحه آموزش خود انتروپیک تایید شد و قیمت پرو (بیست دلار ماهانه، هفده دلار در پرداخت سالانه) از صفحه قیمت. ظرفیت پروژه عدد منتشرشده ندارد، پس آن ستون در جدول مطالعه خالی مانده.
منبع: claude.com
-
صفحه تازه کدنویسی
دسته کدنویسی با شش نامزد و شاهد واقعی راه افتاد. معیار اصلی لیدربورد WebDev Arena است با وزن چهل، و اپوس ۵ با ۱۶۹۲ اول شد. عدد SWE-bench عمدا وارد نشد چون لیدربوردش را نتوانستیم مستقیم بخوانیم.
منبع: arena.ai
-
نسخه تازه کلود اپوس ۵
اپوس ۵ (منتشرشده ۲۴ جولای ۲۰۲۶) با مشخصات کامل و قیمت ۵ و ۲۵ دلار ثبت شد. ادعاهای Frontier-Bench و ARC-AGI 3 اعلامیه نسبی اند و عدد مطلق ندارند، پس در جدول وارد نشدند.
منبع: www.anthropic.com
