بهترین هوش مصنوعی برای ترجمه فارسی
در این دسته دو چیز از هم جدا افتاده اند و همین کل ماجراست: مدلی که فارسی را با اسم در فهرستش نوشته خریدنی نیست، و مدلی که می شود گرفت و روی سرور خودتان اجرا کرد فارسی را اصلا نام نبرده. جدول زیر همین را نشان می دهد و نه اینکه کدام ترجمه قشنگ تری می نویسد.
- هفت نامزد، پنج تای رتبه دار
- وزن باز بودن ۳۰ از ۱۰۰
- ستون دسترسی از ایران
آخرین بررسی: این صفحه یک مرجع است. با هر نسخه تازه، منابع سازنده دوباره خوانده و صفحه بهروز می شود. چه چیزی عوض شد
امتیاز هر ابزار از کجا می آید
حلقه زیر، همان وزن هایی است که در سرستون های جدول پایین نوشته شده.
- فارسی اعلام شده ۳۵
- باز بودن پروانه ۳۰
- شمار زبان ۲۵
- دسترسی از ایران ۱۰
وزن ها را ما انتخاب کرده ایم و همین تنها جای سلیقه این جدول است. اگر وزن دیگری درست تر می دانید، ترتیب هم عوض می شود.
رتبه بندی امروز، بر پایه فهرست زبان و پروانه خود سازنده ها
ستون فارسی می گوید سازنده فارسی را در فهرست همان مدل نوشته یا نه، و نه اینکه ترجمه اش چقدر خوب است. سازنده ای که برای یک مدل اصلا فهرست زبان نداده، در این ستون «تایید نشده» می ماند.
| رتبه | ابزار | امتیاز | فارسی اعلام شده ۳۵ | باز بودن پروانه ۳۰ | شمار زبان ۲۵ | دسترسی از ایران ۱۰ |
|---|---|---|---|---|---|---|
| ۱ | کامند ای ترنسلیت انتخاب فعلی | ۷۰.۰ | ۲/۲ | ۰/۳ | ۲۳ منبع: docs.cohere.com | مسدود / راه کارآمدی ندارد |
| ۲ | آیا اکسپنس ۳۲بی | ۶۷.۵ | ۱/۲ | ۱/۳ | ۲۳ منبع: docs.cohere.com | مسدود / راه کارآمدی ندارد |
| ۳ | کامند ای ریزنینگ | ۳۵.۰ | تایید نشده | ۰/۳ | ۲۳ منبع: docs.cohere.com | مسدود / راه کارآمدی ندارد |
| ۴ | لاما ۴ مووریک | ۳۰.۰ | ۰/۲ | ۲/۳ | ۱۲ منبع: huggingface.co | تایید نشده |
| ۵ | لاما ۴ اسکات | ۳۰.۰ | ۰/۲ | ۲/۳ | ۱۲ منبع: huggingface.co | تایید نشده |
سلول خالی یعنی آن عدد را نتوانسته ایم تایید کنیم، نه اینکه ابزار صفر گرفته است.
پشت هر عدد
هر نمره داوری این جدول یک دلیل نوشته شده دارد و ستون ایران می گوید چطور بررسی شده. آن دو اینجا بازند. رد اندازه گیری هر عدد، یعنی اینکه از کدام ردیف کدام لیدربورد و با چند رای آمده، زیر همان مدل باز می شود.
۱ کامند ای ترنسلیت
فارسی اعلام شده ۲/۲ کوهر ۲۳ زبان این مدل را دانه دانه نام برده و فارسی آخرین اسم آن فهرست است. همان مستندات این مدل را «مدل ترجمه ماشینی» خود کوهر معرفی می کند، پس هم فهرست هست و هم اعلام سازنده.
باز بودن پروانه ۰/۳ وزنی منتشر نشده. فقط از راه API خود کوهر در دسترس است.
دسترسی از ایران مسدود / راه کارآمدی ندارد قرارداد تجاری SaaS خود کوهر ایران را با اسم در تعریف Restricted Location نوشته و می گوید مشتری از چنین جایی به سرویس دسترسی پیدا نمی کند. از متن قرارداد خوانده شده، نه از تست شبکه.
۲ آیا اکسپنس ۳۲بی
فارسی اعلام شده ۱/۲ کارت مدل ۲۳ زبان را دانه دانه نوشته و فارسی در آن هست. ولی کوهر این مدل را مدل ترجمه معرفی نمی کند، بلکه مدل پژوهشی چندزبانه می خواند، پس پله دو نمی گیرد.
باز بودن پروانه ۱/۳ وزنش روی هاگینگ فیس منتشر شده، ولی پروانه اش CC BY-NC 4.0 با پیوست استفاده مجاز است و ان سی یعنی استفاده تجاری ممنوع.
دسترسی از ایران مسدود / راه کارآمدی ندارد قرارداد تجاری SaaS خود کوهر ایران را با اسم در تعریف Restricted Location نوشته و می گوید مشتری از چنین جایی به سرویس دسترسی پیدا نمی کند. از متن قرارداد خوانده شده، نه از تست شبکه.
۳ کامند ای ریزنینگ
باز بودن پروانه ۰/۳ وزنی منتشر نشده. فقط از راه API خود کوهر در دسترس است.
دسترسی از ایران مسدود / راه کارآمدی ندارد قرارداد تجاری SaaS خود کوهر ایران را با اسم در تعریف Restricted Location نوشته و می گوید مشتری از چنین جایی به سرویس دسترسی پیدا نمی کند. از متن قرارداد خوانده شده، نه از تست شبکه.
۴ لاما ۴ مووریک
فارسی اعلام شده ۰/۲ متا برای لاما ۴ فهرست بسته ای از دوازده زبان می دهد: عربی، انگلیسی، فرانسوی، آلمانی، هندی، اندونزیایی، ایتالیایی، پرتغالی، اسپانیایی، تاگالوگ، تایلندی و ویتنامی. فارسی در آن نیست و فهرست هم با «از جمله» باز نگذاشته شده. ترکی هم در آن نیست.
باز بودن پروانه ۲/۳ وزن منتشر شده و پروانه لاما ۴ استفاده تجاری را می دهد، ولی پروانه اختصاصی خود متا است و نه یک پروانه استاندارد: سقف ۷۰۰ میلیون کاربر ماهانه دارد و درج عبارت Built with Llama را الزامی می کند.
۵ لاما ۴ اسکات
فارسی اعلام شده ۰/۲ متا برای لاما ۴ فهرست بسته ای از دوازده زبان می دهد: عربی، انگلیسی، فرانسوی، آلمانی، هندی، اندونزیایی، ایتالیایی، پرتغالی، اسپانیایی، تاگالوگ، تایلندی و ویتنامی. فارسی در آن نیست و فهرست هم با «از جمله» باز نگذاشته شده. ترکی هم در آن نیست.
باز بودن پروانه ۲/۳ وزن منتشر شده و پروانه لاما ۴ استفاده تجاری را می دهد، ولی پروانه اختصاصی خود متا است و نه یک پروانه استاندارد: سقف ۷۰۰ میلیون کاربر ماهانه دارد و درج عبارت Built with Llama را الزامی می کند.
برای رتبه دادن، داده تاییدشده کافی نداریم
اینها ابزارهای واقعی اند و پیگیری شان می کنیم، ولی بیش از نیم وزن معیارها برایشان عدد تاییدشده ندارد، پس رتبه دادنشان حدس زدن بود.
- کامند ای پلاس
- میسترال لارج ۳
این رتبه بندی چطور حساب می شود
هر معیار زیر یک وزن دارد و یک منبع. وزن را عوض کنید، کل جدول از نو حساب می شود. هیچ جای این مرجع، جایگاهی دستی گذاشته نشده است.
| معیار | وزن | شاهد |
|---|---|---|
| فارسی اعلام شده | ۳۵ | مقیاس تعریف شده، با دلیل نوشته برای هر انتسابخروجی ترجمه خودش یک زبان است. مدلی که فارسی را نام نبرده، برای متن فارسی یک حدس است و نه یک ابزار |
| باز بودن پروانه | ۳۰ | مقیاس تعریف شده، با دلیل نوشته برای هر انتسابوزنش ۳۰ است و در هیچ دسته دیگری این عدد نیست، چون در ایران همان API میزبانی شده است که کار نمی کند |
| شمار زبان | ۲۵ | مشخصات اعلامی سازندهفقط وقتی شمرده شده که سازنده فهرست را کامل چاپ کرده باشد یا عدد قطعی داده باشد |
| دسترسی از ایران | ۱۰ | ستون دسترسی ما، با روش اعلام شدهوزنش کم است چون جای اصلی این بحث صفحه «هوش مصنوعی در ایران» است، ولی صفر هم نیست |
مدلی که فارسی را می شناسد، و مدلی که می شود اجرا کرد، یکی نیستند
کوهر مدلی دارد به اسم Command A Translate و در مستنداتش صریحا آن را «مدل ترجمه ماشینی» خودش معرفی کرده. همانجا ۲۳ زبانش را دانه دانه نوشته: انگلیسی، فرانسوی، اسپانیایی، ایتالیایی، آلمانی، پرتغالی، ژاپنی، کره ای، چینی، عربی، روسی، لهستانی، ترکی، ویتنامی، هلندی، چکی، اندونزیایی، اوکراینی، رومانیایی، یونانی، هندی، عبری و فارسی.
هر چهار زبانی که این سایت با آنها منتشر می شود در همان یک فهرست ۲۳ تایی هستند. برای کسی که سایت چهارزبانه دارد، این دقیق ترین جمله ای است که در این مرجع درباره ترجمه پیدا می شود.
حالا طرف دیگر. متا لاما ۴ را با وزن باز می دهد و پروانه اش اجازه استفاده تجاری هم می دهد، یعنی مدلی که می شود گرفت و روی سخت افزار خودتان اجرا کرد و خروجی اش را فروخت. فهرست زبانش دوازده تاست: عربی، انگلیسی، فرانسوی، آلمانی، هندی، اندونزیایی، ایتالیایی، پرتغالی، اسپانیایی، تاگالوگ، تایلندی و ویتنامی. فارسی نیست. ترکی هم نیست. و متا فهرست را با «از جمله» باز نگذاشته، یعنی این یک فهرست بسته است.
پس محور این دسته کیفیت نیست. این است: مدل زبان شما را با اسم نوشته یا نه، و آیا اصلا می توانید به آن برسید.
وارونگی پنجره متن، که هر پروژه ترجمه سایت به آن می خورد
Command A Translate پنجره هشت هزار توکنی دارد. این کوتاه ترین پنجره کل این کاتالوگ است، کوتاه تر از هر مدل دیگری که اینجا ثبت شده. لاما ۴ اسکات پنجره ده میلیون توکنی دارد، بلندترین.
یعنی مدلی که فارسی را می شناسد اندازه چند صفحه جا دارد، و مدلی که فارسی را نام نبرده یک کتاب را یکجا می خواند. این تصادف نیست: مدل ترجمه اختصاصی برای جمله و پاراگراف ساخته شده و نه برای سند.
نتیجه عملی اش این است و کسی جایی ننوشته: یک سایت را با مدل ترجمه اختصاصی صفحه به صفحه ترجمه می کنید و نه یکجا. اگر می خواهید کل یک سند بلند در یک فراخوانی برود، دارید مدلی را انتخاب می کنید که برای ترجمه ساخته نشده، و آن انتخاب باید آگاهانه باشد.
چرا باز بودن پروانه اینجا ۳۰ وزن دارد
در دسته های دیگر این مرجع، وزن باز بودن یک امتیاز جانبی است. اینجا نیست.
دلیلش ساده است: برای خواننده ایرانی، همان حلقه ای از زنجیره که کار نمی کند API میزبانی شده است. قرارداد تجاری کوهر ایران را با اسم در تعریف Restricted Location نوشته. پس مدلی که وزنش منتشر شده و پروانه اش اجازه استفاده تجاری می دهد، اینجا واقعا یک ابزار است و بقیه یک مقاله درباره ابزار.
و همین معیار یک تفاوت را نشان می دهد که یک بولی «وزن باز دارد یا نه» پنهانش می کند. آیا اکسپنس وزنش باز است ولی پروانه اش CC BY-NC است، یعنی اگر ترجمه سایت مشتری را با آن انجام بدهید و پول بگیرید، پروانه را نقض کرده اید. لاما ۴ اجازه تجاری می دهد ولی زیر پروانه اختصاصی متا با سقف ۷۰۰ میلیون کاربر ماهانه و الزام درج Built with Llama. میسترال لارج ۳ آپاچی ۲ است، آزادترین پروانه این جدول، و فارسی را نام نبرده.
چهار معیاری که عمدا در جدول نیستند
نمره کیفیت ترجمه. کوهر می نویسد Command A Translate «مدل ترجمه ماشینی پیشرفته» اوست و هیچ عددی چاپ نمی کند. بقیه هم نمی کنند. ستونی که برای هیچ نامزدی عدد ندارد ستون نیست.
قیمت. از هفت نامزد این جدول، دو تا قیمت دارند. کوهر برای مدل های نسل جدیدش هیچ نرخی چاپ نمی کند، میسترال اصلا نرخ مدل نمی دهد، و متا وزن را می دهد و قیمتی در کار نیست. یک ستون با دو سلول پر، پنج نامزد دیگر را بی دلیل پایین می کشد.
جهت ترجمه. کیفیت ترجمه متقارن نیست: فارسی به انگلیسی با انگلیسی به فارسی یک کار نیست و هر مترجمی این را می داند. هیچ سازنده ای در این مرجع چیزی جدا برای هر جهت منتشر نمی کند، پس این صفحه هم درباره اش حرفی نمی زند. فهرست زبان یک مجموعه است و نه یک جفت.
و پنجره متن، که این یکی را امتحان کردیم و برداشتیم. دلیلش را می نویسیم چون خودش یک درس است. موتور رتبه بندی هر ستون عددی را بین کمترین و بیشترین نامزد نرمال می کند. اینجا کمترین پنجره هشت هزار توکن است و بیشترین ده میلیون، سه مرتبه بزرگی فاصله. نتیجه اش این شد که ۲۵۶ هزار توکن از ۱۵ نمره ۰.۴ گرفت و ۱۲۸ هزار توکن ۰.۲، در حالی که فاصله هشت هزار تا ۲۵۶ هزار در عمل سی و دو برابر است و همان چیزی است که شکل یک پروژه واقعی را تعیین می کند. ستونی که یک تفاوت سی و دو برابری را «۰.۴ در برابر ۰.۲» نشان می دهد، آن تفاوت را نمی سنجد. پس عدد از جدول بیرون آمد و حرفش بالاتر در متن ماند.
دو ردیفی که اصلا رتبه نگرفتند
زیر جدول دو نامزد نشسته اند که موتور رتبه بندی نتوانست رتبه شان بدهد، و هر دو به یک دلیل: سازنده شان برای همان مدل فهرست زبان منتشر نکرده.
یکیشان Command A+ است، پرچمدار خود کوهر. مستندات کوهر می نویسد این مدل «توانایی ترجمه در سطح جهانی» دارد و برای همین مدل هیچ فهرست زبانی و هیچ عدد قطعی نمی دهد. پس ادعای ترجمه هست و چیزی که بشود به آن استناد کرد نیست.
دیگری میسترال لارج ۳ است، که آزادترین پروانه کل این جدول را دارد: آپاچی ۲، وزن باز، اجازه استفاده تجاری کامل. دقیقا همان چیزی که این دسته بیشترین وزن دوم را به آن داده. ولی میسترال برای لارج ۳ نه فهرست زبان می دهد و نه فهرست کشور، و فهرستی هم که می دهد صریحا کامل نیست. مدلی که از نظر پروانه بهترین گزینه این جدول بود، به خاطر نبود همان دو فهرست از جدول بیرون ماند.
این را پنهان نمی کنیم چون همین است که جدول را قابل اعتماد می کند: نامزدی که شاهد ندارد رتبه نمی گیرد، حتی وقتی حدس ما این باشد که خوب است.
چیزی که این جدول نمی سنجد و باید گفت
هر سلول فارسی این صفحه می گوید سازنده زبان را در فهرستش نوشته است. هیچ کس خروجی را نخوانده و نسنجیده.
این همان محدودیتی است که دسته صداگذاری هم دارد و مرز صادقانه کل این روش است. ما فهرست های منتشرشده را می خوانیم و به آنها استناد می کنیم؛ سنجیدن اینکه ترجمه فارسی این مدل ها چقدر طبیعی است کار دیگری است و ادعایش را نمی کنیم.
چه وقت انتخاب اول ما را نگیرید
- اگر فقط بین انگلیسی و زبان های اروپایی کار می کنید، ترتیب این جدول برای شما نیست. ردیف های پایینش دقیقا در همان زبان ها قوی اند و فقط به خاطر فارسی پایین آمده اند.
- اگر می خواهید یک سند بلند در یک فراخوانی ترجمه شود، هیچ کدام از ردیف های بالای جدول جا ندارند و باید سراغ مدل های پنجره بزرگ بروید، با علم به اینکه فارسی را اعلام نکرده اند.
- اگر ترجمه رسمی و مهردار می خواهید، هیچ چیز این صفحه به کارتان نمی آید. آن کار یک مترجم رسمی می خواهد و نه یک مدل.
کجا کم می آورد
- ستون فارسی از فهرست منتشرشده سازنده خوانده شده و نه از خواندن خروجی. کیفیت ترجمه را نسنجیده ایم.
- قیمت در این جدول ستون ندارد، چون فقط دو نامزد از هفت تا نرخ منتشرشده دارند.
- جهت ترجمه سنجیده نشده. فهرست زبان یک مجموعه است و می گوید هر جفتی از داخل آن ممکن است، نه اینکه هر دو جهت یک کیفیت دارند.
- ستون دسترسی از ایران از قرارداد و سیاست خود سازنده ها خوانده شده و نه از تست شبکه از داخل ایران.
نظر ما
اگر سایت چندزبانه دارید و فارسی و عربی و ترکی هر سه در کارتان هست، Command A Translate تنها مدلی است که هر سه را با اسم نوشته، و باید بدانید که پنجره اش هشت هزار توکن است و راه رسمی خریدش از ایران وجود ندارد. اگر می خواهید مدل را خودتان اجرا کنید، آیا اکسپنس فارسی را دارد و پروانه اش استفاده تجاری را ندارد، و این تناقض چیزی است که باید قبل از شروع پروژه بدانید و نه وسطش.
پرسش هایی که واقعا پرسیده می شود
بهترین هوش مصنوعی برای ترجمه فارسی کدام است
بر اساس جدول همین صفحه، Command A Translate از کوهر، چون تنها مدلی است که سازنده اش هم آن را مدل ترجمه معرفی کرده و هم فارسی را در فهرست ۲۳ زبانه اش با اسم نوشته. دو قید دارد که در جدول هم دیده می شوند: پنجره اش هشت هزار توکن است و قرارداد کوهر ایران را با اسم نوشته.
کدام مدل ترجمه را می شود روی سرور خودمان اجرا کرد
سه تا. آیا اکسپنس ۳۲بی که فارسی را نام برده ولی پروانه اش CC BY-NC است و استفاده تجاری نمی دهد، لاما ۴ که پروانه تجاری دارد ولی فارسی در فهرست دوازده زبانه اش نیست، و میسترال لارج ۳ که آپاچی ۲ است و فهرست زبانش فارسی را نام نبرده.
این مدل ها فارسی به عربی ترجمه می کنند
فهرست ۲۳ زبانه کوهر هر دو را دارد، پس این جفت از داخل همان فهرست است. ولی فهرست زبان یک مجموعه است و نه تضمین کیفیت هر جفت، و هیچ سازنده ای عددی جدا برای جفت ها منتشر نمی کند.
کیفیت ترجمه فارسی این مدل ها چطور است
نمی دانیم و ادعا هم نمی کنیم. این جدول می گوید سازنده فارسی را در فهرست زبان های همان مدل نوشته یا نه. سنجیدن کیفیت خواندن خروجی می خواهد و آن را انجام نداده ایم.
برای ترجمه کل یک سایت کدام را انتخاب کنیم
اگر با مدل ترجمه اختصاصی کار می کنید، صفحه به صفحه، چون پنجره هشت هزار توکنی جای بیشتر از چند صفحه ندارد. اگر می خواهید سند بلند را یکجا بدهید، دارید مدلی را انتخاب می کنید که برای ترجمه ساخته نشده و فارسی را هم اعلام نکرده.
ترجمه و بومی سازی سایت شما با ما
خدمات ترجمه سایت