گالری مدل‌ها

برترین مدل‌هادر کنار یکدیگر.

Claude، GPT، Gemini، Grok، Kimi، DeepSeek و موارد دیگر در یک فضای کاری — هر برگه مشخصات را باز کنید، هزینه آن‌ها را به ستاره مقایسه کنید و در میانه گفتگو بین مدل‌ها جابه‌جا شوید.

80 مدل9 آزمایشگاه39 مدل با استدلال

هزینه هر مدل

یک نوار برای هر مدل با قیمت‌گذاری بر حسب ستاره — از ارزان‌ترین تا پرمیوم در مقیاس لگاریتمی. برای مشاهده مشخصات کامل روی هر نوار کلیک کنید.

کمترین ستارهبیشترین ستاره

امتیازدهی مدل‌ها

همه مدل‌های موجود در کاتالوگ روی یک محور، یک نمودار برای هر ارزیابی، با رنگ‌بندی بر اساس آزمایشگاه سازنده. برای مشاهده برگه مشخصات هر مدل روی نوار آن کلیک کنید. امتیازها منتشر شده توسط Artificial Analysis

هوشمندی

34 از 80 مدل ارزیابی شدند

امتیاز شاخص: عددی که ارزیابی‌های مستقل استدلال، دانش، کدنویسی و ریاضیات را ترکیب می‌کند. این امتیاز مشخص می‌کند که «این مدل در کل چقدر توانمند است» — هرچه بالاتر باشد بهتر است و امتیازات از ۰ تا ۱۰۰ هستند.

نماد لامپ نشان‌دهنده یک مدل استدلالی است

همه‌چیزدانی

28 از 80 مدل ارزیابی شدند

قابلیت اطمینان به دانش و میزان توهم در یک عدد. پاسخ صحیح امتیاز مثبت و پاسخ ساختگی (توهم) امتیاز منفی دارد، و امتناع از پاسخ هیچ امتیازی کسر نمی‌کند. هرچه بالاتر باشد بهتر است، اما مقیاس از ۱۰۰- تا ۱۰۰ متغیر است: صفر یعنی تعداد پاسخ‌های درست و نادرست برابر است، و امتیاز منفی یعنی خطاهای مدل بیشتر از پاسخ‌های درست آن است.

نماد لامپ نشان‌دهنده یک مدل استدلالی است

کدنویسی

16 از 80 مدل ارزیابی شدند

کدنویسی عاملی: این‌که یک مدل روی یک پایگاه کد واقعی چقدر خوب کار می‌کند، نه این‌که چقدر سینتکس را خوب از حفظ است. شاخص نسخه ۱.۳ سه بنچمارک DeepSWE، Terminal-Bench v2 و SWE-Atlas-QnA را ترکیب می‌کند. هرچه بالاتر باشد در همان مقیاس ۰ تا ۱۰۰ بهتر است.

نماد لامپ نشان‌دهنده یک مدل استدلالی است

OpenAI

13

Google

6

Anthropic

5

xAI

6

Moonshot AI

4

DeepSeek

2

Perplexity

4

Meta

2

یکی را انتخاب کرده و شروع کنید

تنها با یک ورود به همه مدل‌های اینجا دسترسی دارید — شروع طرح‌ها رایگان است.