uttapen

رتبه‌بندی مدل‌های استدلالی برای مسئله‌های چندمرحله‌ای

این مدل‌ها قبل از پاسخ، زنجیرهٔ استدلال تولید می‌کنند. کیفیت روی مسائل چندمرحله‌ای بالاتر است ولی تعداد توکن خروجی چند برابر می‌شود؛ برای همین در برآورد هزینه، سه برابر خروجی معمول در نظر گرفته می‌شود.

به‌صرفه‌ترین در این دسته

امتیاز از ۱۰۰: ۵۰٪ ارزانی، ۳۰٪ قابلیت‌ها و ۲۰٪ اندازهٔ context — نه سنجهٔ کیفیت پاسخ.

#مدلcontext≈ ۱٬۰۰۰ کلمهامتیاز
۱Gemini 2.5 Flash Lite (batch)1,048,5769486.2
۲Qwen3.7 Flash1,000,0006084.9
۳Muse Spark 1.2 Contributor1,048,57611384.2
۴Muse Spark 1.3 Contributor1,048,57611384.2
۵GPT-5 Nano (batch)400,0008583.9
۶Nex-N2-Mini262,1444782.9
۷Ling 3.0 Flash262,1443281.1
۸GLM Flash Latest1,310,72011678.6
۹Gemini 2.5 Flash Lite1,048,57618978.6
۱۰GLM 5.3 Flash1,310,72012378
۱۱Solar Pro 4524,2885777.2
۱۲Qwen3.5-Flash1,000,00012377.1
۱۳DeepSeek V4 Flash Latest1,310,7207976.8
۱۴GPT-5 Nano400,00017076.4
۱۵Qwen3.5-9B262,1449475.4

فهرست کامل مدل‌های استدلالی برای مسئله‌های چندمرحله‌ای با قیمت ←