uttapen

GLM 5.3 Flash یا Qwen3.5-9B (batch)؟

هر دو با همان کلید و همان کد در یوتاپن کار می‌کنند؛ فقط مقدار model عوض می‌شود. پس می‌توانی بدون تغییر معماری، هر دو را روی کار واقعی خودت تست کنی. از نظر هزینه، GLM 5.3 Flash حدود ۱٫۳ برابر ارزان‌تر تمام می‌شود.

ویژگیGLM 5.3 FlashQwen3.5-9B (batch)
تأمین‌کنندهZ.ai (GLM)Qwen (Alibaba)
شناسهٔ مدلz-ai/glm-5.3-flashqwen/qwen3.5-9b:batch
context1,310,720 توکن262,144 توکن
حداکثر خروجی131,072 توکن235,929 توکن
ورودی / ۱M توکن21,759 تومان49,321 تومان
خروجی / ۱M توکن72,531 تومان72,531 تومان
≈ یک درخواست ۱٬۰۰۰ کلمه‌ای123 تومان158 تومان
cache ورودی4,352 تومان / ۱Mندارد
ورودی تصویردارددارد
ورودی فایلنداردندارد
tool callingدارددارد
خروجی JSONدارددارد
حالت استدلالدارددارد

کدام برای چه کاری؟

GLM 5.3 Flash

  • مسئله‌های چندمرحله‌ای، ریاضی و دیباگ
  • تحلیل اسناد بلند و کدبیس در یک درخواست
  • خواندن تصویر، فاکتور و فرم
  • ایجنت و اتصال به API و دیتابیس
  • کار پرحجم با هزینهٔ کم
123 تومان برای هر ۱٬۰۰۰ کلمه · صفحهٔ مدل

Qwen3.5-9B (batch)

  • مسئله‌های چندمرحله‌ای، ریاضی و دیباگ
  • تحلیل اسناد بلند و کدبیس در یک درخواست
  • خواندن تصویر، فاکتور و فرم
  • ایجنت و اتصال به API و دیتابیس
  • کار پرحجم با هزینهٔ کم
158 تومان برای هر ۱٬۰۰۰ کلمه · صفحهٔ مدل

تست هر دو با یک کد

فقط model را بین دو شناسه عوض کن و همان درخواست را دو بار بفرست؛ هزینهٔ هر پاسخ در هدر X-Uttapen-Cost-Toman برمی‌گردد.

curl https://api.uttapen.ir/v1/chat/completions \
  -H "Authorization: Bearer sk-up-…" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "z-ai/glm-5.3-flash",
    "messages": [{"role": "user", "content": "سلام! خودت را معرفی کن."}],
    "stream": true
  }'

model = "qwen/qwen3.5-9b:batch"

مقایسه‌های دیگر: همهٔ جفت‌ها · رتبه‌بندی مدل‌ها · فهرست کامل

base_url = https://api.uttapen.ir/v1