uttapen

Llama Guard 4 12B یا Ling 3.0 Flash Fin؟

هر دو با همان کلید و همان کد در یوتاپن کار می‌کنند؛ فقط مقدار model عوض می‌شود. پس می‌توانی بدون تغییر معماری، هر دو را روی کار واقعی خودت تست کنی. از نظر هزینه، Ling 3.0 Flash Fin حدود ۱٫۵ برابر ارزان‌تر تمام می‌شود.

ویژگیLlama Guard 4 12BLing 3.0 Flash Fin
تأمین‌کنندهMetainclusionAI
شناسهٔ مدلmeta-llama/llama-guard-4-12binclusionai/ling-3.0-flash-fin
context163,840 توکن262,144 توکن
حداکثر خروجی16,384 توکن235,929 توکن
ورودی / ۱M توکن52,223 تومان17,408 تومان
خروجی / ۱M توکن52,223 تومان52,223 تومان
≈ یک درخواست ۱٬۰۰۰ کلمه‌ای136 تومان91 تومان
cache ورودیندارد3,482 تومان / ۱M
ورودی تصویرداردندارد
ورودی فایلنداردندارد
tool callingندارددارد
خروجی JSONدارددارد
حالت استدلالندارددارد

کدام برای چه کاری؟

Llama Guard 4 12B

  • خواندن تصویر، فاکتور و فرم
  • کار پرحجم با هزینهٔ کم
136 تومان برای هر ۱٬۰۰۰ کلمه · صفحهٔ مدل

Ling 3.0 Flash Fin

  • مسئله‌های چندمرحله‌ای، ریاضی و دیباگ
  • تحلیل اسناد بلند و کدبیس در یک درخواست
  • ایجنت و اتصال به API و دیتابیس
  • کار پرحجم با هزینهٔ کم
91 تومان برای هر ۱٬۰۰۰ کلمه · صفحهٔ مدل

تست هر دو با یک کد

فقط model را بین دو شناسه عوض کن و همان درخواست را دو بار بفرست؛ هزینهٔ هر پاسخ در هدر X-Uttapen-Cost-Toman برمی‌گردد.

curl https://api.uttapen.ir/v1/chat/completions \
  -H "Authorization: Bearer sk-up-…" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/llama-guard-4-12b",
    "messages": [{"role": "user", "content": "سلام! خودت را معرفی کن."}],
    "stream": true
  }'

model = "inclusionai/ling-3.0-flash-fin"

مقایسه‌های دیگر: همهٔ جفت‌ها · رتبه‌بندی مدل‌ها · فهرست کامل

base_url = https://api.uttapen.ir/v1