uttapen

Gemma 4 31B (batch) یا Gemini 3.1 Flash Lite (batch)؟

هر دو با همان کلید و همان کد در یوتاپن کار می‌کنند؛ فقط مقدار model عوض می‌شود. پس می‌توانی بدون تغییر معماری، هر دو را روی کار واقعی خودت تست کنی. از نظر هزینه، Gemini 3.1 Flash Lite (batch) حدود ۱٫۶ برابر ارزان‌تر تمام می‌شود.

ویژگیGemma 4 31B (batch)Gemini 3.1 Flash Lite (batch)
تأمین‌کنندهGoogleGoogle
شناسهٔ مدلgoogle/gemma-4-31b-it:batchgoogle/gemini-3.1-flash-lite:batch
context262,144 توکن1,048,576 توکن
حداکثر خروجی235,929 توکن65,536 توکن
ورودی / ۱M توکن113,149 تومان36,266 تومان
خروجی / ۱M توکن281,421 تومان217,594 تومان
≈ یک درخواست ۱٬۰۰۰ کلمه‌ای513 تومان330 تومان
cache ورودیندارد3,627 تومان / ۱M
ورودی تصویردارددارد
ورودی فایلندارددارد
tool callingدارددارد
خروجی JSONدارددارد
حالت استدلالدارددارد

کدام برای چه کاری؟

Gemma 4 31B (batch)

  • مسئله‌های چندمرحله‌ای، ریاضی و دیباگ
  • تحلیل اسناد بلند و کدبیس در یک درخواست
  • خواندن تصویر، فاکتور و فرم
  • ایجنت و اتصال به API و دیتابیس
513 تومان برای هر ۱٬۰۰۰ کلمه · صفحهٔ مدل

Gemini 3.1 Flash Lite (batch)

  • مسئله‌های چندمرحله‌ای، ریاضی و دیباگ
  • تحلیل اسناد بلند و کدبیس در یک درخواست
  • خواندن تصویر، فاکتور و فرم
  • ایجنت و اتصال به API و دیتابیس
  • کار پرحجم با هزینهٔ کم
330 تومان برای هر ۱٬۰۰۰ کلمه · صفحهٔ مدل

تست هر دو با یک کد

فقط model را بین دو شناسه عوض کن و همان درخواست را دو بار بفرست؛ هزینهٔ هر پاسخ در هدر X-Uttapen-Cost-Toman برمی‌گردد.

curl https://api.uttapen.ir/v1/chat/completions \
  -H "Authorization: Bearer sk-up-…" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemma-4-31b-it:batch",
    "messages": [{"role": "user", "content": "سلام! خودت را معرفی کن."}],
    "stream": true
  }'

model = "google/gemini-3.1-flash-lite:batch"

مقایسه‌های دیگر: همهٔ جفت‌ها · رتبه‌بندی مدل‌ها · فهرست کامل

base_url = https://api.uttapen.ir/v1