uttapen

Llama 3.3 Euryale 70B یا Gemini 3.1 Flash Lite (batch)؟

هر دو با همان کلید و همان کد در یوتاپن کار می‌کنند؛ فقط مقدار model عوض می‌شود. پس می‌توانی بدون تغییر معماری، هر دو را روی کار واقعی خودت تست کنی. از نظر هزینه، Gemini 3.1 Flash Lite (batch) حدود ۱٫۶ برابر ارزان‌تر تمام می‌شود.

ویژگیLlama 3.3 Euryale 70BGemini 3.1 Flash Lite (batch)
تأمین‌کنندهSao10kGoogle
شناسهٔ مدلsao10k/l3.3-euryale-70bgoogle/gemini-3.1-flash-lite:batch
context131,072 توکن1,048,576 توکن
حداکثر خروجی16,384 توکن65,536 توکن
ورودی / ۱M توکن188,581 تومان36,266 تومان
خروجی / ۱M توکن217,594 تومان217,594 تومان
≈ یک درخواست ۱٬۰۰۰ کلمه‌ای528 تومان330 تومان
cache ورودیندارد3,627 تومان / ۱M
ورودی تصویرندارددارد
ورودی فایلندارددارد
tool callingندارددارد
خروجی JSONدارددارد
حالت استدلالندارددارد

کدام برای چه کاری؟

Llama 3.3 Euryale 70B

  • گفتگو، خلاصه‌سازی و تولید متن
528 تومان برای هر ۱٬۰۰۰ کلمه · صفحهٔ مدل

Gemini 3.1 Flash Lite (batch)

  • مسئله‌های چندمرحله‌ای، ریاضی و دیباگ
  • تحلیل اسناد بلند و کدبیس در یک درخواست
  • خواندن تصویر، فاکتور و فرم
  • ایجنت و اتصال به API و دیتابیس
  • کار پرحجم با هزینهٔ کم
330 تومان برای هر ۱٬۰۰۰ کلمه · صفحهٔ مدل

تست هر دو با یک کد

فقط model را بین دو شناسه عوض کن و همان درخواست را دو بار بفرست؛ هزینهٔ هر پاسخ در هدر X-Uttapen-Cost-Toman برمی‌گردد.

curl https://api.uttapen.ir/v1/chat/completions \
  -H "Authorization: Bearer sk-up-…" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "sao10k/l3.3-euryale-70b",
    "messages": [{"role": "user", "content": "سلام! خودت را معرفی کن."}],
    "stream": true
  }'

model = "google/gemini-3.1-flash-lite:batch"

مقایسه‌های دیگر: همهٔ جفت‌ها · رتبه‌بندی مدل‌ها · فهرست کامل

base_url = https://api.uttapen.ir/v1