قیمت و API مدل R1 Distill Llama 70B در ایران
deepseek/deepseek-r1-distill-llama-70b
reasoningشارژ بر اساس مصرف واقعی همان درخواست. قیمتها با تغییر شرایط بازار بهروز میشوند.قیمتها و شارژ
کد آمادهٔ R1 Distill Llama 70B: حل مسئلهٔ چندمرحلهای با حالت استدلال
نمونه بر اساس قابلیتهای همین مدل انتخاب شده و با کلید خودت بدون تغییر دیگری اجرا میشود.
from openai import OpenAI
client = OpenAI(base_url="https://api.uttapen.ir/v1", api_key="sk-up-…")
resp = client.chat.completions.create(
model="deepseek/deepseek-r1-distill-llama-70b",
messages=[{"role": "user", "content": (
"یک فروشگاه ۳ انبار دارد. انبار A روزی ۱۲۰ سفارش، B روزی ۸۵ و C روزی ۴۰ سفارش میفرستد. "
"اگر C تعطیل شود و بارش بین A و B نسبت به ظرفیتشان تقسیم شود، هر کدام روزی چند سفارش میفرستند؟ "
"مرحلهبهمرحله حساب کن و در پایان فقط دو عدد بده."
)}],
reasoning_effort="medium", # low | medium | high
)
print(resp.choices[0].message.content)
# توکنهای استدلال هم توکن خروجی حساب میشوند:
print(resp.usage.completion_tokens_details)curl https://api.uttapen.ir/v1/chat/completions \
-H "Authorization: Bearer sk-up-…" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek/deepseek-r1-distill-llama-70b",
"messages": [{"role": "user", "content": "۱۲۰ و ۸۵ سفارش روزانه بین دو انبار تقسیم میشود؛ مرحلهبهمرحله حساب کن."}],
"reasoning": {"effort": "medium"}
}'import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uttapen.ir/v1", apiKey: "sk-up-…" });
const resp = await client.chat.completions.create({
model: "deepseek/deepseek-r1-distill-llama-70b",
messages: [{ role: "user", content: "۱۲۰ و ۸۵ سفارش روزانه بین دو انبار تقسیم میشود؛ مرحلهبهمرحله حساب کن و در پایان فقط دو عدد بده." }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);
console.log(resp.usage.completion_tokens_details);R1 Distill Llama 70B برای چه کاری خوب است؟
R1 Distill Llama 70B یکی از مدلهای DeepSeek است و در یوتاپن با شناسهٔ «deepseek/deepseek-r1-distill-llama-70b» صدا زده میشود. در هر فراخوانی تا ۸٬۱۹۲ توکن ورودی میپذیرد؛ برای متن فارسی این تقریباً ۲۰ صفحهٔ A4 است، پس چند فایل یا یک سند بلند را میشود یکجا داد. حداکثر طول پاسخ در هر فراخوانی ۷٬۳۷۲ توکن است. از نظر قیمت در دستهٔ «ارزان» است — ارزانتر از ۱۲۰ مدل و گرانتر از ۲۸۶ مدل پولی دیگر کاتالوگ.
قابلیتهایی که در همین شناسه فعال است: حالت استدلال دارد و روی مسئلهٔ چندمرحلهای، ریاضی و دیباگ بهتر جواب میدهد. همهٔ اینها با همان پارامترهای استاندارد SDK رسمی OpenAI کار میکنند و کد اختصاصی لازم ندارند. توجه کن که توکنهای استدلال هم توکن خروجی محسوب میشوند و در صورتحساب میآیند.
برای برآورد سرانگشتی: هر ۱٬۰۰۰ کلمه رفتوبرگشت با این مدل حدود ۶۰۳ تومان است (۲۳۲٬۱۰۰ تومان ورودی و ۲۳۲٬۱۰۰ تومان خروجی بهازای ۱M توکن). شارژ نهایی همیشه بر اساس مصرف واقعی همان درخواست است، نه برآورد؛ درخواست ناموفق صفر تومان.
نزدیکترین گزینه با همین قابلیتها از تأمینکنندهٔ دیگر Skyfall 36B V2 است: R1 Distill Llama 70B تقریباً 1.2 برابر گرانتر از آن تمام میشود و پنجرهٔ context آن کوچکتر است. هر دو با همان کلید و همان کد کار میکنند، پس عوضکردنشان فقط تغییر یک رشته است.
برای اینکه عدد قابل تصور شود: با ۱۰۰ هزار تومان اعتبار، حدود ۱۶۶ درخواست ۱٬۰۰۰ کلمهای روی R1 Distill Llama 70B جا میشود، و هر ۱٬۰۰۰ تومان تقریباً ۱٬۶۵۸ کلمه رفتوبرگشت میخرد. اگر پردازشی یک میلیون توکن ورودی و یک میلیون توکن خروجی داشته باشد، کل آن ۴۶۴٬۲۰۰ تومان میشود. پر کردن کامل پنجرهٔ ۸٬۱۹۲ توکنی این مدل فقط از سمت ورودی ۱٬۹۰۱ تومان هزینه دارد، پس تاریخچهٔ گفتگو را بیدلیل بلند نگه ندار.
DeepSeek در کاتالوگ ما ۱۷ مدل دارد؛ ارزانترینشان DeepSeek V4 Flash Latest با ۷۹ تومان و گرانترین DeepSeek V4 Pro 0813 (batch) با ۱٬۹۹۱ تومان برای هر ۱٬۰۰۰ کلمه. از پارامترهای کمتکرار، این مدل repetition_penalty، top_k را میپذیرد — همه از طریق همان بدنهٔ استاندارد درخواست. در عوض response_format، tool_choice، tools، structured_outputs را که بیشتر مدلها دارند پشتیبانی نمیکند، پس اگر کدت به آنها تکیه دارد قبل از جابهجایی تست کن. از نظر اندازهٔ context نزدیکترین گزینه از تأمینکنندهٔ دیگر Gemma 2 27B با ۸٬۱۹۲ توکن است.
بهترین جای استفادهاش: کار پرحجم مثل دستهبندی، برچسبگذاری و خلاصهسازی انبوه، حل مسئلهٔ منطقی و بازبینی کد، درخواستهای کوتاه و تکمرحلهای (context کوچک است).
DeepSeek R1 Distill Llama 70B is a distilled large language model based on [Llama-3.3-70B-Instruct](/meta-llama/llama-3.3-70b-instruct), using outputs from [DeepSeek R1](/deepseek/deepseek-r1). The model combines advanced distillation techniques to achieve high performance across...
سه کار واقعی، با قیمت همین مدل
اعداد از همان قیمتهای بالا حساب شدهاند و با تغییر قیمت مدل تغییر میکنند.
| کار | توکن | هزینه |
|---|---|---|
| یک نوبت گفتگو با تاریخچهٔ متوسط | 1,500 ورودی + 400 خروجی | 441 تومان |
| خلاصهکردن سند دهصفحهای | 4,000 ورودی + 600 خروجی | 1,068 تومان |
| دستهبندی هزار ردیف کوتاه | 120,000 ورودی + 20,000 خروجی | 32,494 تومان |
سؤالهای پرتکرار
- چطور با R1 Distill Llama 70B در ایران کار کنم؟
- در یوتاپن ثبتنام کن، کیف پول را تومانی شارژ کن، کلید API بساز و در SDK رسمی OpenAI فقط base_url را به https://api.uttapen.ir/v1 و model را به «deepseek/deepseek-r1-distill-llama-70b» تغییر بده. بقیهٔ کدت دستنخورده میماند.
- قیمت R1 Distill Llama 70B به تومان چقدر است؟
- هر ۱ میلیون توکن ورودی ۲۳۲٬۱۰۰ تومان و هر ۱ میلیون توکن خروجی ۲۳۲٬۱۰۰ تومان؛ یک درخواست ۱٬۰۰۰ کلمهای تقریباً ۶۰۳ تومان. شارژ بر اساس مصرف واقعی همان درخواست است و درخواست ناموفق صفر تومان.
- R1 Distill Llama 70B چند توکن ورودی میگیرد؟
- تا ۸٬۱۹۲ توکن در هر درخواست؛ برای متن فارسی حدود ۶ هزار کلمه. حداکثر طول پاسخ هم ۷٬۳۷۲ توکن است.
- آیا پاسخ R1 Distill Llama 70B را میتوانم استریم کنم؟
- بله، با stream=true رویدادهای SSE را همانطور که تولید میشوند میگیری. این مدل tool calling و ورودی تصویر ندارد، پس اگر به آنها نیاز داری مدل دیگری انتخاب کن.