قیمت و API مدل Nemotron 3 Ultra (free) در ایران
nvidia/nemotron-3-ultra-550b-a55b:free
رایگان · ظرفیت محدودtoolsreasoningشارژ بر اساس مصرف واقعی همان درخواست. قیمتها با تغییر شرایط بازار بهروز میشوند.قیمتها و شارژ
کد آمادهٔ Nemotron 3 Ultra (free): حل مسئلهٔ چندمرحلهای با حالت استدلال
نمونه بر اساس قابلیتهای همین مدل انتخاب شده و با کلید خودت بدون تغییر دیگری اجرا میشود.
from openai import OpenAI
client = OpenAI(base_url="https://api.uttapen.ir/v1", api_key="sk-up-…")
resp = client.chat.completions.create(
model="nvidia/nemotron-3-ultra-550b-a55b:free",
messages=[{"role": "user", "content": (
"یک فروشگاه ۳ انبار دارد. انبار A روزی ۱۲۰ سفارش، B روزی ۸۵ و C روزی ۴۰ سفارش میفرستد. "
"اگر C تعطیل شود و بارش بین A و B نسبت به ظرفیتشان تقسیم شود، هر کدام روزی چند سفارش میفرستند؟ "
"مرحلهبهمرحله حساب کن و در پایان فقط دو عدد بده."
)}],
reasoning_effort="medium", # low | medium | high
)
print(resp.choices[0].message.content)
# توکنهای استدلال هم توکن خروجی حساب میشوند:
print(resp.usage.completion_tokens_details)curl https://api.uttapen.ir/v1/chat/completions \
-H "Authorization: Bearer sk-up-…" \
-H "Content-Type: application/json" \
-d '{
"model": "nvidia/nemotron-3-ultra-550b-a55b:free",
"messages": [{"role": "user", "content": "۱۲۰ و ۸۵ سفارش روزانه بین دو انبار تقسیم میشود؛ مرحلهبهمرحله حساب کن."}],
"reasoning": {"effort": "medium"}
}'import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uttapen.ir/v1", apiKey: "sk-up-…" });
const resp = await client.chat.completions.create({
model: "nvidia/nemotron-3-ultra-550b-a55b:free",
messages: [{ role: "user", content: "۱۲۰ و ۸۵ سفارش روزانه بین دو انبار تقسیم میشود؛ مرحلهبهمرحله حساب کن و در پایان فقط دو عدد بده." }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);
console.log(resp.usage.completion_tokens_details);Nemotron 3 Ultra (free) برای چه کاری خوب است؟
NVIDIA این مدل را منتشر کرده و ما آن را با نام «nvidia/nemotron-3-ultra-550b-a55b:free» عرضه میکنیم. پنجرهٔ context آن ۱٬۰۰۰٬۰۰۰ توکن است — تقریباً ۷۵۰ هزار کلمهٔ فارسی، یا حدود ۲٬۵۰۰ صفحهٔ A4 در یک درخواست. حداکثر طول پاسخ در هر فراخوانی ۶۵٬۵۳۶ توکن است. این مدل رایگان است: چیزی از کیف پول کم نمیشود، ولی ظرفیتش بین همهٔ کاربران مشترک است و سقف روزانه دارد.
قابلیتهایی که در همین شناسه فعال است: tool calling دارد، یعنی میتواند تابعهای خودت را با آرگومان درست صدا بزند؛ حالت استدلال دارد و روی مسئلهٔ چندمرحلهای، ریاضی و دیباگ بهتر جواب میدهد. همهٔ اینها با همان پارامترهای استاندارد SDK رسمی OpenAI کار میکنند و کد اختصاصی لازم ندارند. توجه کن که توکنهای استدلال هم توکن خروجی محسوب میشوند و در صورتحساب میآیند.
قیمت ورودی ۰ و خروجی ۰ تومان بهازای هر ۱M توکن است. یک درخواست ۱٬۰۰۰ کلمهای روی Nemotron 3 Ultra (free) تقریباً ۰ تومان درمیآید. شارژ نهایی همیشه بر اساس مصرف واقعی همان درخواست است، نه برآورد؛ درخواست ناموفق صفر تومان.
نزدیکترین گزینه با همین قابلیتها از تأمینکنندهٔ دیگر North Mini Code (free) است و پنجرهٔ context آن بزرگتر است. هر دو با همان کلید و همان کد کار میکنند، پس عوضکردنشان فقط تغییر یک رشته است.
این شناسه با «nvidia/nemotron-3-ultra-550b-a55b» اشتباه گرفته میشود، چون هستهٔ مدل یکی است. تفاوت در پسوند است: «free» در برابر نسخهٔ استاندارد. پنجرهٔ context هم یکی نیست: ۱٬۰۰۰٬۰۰۰ در برابر ۲۶۲٬۱۴۴ توکن. حداکثر طول پاسخ هم فرق دارد: ۶۵٬۵۳۶ در برابر ۳۲٬۷۶۸ توکن. در پارامترها آن یکی frequency_penalty، logit_bias، min_p، presence_penalty را.
NVIDIA در کاتالوگ ما ۱۰ مدل دارد؛ ارزانترینشان Nemotron 3 Nano 30B A3B با ۹۴ تومان و گرانترین Nemotron 3 Ultra با ۱٬۴۱۴ تومان برای هر ۱٬۰۰۰ کلمه. از پارامترهای کمتکرار، این مدل reasoning_effort را میپذیرد — همه از طریق همان بدنهٔ استاندارد درخواست. در عوض response_format، structured_outputs را که بیشتر مدلها دارند پشتیبانی نمیکند، پس اگر کدت به آنها تکیه دارد قبل از جابهجایی تست کن. از نظر اندازهٔ context نزدیکترین گزینه از تأمینکنندهٔ دیگر Nova 2 Lite با ۱٬۰۰۰٬۰۰۰ توکن است.
بهترین جای استفادهاش: تست ایده و پروتوتایپ بدون هزینه، حل مسئلهٔ منطقی و بازبینی کد، ایجنتهایی که به API و دیتابیس وصل میشوند، تحلیل سند یا کدبیس بلند در یک درخواست.
NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it...
سه کار واقعی، با قیمت همین مدل
اعداد از همان قیمتهای بالا حساب شدهاند و با تغییر قیمت مدل تغییر میکنند.
| کار | توکن | هزینه |
|---|---|---|
| یک نوبت گفتگو با تاریخچهٔ متوسط | 1,500 ورودی + 400 خروجی | 0 تومان |
| خلاصهکردن سند دهصفحهای | 4,000 ورودی + 600 خروجی | 0 تومان |
| دستهبندی هزار ردیف کوتاه | 120,000 ورودی + 20,000 خروجی | 0 تومان |
نسخههای دیگر همین مدل
هستهٔ مدل یکی است؛ هر نسخه شرایط اجرا و قیمت خودش را دارد. نسخهٔ فعلی: رایگان.
| نسخه | شناسه | خروجی / ۱M | context |
|---|---|---|---|
| استاندارد | nvidia/nemotron-3-ultra-550b-a55b | 906,641 | 262,144 |
شناسهٔ هر نسخه را عیناً در فیلد model بگذار؛ نیازی به تغییر کد دیگری نیست.
سؤالهای پرتکرار
- چطور با Nemotron 3 Ultra (free) در ایران کار کنم؟
- در یوتاپن ثبتنام کن، کیف پول را تومانی شارژ کن، کلید API بساز و در SDK رسمی OpenAI فقط base_url را به https://api.uttapen.ir/v1 و model را به «nvidia/nemotron-3-ultra-550b-a55b:free» تغییر بده. بقیهٔ کدت دستنخورده میماند.
- قیمت Nemotron 3 Ultra (free) به تومان چقدر است؟
- هر ۱ میلیون توکن ورودی ۰ تومان و هر ۱ میلیون توکن خروجی ۰ تومان؛ یک درخواست ۱٬۰۰۰ کلمهای تقریباً ۰ تومان. شارژ بر اساس مصرف واقعی همان درخواست است و درخواست ناموفق صفر تومان.
- Nemotron 3 Ultra (free) چند توکن ورودی میگیرد؟
- تا ۱٬۰۰۰٬۰۰۰ توکن در هر درخواست؛ برای متن فارسی حدود ۷۵۰ هزار کلمه. حداکثر طول پاسخ هم ۶۵٬۵۳۶ توکن است.
- آیا Nemotron 3 Ultra (free) استریم و tool calling را پشتیبانی میکند؟
- استریم (stream=true) روی همهٔ مدلها فعال است. این مدل tool calling را با همان قالب OpenAI پشتیبانی میکند.
- محدودیت مدل رایگان چیست؟
- مدلهای رایگان سقف روزانه بهازای هر کاربر دارند و ظرفیتشان بین همهٔ کاربران مشترک است؛ وقتی ظرفیت مشترک تمام شود، درخواست با خطای مشخص رد میشود و کیف پولت دستنخورده میماند.