قیمت و API مدل Nemotron 3.5 Lightning (free) در ایران
nvidia/nemotron-3.5-lightning:free
رایگان · ظرفیت محدودtoolsreasoningشارژ بر اساس مصرف واقعی همان درخواست. قیمتها با تغییر شرایط بازار بهروز میشوند.قیمتها و شارژ
کد آمادهٔ Nemotron 3.5 Lightning (free): حل مسئلهٔ چندمرحلهای با حالت استدلال
نمونه بر اساس قابلیتهای همین مدل انتخاب شده و با کلید خودت بدون تغییر دیگری اجرا میشود.
from openai import OpenAI
client = OpenAI(base_url="https://api.uttapen.ir/v1", api_key="sk-up-…")
resp = client.chat.completions.create(
model="nvidia/nemotron-3.5-lightning:free",
messages=[{"role": "user", "content": (
"یک فروشگاه ۳ انبار دارد. انبار A روزی ۱۲۰ سفارش، B روزی ۸۵ و C روزی ۴۰ سفارش میفرستد. "
"اگر C تعطیل شود و بارش بین A و B نسبت به ظرفیتشان تقسیم شود، هر کدام روزی چند سفارش میفرستند؟ "
"مرحلهبهمرحله حساب کن و در پایان فقط دو عدد بده."
)}],
reasoning_effort="medium", # low | medium | high
)
print(resp.choices[0].message.content)
# توکنهای استدلال هم توکن خروجی حساب میشوند:
print(resp.usage.completion_tokens_details)curl https://api.uttapen.ir/v1/chat/completions \
-H "Authorization: Bearer sk-up-…" \
-H "Content-Type: application/json" \
-d '{
"model": "nvidia/nemotron-3.5-lightning:free",
"messages": [{"role": "user", "content": "۱۲۰ و ۸۵ سفارش روزانه بین دو انبار تقسیم میشود؛ مرحلهبهمرحله حساب کن."}],
"reasoning": {"effort": "medium"}
}'import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uttapen.ir/v1", apiKey: "sk-up-…" });
const resp = await client.chat.completions.create({
model: "nvidia/nemotron-3.5-lightning:free",
messages: [{ role: "user", content: "۱۲۰ و ۸۵ سفارش روزانه بین دو انبار تقسیم میشود؛ مرحلهبهمرحله حساب کن و در پایان فقط دو عدد بده." }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);
console.log(resp.usage.completion_tokens_details);Nemotron 3.5 Lightning (free) برای چه کاری خوب است؟
Nemotron 3.5 Lightning (free) از NVIDIA میآید؛ در کد فقط همین رشته را در فیلد model بگذار: «nvidia/nemotron-3.5-lightning:free». Nemotron 3.5 Lightning (free) تا ۱٬۰۰۰٬۰۰۰ توکن را در یک درخواست نگه میدارد (نزدیک ۷۵۰ هزار کلمهٔ فارسی)، و همین عدد سقف تاریخچهٔ گفتگو در محصول تو را تعیین میکند. حداکثر طول پاسخ در هر فراخوانی ۶۵٬۵۳۶ توکن است. این مدل رایگان است: چیزی از کیف پول کم نمیشود، ولی ظرفیتش بین همهٔ کاربران مشترک است و سقف روزانه دارد.
قابلیتهایی که در همین شناسه فعال است: tool calling دارد، یعنی میتواند تابعهای خودت را با آرگومان درست صدا بزند؛ حالت استدلال دارد و روی مسئلهٔ چندمرحلهای، ریاضی و دیباگ بهتر جواب میدهد. همهٔ اینها با همان پارامترهای استاندارد SDK رسمی OpenAI کار میکنند و کد اختصاصی لازم ندارند. توجه کن که توکنهای استدلال هم توکن خروجی محسوب میشوند و در صورتحساب میآیند.
۰ تومان برای هر ۱M توکن ورودی و ۰ تومان برای هر ۱M توکن خروجی؛ در دستهٔ «رایگان» کاتالوگ مینشیند و یک درخواست ۱٬۰۰۰ کلمهای ≈ ۰ تومان. شارژ نهایی همیشه بر اساس مصرف واقعی همان درخواست است، نه برآورد؛ درخواست ناموفق صفر تومان.
نزدیکترین گزینه با همین قابلیتها از تأمینکنندهٔ دیگر North Mini Code (free) است و پنجرهٔ context آن بزرگتر است. هر دو با همان کلید و همان کد کار میکنند، پس عوضکردنشان فقط تغییر یک رشته است.
این شناسه با «nvidia/nemotron-3.5-lightning» اشتباه گرفته میشود، چون هستهٔ مدل یکی است. تفاوت در پسوند است: «free» در برابر نسخهٔ استاندارد. پنجرهٔ context هم یکی نیست: ۱٬۰۰۰٬۰۰۰ در برابر ۲۶۲٬۱۴۴ توکن. حداکثر طول پاسخ هم فرق دارد: ۶۵٬۵۳۶ در برابر ۱۳۱٬۰۷۲ توکن. در پارامترها آن یکی frequency_penalty، logit_bias، logprobs، min_p را.
NVIDIA در کاتالوگ ما ۱۰ مدل دارد؛ ارزانترینشان Nemotron 3 Nano 30B A3B با ۹۴ تومان و گرانترین Nemotron 3 Ultra با ۱٬۴۱۴ تومان برای هر ۱٬۰۰۰ کلمه. در عوض response_format، structured_outputs را که بیشتر مدلها دارند پشتیبانی نمیکند، پس اگر کدت به آنها تکیه دارد قبل از جابهجایی تست کن. از نظر اندازهٔ context نزدیکترین گزینه از تأمینکنندهٔ دیگر Nova 2 Lite با ۱٬۰۰۰٬۰۰۰ توکن است.
بهترین جای استفادهاش: تست ایده و پروتوتایپ بدون هزینه، حل مسئلهٔ منطقی و بازبینی کد، ایجنتهایی که به API و دیتابیس وصل میشوند، تحلیل سند یا کدبیس بلند در یک درخواست.
NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...
سه کار واقعی، با قیمت همین مدل
اعداد از همان قیمتهای بالا حساب شدهاند و با تغییر قیمت مدل تغییر میکنند.
| کار | توکن | هزینه |
|---|---|---|
| یک نوبت گفتگو با تاریخچهٔ متوسط | 1,500 ورودی + 400 خروجی | 0 تومان |
| خلاصهکردن سند دهصفحهای | 4,000 ورودی + 600 خروجی | 0 تومان |
| دستهبندی هزار ردیف کوتاه | 120,000 ورودی + 20,000 خروجی | 0 تومان |
نسخههای دیگر همین مدل
هستهٔ مدل یکی است؛ هر نسخه شرایط اجرا و قیمت خودش را دارد. نسخهٔ فعلی: رایگان.
| نسخه | شناسه | خروجی / ۱M | context |
|---|---|---|---|
| استاندارد | nvidia/nemotron-3.5-lightning | 58,025 | 262,144 |
شناسهٔ هر نسخه را عیناً در فیلد model بگذار؛ نیازی به تغییر کد دیگری نیست.
سؤالهای پرتکرار
- چطور با Nemotron 3.5 Lightning (free) در ایران کار کنم؟
- در یوتاپن ثبتنام کن، کیف پول را تومانی شارژ کن، کلید API بساز و در SDK رسمی OpenAI فقط base_url را به https://api.uttapen.ir/v1 و model را به «nvidia/nemotron-3.5-lightning:free» تغییر بده. بقیهٔ کدت دستنخورده میماند.
- قیمت Nemotron 3.5 Lightning (free) به تومان چقدر است؟
- هر ۱ میلیون توکن ورودی ۰ تومان و هر ۱ میلیون توکن خروجی ۰ تومان؛ یک درخواست ۱٬۰۰۰ کلمهای تقریباً ۰ تومان. شارژ بر اساس مصرف واقعی همان درخواست است و درخواست ناموفق صفر تومان.
- Nemotron 3.5 Lightning (free) چند توکن ورودی میگیرد؟
- تا ۱٬۰۰۰٬۰۰۰ توکن در هر درخواست؛ برای متن فارسی حدود ۷۵۰ هزار کلمه. حداکثر طول پاسخ هم ۶۵٬۵۳۶ توکن است.
- آیا Nemotron 3.5 Lightning (free) استریم و tool calling را پشتیبانی میکند؟
- استریم (stream=true) روی همهٔ مدلها فعال است. این مدل tool calling را با همان قالب OpenAI پشتیبانی میکند.
- محدودیت مدل رایگان چیست؟
- مدلهای رایگان سقف روزانه بهازای هر کاربر دارند و ظرفیتشان بین همهٔ کاربران مشترک است؛ وقتی ظرفیت مشترک تمام شود، درخواست با خطای مشخص رد میشود و کیف پولت دستنخورده میماند.