قیمت و API مدل Kimi K2 Thinking در ایران
moonshotai/kimi-k2-thinking
toolsreasoningjsonشارژ بر اساس مصرف واقعی همان درخواست. قیمتها با تغییر شرایط بازار بهروز میشوند. cache ورودی: 43,519 تومان / 1M.قیمتها و شارژ
کد آمادهٔ Kimi K2 Thinking: فراخوانی ابزار (tool calling)
نمونه بر اساس قابلیتهای همین مدل انتخاب شده و با کلید خودت بدون تغییر دیگری اجرا میشود.
from openai import OpenAI
import json
client = OpenAI(base_url="https://api.uttapen.ir/v1", api_key="sk-up-…")
tools = [{
"type": "function",
"function": {
"name": "check_stock",
"description": "موجودی یک محصول را برمیگرداند",
"parameters": {
"type": "object",
"properties": {"sku": {"type": "string"}},
"required": ["sku"],
},
},
}]
messages = [{"role": "user", "content": "از کفش نایک مدل NK-42 چند تا موجوده؟"}]
first = client.chat.completions.create(model="moonshotai/kimi-k2-thinking", messages=messages, tools=tools)
call = first.choices[0].message.tool_calls[0]
# تابع را خودت اجرا میکنی؛ مدل هیچ دسترسی مستقیمی به دیتابیس ندارد
args = json.loads(call.function.arguments)
result = {"sku": args["sku"], "qty": 7}
messages += [first.choices[0].message, {"role": "tool", "tool_call_id": call.id, "content": json.dumps(result)}]
final = client.chat.completions.create(model="moonshotai/kimi-k2-thinking", messages=messages, tools=tools)
print(final.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uttapen.ir/v1", apiKey: "sk-up-…" });
const tools = [{
type: "function",
function: {
name: "check_stock",
description: "موجودی یک محصول را برمیگرداند",
parameters: { type: "object", properties: { sku: { type: "string" } }, required: ["sku"] },
},
}];
const messages = [{ role: "user", content: "از کفش نایک مدل NK-42 چند تا موجوده؟" }];
const first = await client.chat.completions.create({ model: "moonshotai/kimi-k2-thinking", messages, tools });
const call = first.choices[0].message.tool_calls[0];
const args = JSON.parse(call.function.arguments);
const result = { sku: args.sku, qty: 7 };
messages.push(first.choices[0].message, { role: "tool", tool_call_id: call.id, content: JSON.stringify(result) });
const final = await client.chat.completions.create({ model: "moonshotai/kimi-k2-thinking", messages, tools });
console.log(final.choices[0].message.content);curl https://api.uttapen.ir/v1/chat/completions \
-H "Authorization: Bearer sk-up-…" \
-H "Content-Type: application/json" \
-d '{
"model": "moonshotai/kimi-k2-thinking",
"messages": [{"role": "user", "content": "از کفش نایک مدل NK-42 چند تا موجوده؟"}],
"tools": [{
"type": "function",
"function": {
"name": "check_stock",
"parameters": {"type": "object", "properties": {"sku": {"type": "string"}}, "required": ["sku"]}
}
}]
}'Kimi K2 Thinking برای چه کاری خوب است؟
Kimi K2 Thinking یکی از مدلهای Moonshot (Kimi) است و در یوتاپن با شناسهٔ «moonshotai/kimi-k2-thinking» صدا زده میشود. در هر فراخوانی تا ۲۶۲٬۱۴۴ توکن ورودی میپذیرد؛ برای متن فارسی این تقریباً ۶۵۵ صفحهٔ A4 است، پس چند فایل یا یک سند بلند را میشود یکجا داد. حداکثر طول پاسخ در هر فراخوانی ۱۰۰٬۳۵۲ توکن است. از نظر قیمت در دستهٔ «میانرده» است — ارزانتر از ۲۲۸ مدل و گرانتر از ۱۷۸ مدل پولی دیگر کاتالوگ.
قابلیتهایی که در همین شناسه فعال است: tool calling دارد، یعنی میتواند تابعهای خودت را با آرگومان درست صدا بزند؛ با response_format خروجی JSON معتبر میدهد و مستقیم به کد وصل میشود؛ حالت استدلال دارد و روی مسئلهٔ چندمرحلهای، ریاضی و دیباگ بهتر جواب میدهد. همهٔ اینها با همان پارامترهای استاندارد SDK رسمی OpenAI کار میکنند و کد اختصاصی لازم ندارند. توجه کن که توکنهای استدلال هم توکن خروجی محسوب میشوند و در صورتحساب میآیند.
برای برآورد سرانگشتی: هر ۱٬۰۰۰ کلمه رفتوبرگشت با این مدل حدود ۱٬۱۶۹ تومان است (۱۷۴٬۰۷۵ تومان ورودی و ۷۲۵٬۳۱۳ تومان خروجی بهازای ۱M توکن). cache ورودی دارد: توکنهای تکراری context با ۴۳٬۵۱۹ تومان / ۱M حساب میشوند، که برای پرامپت سیستمی بلند تفاوت بزرگی است. شارژ نهایی همیشه بر اساس مصرف واقعی همان درخواست است، نه برآورد؛ درخواست ناموفق صفر تومان.
نزدیکترین گزینه با همین قابلیتها از تأمینکنندهٔ دیگر R1 است: Kimi K2 Thinking تقریباً 1 برابر ارزانتر از آن تمام میشود و پنجرهٔ context آن بزرگتر است. هر دو با همان کلید و همان کد کار میکنند، پس عوضکردنشان فقط تغییر یک رشته است.
برای اینکه عدد قابل تصور شود: با ۱۰۰ هزار تومان اعتبار، حدود ۸۶ درخواست ۱٬۰۰۰ کلمهای روی Kimi K2 Thinking جا میشود، و هر ۱٬۰۰۰ تومان تقریباً ۸۵۵ کلمه رفتوبرگشت میخرد. اگر پردازشی یک میلیون توکن ورودی و یک میلیون توکن خروجی داشته باشد، کل آن ۸۹۹٬۳۸۸ تومان میشود. پر کردن کامل پنجرهٔ ۲۶۲٬۱۴۴ توکنی این مدل فقط از سمت ورودی ۴۵٬۶۳۳ تومان هزینه دارد، پس تاریخچهٔ گفتگو را بیدلیل بلند نگه ندار.
Moonshot (Kimi) در کاتالوگ ما ۹ مدل دارد؛ ارزانترینشان Kimi K2.5 با ۱٬۰۱۸ تومان و گرانترین Kimi K3 (batch) با ۶٬۷۸۹ تومان برای هر ۱٬۰۰۰ کلمه. از پارامترهای کمتکرار، این مدل logprobs، repetition_penalty، top_k، top_logprobs را میپذیرد — همه از طریق همان بدنهٔ استاندارد درخواست. از نظر اندازهٔ context نزدیکترین گزینه از تأمینکنندهٔ دیگر Trinity Large Thinking با ۲۶۲٬۱۴۴ توکن است.
بهترین جای استفادهاش: چتبات محصول و دستیار داخلی، جایی که تعادل هزینه و کیفیت مهم است، حل مسئلهٔ منطقی و بازبینی کد، ایجنتهایی که به API و دیتابیس وصل میشوند، استخراج داده با اسکیمای مشخص، تحلیل سند یا کدبیس بلند در یک درخواست.
Kimi K2 Thinking is Moonshot AI’s most advanced open reasoning model to date, extending the K2 series into agentic, long-horizon reasoning. Built on the trillion-parameter Mixture-of-Experts (MoE) architecture introduced in...
سه کار واقعی، با قیمت همین مدل
اعداد از همان قیمتهای بالا حساب شدهاند و با تغییر قیمت مدل تغییر میکنند.
| کار | توکن | هزینه |
|---|---|---|
| یک نوبت گفتگو با تاریخچهٔ متوسط | 1,500 ورودی + 400 خروجی | 551 تومان |
| خلاصهکردن سند دهصفحهای | 4,000 ورودی + 600 خروجی | 1,131 تومان |
| دستهبندی هزار ردیف کوتاه | 120,000 ورودی + 20,000 خروجی | 35,395 تومان |
سؤالهای پرتکرار
- چطور با Kimi K2 Thinking در ایران کار کنم؟
- در یوتاپن ثبتنام کن، کیف پول را تومانی شارژ کن، کلید API بساز و در SDK رسمی OpenAI فقط base_url را به https://api.uttapen.ir/v1 و model را به «moonshotai/kimi-k2-thinking» تغییر بده. بقیهٔ کدت دستنخورده میماند.
- قیمت Kimi K2 Thinking به تومان چقدر است؟
- هر ۱ میلیون توکن ورودی ۱۷۴٬۰۷۵ تومان و هر ۱ میلیون توکن خروجی ۷۲۵٬۳۱۳ تومان؛ یک درخواست ۱٬۰۰۰ کلمهای تقریباً ۱٬۱۶۹ تومان. شارژ بر اساس مصرف واقعی همان درخواست است و درخواست ناموفق صفر تومان.
- Kimi K2 Thinking چند توکن ورودی میگیرد؟
- تا ۲۶۲٬۱۴۴ توکن در هر درخواست؛ برای متن فارسی حدود ۱۹۷ هزار کلمه. حداکثر طول پاسخ هم ۱۰۰٬۳۵۲ توکن است.
- آیا Kimi K2 Thinking استریم و tool calling را پشتیبانی میکند؟
- استریم (stream=true) روی همهٔ مدلها فعال است. این مدل tool calling را با همان قالب OpenAI پشتیبانی میکند. خروجی ساختیافته با response_format هم کار میکند.