قیمت و API مدل GLM Latest در ایران
~z-ai/glm-latest
toolsreasoningjsonشارژ بر اساس مصرف واقعی همان درخواست. قیمتها با تغییر شرایط بازار بهروز میشوند. cache ورودی: 60,346 تومان / 1M.قیمتها و شارژ
کد آمادهٔ GLM Latest: خروجی JSON با اسکیمای مشخص
نمونه بر اساس قابلیتهای همین مدل انتخاب شده و با کلید خودت بدون تغییر دیگری اجرا میشود.
from openai import OpenAI
import json
client = OpenAI(base_url="https://api.uttapen.ir/v1", api_key="sk-up-…")
schema = {
"name": "ticket",
"schema": {
"type": "object",
"properties": {
"category": {"type": "string", "enum": ["fani", "mali", "forush"]},
"priority": {"type": "integer", "minimum": 1, "maximum": 5},
"summary": {"type": "string"},
},
"required": ["category", "priority", "summary"],
"additionalProperties": False,
},
"strict": True,
}
resp = client.chat.completions.create(
model="~z-ai/glm-latest",
messages=[{"role": "user", "content": "تیکت: «دو روزه نمیتونم فاکتور دانلود کنم و پرداختم هم دوباره کسر شد.»"}],
response_format={"type": "json_schema", "json_schema": schema},
)
print(json.loads(resp.choices[0].message.content))import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uttapen.ir/v1", apiKey: "sk-up-…" });
const resp = await client.chat.completions.create({
model: "~z-ai/glm-latest",
messages: [{ role: "user", content: "تیکت: «دو روزه نمیتونم فاکتور دانلود کنم و پرداختم هم دوباره کسر شد.»" }],
response_format: {
type: "json_schema",
json_schema: {
name: "ticket",
strict: true,
schema: {
type: "object",
properties: {
category: { type: "string", enum: ["fani", "mali", "forush"] },
priority: { type: "integer", minimum: 1, maximum: 5 },
summary: { type: "string" },
},
required: ["category", "priority", "summary"],
additionalProperties: false,
},
},
},
});
console.log(JSON.parse(resp.choices[0].message.content));curl https://api.uttapen.ir/v1/chat/completions \
-H "Authorization: Bearer sk-up-…" \
-H "Content-Type: application/json" \
-d '{
"model": "~z-ai/glm-latest",
"messages": [{"role": "user", "content": "تیکت را دستهبندی کن و اولویت ۱ تا ۵ بده."}],
"response_format": {"type": "json_object"}
}'GLM Latest برای چه کاری خوب است؟
GLM Latest از Z.ai (GLM) میآید؛ در کد فقط همین رشته را در فیلد model بگذار: «~z-ai/glm-latest». GLM Latest تا ۱٬۳۱۰٬۷۲۰ توکن را در یک درخواست نگه میدارد (نزدیک ۹۸۳ هزار کلمهٔ فارسی)، و همین عدد سقف تاریخچهٔ گفتگو در محصول تو را تعیین میکند. حداکثر طول پاسخ در هر فراخوانی ۹۴۳٬۷۱۸ توکن است. از نظر قیمت در دستهٔ «میانرده» است — ارزانتر از ۲۵۶ مدل و گرانتر از ۱۵۰ مدل پولی دیگر کاتالوگ.
چه کارهایی از آن برمیآید: tool calling دارد، یعنی میتواند تابعهای خودت را با آرگومان درست صدا بزند؛ با response_format خروجی JSON معتبر میدهد و مستقیم به کد وصل میشود؛ حالت استدلال دارد و روی مسئلهٔ چندمرحلهای، ریاضی و دیباگ بهتر جواب میدهد. همهٔ اینها با همان پارامترهای استاندارد SDK رسمی OpenAI کار میکنند و کد اختصاصی لازم ندارند. توجه کن که توکنهای استدلال هم توکن خروجی محسوب میشوند و در صورتحساب میآیند.
۳۲۴٬۹۴۰ تومان برای هر ۱M توکن ورودی و ۱٬۰۲۱٬۲۴۰ تومان برای هر ۱M توکن خروجی؛ در دستهٔ «میانرده» کاتالوگ مینشیند و یک درخواست ۱٬۰۰۰ کلمهای ≈ ۱٬۷۵۰ تومان. cache ورودی دارد: توکنهای تکراری context با ۶۰٬۳۴۶ تومان / ۱M حساب میشوند، که برای پرامپت سیستمی بلند تفاوت بزرگی است. شارژ نهایی همیشه بر اساس مصرف واقعی همان درخواست است، نه برآورد؛ درخواست ناموفق صفر تومان.
نزدیکترین گزینه با همین قابلیتها از تأمینکنندهٔ دیگر Qwen3 Coder Plus است: GLM Latest تقریباً 1.2 برابر گرانتر از آن تمام میشود و پنجرهٔ context آن بزرگتر است. هر دو با همان کلید و همان کد کار میکنند، پس عوضکردنشان فقط تغییر یک رشته است.
برای اینکه عدد قابل تصور شود: با ۱۰۰ هزار تومان اعتبار، حدود ۵۷ درخواست ۱٬۰۰۰ کلمهای روی GLM Latest جا میشود، و هر ۱٬۰۰۰ تومان تقریباً ۵۷۱ کلمه رفتوبرگشت میخرد. اگر پردازشی یک میلیون توکن ورودی و یک میلیون توکن خروجی داشته باشد، کل آن ۱٬۳۴۶٬۱۸۰ تومان میشود. پر کردن کامل پنجرهٔ ۱٬۳۱۰٬۷۲۰ توکنی این مدل فقط از سمت ورودی ۴۲۵٬۹۰۵ تومان هزینه دارد، پس تاریخچهٔ گفتگو را بیدلیل بلند نگه ندار.
نزدیکترین همخانوادهٔ این مدل «z-ai/glm-5.3» است و انتخاب بین این دو همان جایی است که بیشتر آدمها گیر میکنند. روی یک درخواست ۱٬۰۰۰ کلمهای، این نسخه 1.3 برابر ارزانتر از آن درمیآید (۱٬۷۵۰ در برابر ۲٬۱۸۸ تومان).
Z.ai (GLM) در کاتالوگ ما ۱۷ مدل دارد؛ ارزانترینشان GLM Flash Latest با ۱۱۶ تومان و گرانترین GLM 5.3 با ۲٬۱۸۸ تومان برای هر ۱٬۰۰۰ کلمه. از پارامترهای کمتکرار، این مدل logit_bias، logprobs، min_p، parallel_tool_calls، reasoning_effort، repetition_penalty را میپذیرد — همه از طریق همان بدنهٔ استاندارد درخواست. از نظر اندازهٔ context نزدیکترین گزینه از تأمینکنندهٔ دیگر DeepSeek V4 Flash 0731 با ۱٬۳۱۰٬۷۲۰ توکن است.
کجا انتخاب درستی است: چتبات محصول و دستیار داخلی، جایی که تعادل هزینه و کیفیت مهم است، حل مسئلهٔ منطقی و بازبینی کد، ایجنتهایی که به API و دیتابیس وصل میشوند، استخراج داده با اسکیمای مشخص، تحلیل سند یا کدبیس بلند در یک درخواست.
This model always redirects to the latest GLM model from Z.ai.
سه کار واقعی، با قیمت همین مدل
اعداد از همان قیمتهای بالا حساب شدهاند و با تغییر قیمت مدل تغییر میکنند.
| کار | توکن | هزینه |
|---|---|---|
| یک نوبت گفتگو با تاریخچهٔ متوسط | 1,500 ورودی + 400 خروجی | 896 تومان |
| خلاصهکردن سند دهصفحهای | 4,000 ورودی + 600 خروجی | 1,913 تومان |
| دستهبندی هزار ردیف کوتاه | 120,000 ورودی + 20,000 خروجی | 59,418 تومان |
تاریخچهٔ قیمت
| تاریخ | ورودی (تومان/۱M) | خروجی (تومان/۱M) |
|---|---|---|
| ۱۶ شهریور ۱۴۰۵ | 324,940 | 1,021,240 |
| ۱۶ شهریور ۱۴۰۵ | 322,909 | 1,014,857 |
| ۱۶ شهریور ۱۴۰۵ | 324,940 | 1,021,240 |
| ۱۶ شهریور ۱۴۰۵ | 339,446 | 1,148,895 |
هر تغییر قیمت این مدل ثبت میشود؛ ستون تومان با قیمت امروز محاسبه شده است.
سؤالهای پرتکرار
- چطور با GLM Latest در ایران کار کنم؟
- در یوتاپن ثبتنام کن، کیف پول را تومانی شارژ کن، کلید API بساز و در SDK رسمی OpenAI فقط base_url را به https://api.uttapen.ir/v1 و model را به «~z-ai/glm-latest» تغییر بده. بقیهٔ کدت دستنخورده میماند.
- قیمت GLM Latest به تومان چقدر است؟
- هر ۱ میلیون توکن ورودی ۳۲۴٬۹۴۰ تومان و هر ۱ میلیون توکن خروجی ۱٬۰۲۱٬۲۴۰ تومان؛ یک درخواست ۱٬۰۰۰ کلمهای تقریباً ۱٬۷۵۰ تومان. شارژ بر اساس مصرف واقعی همان درخواست است و درخواست ناموفق صفر تومان.
- GLM Latest چند توکن ورودی میگیرد؟
- تا ۱٬۳۱۰٬۷۲۰ توکن در هر درخواست؛ برای متن فارسی حدود ۹۸۳ هزار کلمه. حداکثر طول پاسخ هم ۹۴۳٬۷۱۸ توکن است.
- آیا GLM Latest استریم و tool calling را پشتیبانی میکند؟
- استریم (stream=true) روی همهٔ مدلها فعال است. این مدل tool calling را با همان قالب OpenAI پشتیبانی میکند. خروجی ساختیافته با response_format هم کار میکند.