قیمت و API مدل Hy3 در ایران
tencent/hy3
toolsreasoningjsonشارژ بر اساس مصرف واقعی همان درخواست. قیمتها با تغییر شرایط بازار بهروز میشوند. cache ورودی: 9,574 تومان / 1M.قیمتها و شارژ
کد آمادهٔ Hy3: خروجی JSON با اسکیمای مشخص
نمونه بر اساس قابلیتهای همین مدل انتخاب شده و با کلید خودت بدون تغییر دیگری اجرا میشود.
from openai import OpenAI
import json
client = OpenAI(base_url="https://api.uttapen.ir/v1", api_key="sk-up-…")
schema = {
"name": "ticket",
"schema": {
"type": "object",
"properties": {
"category": {"type": "string", "enum": ["fani", "mali", "forush"]},
"priority": {"type": "integer", "minimum": 1, "maximum": 5},
"summary": {"type": "string"},
},
"required": ["category", "priority", "summary"],
"additionalProperties": False,
},
"strict": True,
}
resp = client.chat.completions.create(
model="tencent/hy3",
messages=[{"role": "user", "content": "تیکت: «دو روزه نمیتونم فاکتور دانلود کنم و پرداختم هم دوباره کسر شد.»"}],
response_format={"type": "json_schema", "json_schema": schema},
)
print(json.loads(resp.choices[0].message.content))import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uttapen.ir/v1", apiKey: "sk-up-…" });
const resp = await client.chat.completions.create({
model: "tencent/hy3",
messages: [{ role: "user", content: "تیکت: «دو روزه نمیتونم فاکتور دانلود کنم و پرداختم هم دوباره کسر شد.»" }],
response_format: {
type: "json_schema",
json_schema: {
name: "ticket",
strict: true,
schema: {
type: "object",
properties: {
category: { type: "string", enum: ["fani", "mali", "forush"] },
priority: { type: "integer", minimum: 1, maximum: 5 },
summary: { type: "string" },
},
required: ["category", "priority", "summary"],
additionalProperties: false,
},
},
},
});
console.log(JSON.parse(resp.choices[0].message.content));curl https://api.uttapen.ir/v1/chat/completions \
-H "Authorization: Bearer sk-up-…" \
-H "Content-Type: application/json" \
-d '{
"model": "tencent/hy3",
"messages": [{"role": "user", "content": "تیکت را دستهبندی کن و اولویت ۱ تا ۵ بده."}],
"response_format": {"type": "json_object"}
}'Hy3 برای چه کاری خوب است؟
Hy3 از Tencent میآید؛ در کد فقط همین رشته را در فیلد model بگذار: «tencent/hy3». Hy3 تا ۲۶۲٬۱۴۴ توکن را در یک درخواست نگه میدارد (نزدیک ۱۹۷ هزار کلمهٔ فارسی)، و همین عدد سقف تاریخچهٔ گفتگو در محصول تو را تعیین میکند. حداکثر طول پاسخ در هر فراخوانی ۱۲۸٬۰۰۰ توکن است. از نظر قیمت در دستهٔ «بسیار ارزان» است — ارزانتر از ۹۱ مدل و گرانتر از ۳۱۵ مدل پولی دیگر کاتالوگ.
چه کارهایی از آن برمیآید: tool calling دارد، یعنی میتواند تابعهای خودت را با آرگومان درست صدا بزند؛ با response_format خروجی JSON معتبر میدهد و مستقیم به کد وصل میشود؛ حالت استدلال دارد و روی مسئلهٔ چندمرحلهای، ریاضی و دیباگ بهتر جواب میدهد. همهٔ اینها با همان پارامترهای استاندارد SDK رسمی OpenAI کار میکنند و کد اختصاصی لازم ندارند. توجه کن که توکنهای استدلال هم توکن خروجی محسوب میشوند و در صورتحساب میآیند.
۳۸٬۲۹۷ تومان برای هر ۱M توکن ورودی و ۱۵۳٬۱۸۶ تومان برای هر ۱M توکن خروجی؛ در دستهٔ «بسیار ارزان» کاتالوگ مینشیند و یک درخواست ۱٬۰۰۰ کلمهای ≈ ۲۴۹ تومان. cache ورودی دارد: توکنهای تکراری context با ۹٬۵۷۴ تومان / ۱M حساب میشوند، که برای پرامپت سیستمی بلند تفاوت بزرگی است. شارژ نهایی همیشه بر اساس مصرف واقعی همان درخواست است، نه برآورد؛ درخواست ناموفق صفر تومان.
نزدیکترین گزینه با همین قابلیتها از تأمینکنندهٔ دیگر Qwen3 235B A22B Instruct 2507 است: Hy3 تقریباً 1 برابر گرانتر از آن تمام میشود و پنجرهٔ context آن برابر است. هر دو با همان کلید و همان کد کار میکنند، پس عوضکردنشان فقط تغییر یک رشته است.
برای اینکه عدد قابل تصور شود: با ۱۰۰ هزار تومان اعتبار، حدود ۴۰۲ درخواست ۱٬۰۰۰ کلمهای روی Hy3 جا میشود، و هر ۱٬۰۰۰ تومان تقریباً ۴٬۰۱۶ کلمه رفتوبرگشت میخرد. اگر پردازشی یک میلیون توکن ورودی و یک میلیون توکن خروجی داشته باشد، کل آن ۱۹۱٬۴۸۳ تومان میشود. پر کردن کامل پنجرهٔ ۲۶۲٬۱۴۴ توکنی این مدل فقط از سمت ورودی ۱۰٬۰۳۹ تومان هزینه دارد، پس تاریخچهٔ گفتگو را بیدلیل بلند نگه ندار.
نزدیکترین همخانوادهٔ این مدل «tencent/hy4-preview» است و انتخاب بین این دو همان جایی است که بیشتر آدمها گیر میکنند. روی یک درخواست ۱٬۰۰۰ کلمهای، این نسخه 5.1 برابر ارزانتر از آن درمیآید (۲۴۹ در برابر ۱٬۲۵۸ تومان). پنجرهٔ context هم یکی نیست: ۲۶۲٬۱۴۴ در برابر ۱٬۰۴۸٬۵۷۶ توکن. حداکثر طول پاسخ هم فرق دارد: ۱۲۸٬۰۰۰ در برابر ۶۴٬۰۰۰ توکن. در پارامترها این مدل frequency_penalty، logit_bias، min_p، presence_penalty را دارد.
Tencent در کاتالوگ ما ۷ مدل دارد؛ ارزانترینشان Hy-MT2-1.8B با ۸۳ تومان و گرانترین Hy4 preview با ۱٬۲۵۸ تومان برای هر ۱٬۰۰۰ کلمه. از پارامترهای کمتکرار، این مدل logit_bias، max_completion_tokens، min_p، reasoning_effort، repetition_penalty، top_k را میپذیرد — همه از طریق همان بدنهٔ استاندارد درخواست. از نظر اندازهٔ context نزدیکترین گزینه از تأمینکنندهٔ دیگر Trinity Large Thinking با ۲۶۲٬۱۴۴ توکن است.
کجا انتخاب درستی است: کار پرحجم مثل دستهبندی، برچسبگذاری و خلاصهسازی انبوه، حل مسئلهٔ منطقی و بازبینی کد، ایجنتهایی که به API و دیتابیس وصل میشوند، استخراج داده با اسکیمای مشخص، تحلیل سند یا کدبیس بلند در یک درخواست.
Hy3 is a 295B-parameter Mixture-of-Experts model from Tencent (21B active, 192 experts with top-8 routing) built for reasoning, agentic workflows, and real-world production use. It supports a configurable reasoning effort:...
سه کار واقعی، با قیمت همین مدل
اعداد از همان قیمتهای بالا حساب شدهاند و با تغییر قیمت مدل تغییر میکنند.
| کار | توکن | هزینه |
|---|---|---|
| یک نوبت گفتگو با تاریخچهٔ متوسط | 1,500 ورودی + 400 خروجی | 119 تومان |
| خلاصهکردن سند دهصفحهای | 4,000 ورودی + 600 خروجی | 245 تومان |
| دستهبندی هزار ردیف کوتاه | 120,000 ورودی + 20,000 خروجی | 7,659 تومان |
تاریخچهٔ قیمت
| تاریخ | ورودی (تومان/۱M) | خروجی (تومان/۱M) |
|---|---|---|
| ۱۶ شهریور ۱۴۰۵ | 38,297 | 153,186 |
| ۱۶ شهریور ۱۴۰۵ | 23,935 | 95,741 |
هر تغییر قیمت این مدل ثبت میشود؛ ستون تومان با قیمت امروز محاسبه شده است.
سؤالهای پرتکرار
- چطور با Hy3 در ایران کار کنم؟
- در یوتاپن ثبتنام کن، کیف پول را تومانی شارژ کن، کلید API بساز و در SDK رسمی OpenAI فقط base_url را به https://api.uttapen.ir/v1 و model را به «tencent/hy3» تغییر بده. بقیهٔ کدت دستنخورده میماند.
- قیمت Hy3 به تومان چقدر است؟
- هر ۱ میلیون توکن ورودی ۳۸٬۲۹۷ تومان و هر ۱ میلیون توکن خروجی ۱۵۳٬۱۸۶ تومان؛ یک درخواست ۱٬۰۰۰ کلمهای تقریباً ۲۴۹ تومان. شارژ بر اساس مصرف واقعی همان درخواست است و درخواست ناموفق صفر تومان.
- Hy3 چند توکن ورودی میگیرد؟
- تا ۲۶۲٬۱۴۴ توکن در هر درخواست؛ برای متن فارسی حدود ۱۹۷ هزار کلمه. حداکثر طول پاسخ هم ۱۲۸٬۰۰۰ توکن است.
- آیا Hy3 استریم و tool calling را پشتیبانی میکند؟
- استریم (stream=true) روی همهٔ مدلها فعال است. این مدل tool calling را با همان قالب OpenAI پشتیبانی میکند. خروجی ساختیافته با response_format هم کار میکند.