Llama 3.2 1B Instruct یا Llama Guard 4 12B؟
هر دو با همان کلید و همان کد در یوتاپن کار میکنند؛ فقط مقدار model عوض میشود. پس میتوانی بدون تغییر معماری، هر دو را روی کار واقعی خودت تست کنی. از نظر هزینه، Llama 3.2 1B Instruct حدود ۱٫۶ برابر ارزانتر تمام میشود.
| ویژگی | ||
|---|---|---|
| تأمینکننده | Meta | Meta |
| شناسهٔ مدل | meta-llama/llama-3.2-1b-instruct | meta-llama/llama-guard-4-12b |
| context | 60,000 توکن | 163,840 توکن |
| حداکثر خروجی | 54,000 توکن | 16,384 توکن |
| ورودی / ۱M توکن | 7,833 تومان | 52,223 تومان |
| خروجی / ۱M توکن | 58,315 تومان | 52,223 تومان |
| ≈ یک درخواست ۱٬۰۰۰ کلمهای | 86 تومان | 136 تومان |
| cache ورودی | ندارد | ندارد |
| ورودی تصویر | ندارد | دارد |
| ورودی فایل | ندارد | ندارد |
| tool calling | ندارد | ندارد |
| خروجی JSON | ندارد | دارد |
| حالت استدلال | ندارد | ندارد |
کدام برای چه کاری؟
تست هر دو با یک کد
فقط model را بین دو شناسه عوض کن و همان درخواست را دو بار بفرست؛ هزینهٔ هر پاسخ در هدر X-Uttapen-Cost-Toman برمیگردد.
curl https://api.uttapen.ir/v1/chat/completions \
-H "Authorization: Bearer sk-up-…" \
-H "Content-Type: application/json" \
-d '{
"model": "meta-llama/llama-3.2-1b-instruct",
"messages": [{"role": "user", "content": "سلام! خودت را معرفی کن."}],
"stream": true
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.uttapen.ir/v1",
api_key="sk-up-…",
)
stream = client.chat.completions.create(
model="meta-llama/llama-3.2-1b-instruct",
messages=[{"role": "user", "content": "سلام! خودت را معرفی کن."}],
stream=True,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="", flush=True)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.uttapen.ir/v1",
apiKey: "sk-up-…",
});
const stream = await client.chat.completions.create({
model: "meta-llama/llama-3.2-1b-instruct",
messages: [{ role: "user", content: "سلام! خودت را معرفی کن." }],
stream: true,
});
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? "");
}<?php
// composer require openai-php/client guzzlehttp/guzzle
$client = OpenAI::factory()
->withBaseUri('https://api.uttapen.ir/v1')
->withApiKey('sk-up-…')
->make();
$result = $client->chat()->create([
'model' => 'meta-llama/llama-3.2-1b-instruct',
'messages' => [['role' => 'user', 'content' => 'سلام! خودت را معرفی کن.']],
]);
echo $result->choices[0]->message->content;package main
import (
"context"
"fmt"
"github.com/openai/openai-go"
"github.com/openai/openai-go/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://api.uttapen.ir/v1"),
option.WithAPIKey("sk-up-…"),
)
resp, err := client.Chat.Completions.New(context.Background(), openai.ChatCompletionNewParams{
Model: "meta-llama/llama-3.2-1b-instruct",
Messages: []openai.ChatCompletionMessageParamUnion{openai.UserMessage("سلام! خودت را معرفی کن.")},
})
if err != nil {
panic(err)
}
fmt.Println(resp.Choices[0].Message.Content)
}model = "meta-llama/llama-guard-4-12b"
مقایسههای دیگر: همهٔ جفتها · رتبهبندی مدلها · فهرست کامل
base_url = https://api.uttapen.ir/v1