لوگوی کاپای

→ بازگشت به فهرست مدل‌ها

نشان Qwen

Qwen3-Embedding 4B

⁦Qwen⁩ · ⁦qwen3-embedding-4b⁩

Qwen3-Embedding 4B، مدل امبدینگ برای جست‌وجوی معنایی، خوشه‌بندی و بازیابی اسناد است؛ پنجرهٔ متن آن 32 هزار توکن است.

⁦32K⁩ توکنمتن ← متننوع ورودی/خروجی

قیمت شروع

۰

به ازای هر یک میلیون توکن

نحوهٔ پرداخت

بر اساس مصرف

وضعیت سرویس

فعال

سال انتشار

2025

معرفی Qwen3-Embedding 4B

Qwen3-Embedding 4B، مدل امبدینگ برای جست‌وجوی معنایی، خوشه‌بندی و بازیابی اسناد است؛ پنجرهٔ متن آن 32 هزار توکن است.

قیمت‌گذاری Qwen3-Embedding 4B

ورودی

۰

خروجی

۰

کش (خواندن)

۰

کش (نوشتن)

۰

مانند ورودی

شناسهٔ مدل

qwen3-embedding-4b

ارائه‌دهنده

Qwen

حداکثر طول متن

32K

ورودی‌ها

متن

خروجی‌ها

متن

وضعیت

فعال

سال انتشار

2025

اشتراک‌گذاری مدل

https://cupai.ir/models/qwen3-embedding-4b

کد نمونه و API برای Qwen3-Embedding 4B

نشانی پایه را به کاپ‌ای‌آی تغییر دهید و کلید API خود را قرار دهید؛ بقیهٔ درخواست با کلاینت‌های سازگار بدون تغییر باقی می‌ماند.

curl 'https://api.cupai.ir/v1/embeddings' \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer $CUPAI_API_KEY' \
  -d '{
    "model": "qwen3-embedding-4b",
    "input": "Hello!"
  }'

به‌جای CUPAI_API_KEY کلید خودتان را بگذارید.

ساخت کلید API

قابلیت‌ها

قابلیت‌های پشتیبانی‌شده توسط API این مدل.

text-to-text

پرسش‌های پرتکرار دربارهٔ Qwen3-Embedding 4B

هزینهٔ استفاده از Qwen3-Embedding 4B چطور محاسبه می‌شود؟
بر اساس تعداد توکن‌های ورودی و خروجی هر درخواست. نرخ هر بخش در جدول قیمت همین صفحه آمده و مبلغ آن از کیف پول شما کسر می‌شود.
چطور به Qwen3-Embedding 4B متصل شوم؟
نشانی پایه را به کاپ‌ای‌آی تغییر دهید، کلید API خود را در سربرگ درخواست قرار دهید و شناسهٔ مدل را در بدنهٔ درخواست بفرستید. نمونهٔ کد آماده در همین صفحه آمده است.
پرداخت به چه صورتی انجام می‌شود؟
پرداخت‌ها ریالی است و نیازی به کارت اعتباری خارجی ندارید. اعتبار خریداری‌شده روی همهٔ مدل‌های در دسترس قابل استفاده است.

مدل‌های دیگر

قیمت‌گذاری مدل‌ها چطور کار می‌کند؟

هر مدل هوش مصنوعی ترکیب متفاوتی از سرعت، کیفیت پاسخ و هزینه دارد. مدل‌های پرچم‌دار برای استدلال پیچیده، تحلیل متن‌های طولانی و کدنویسی دقیق‌تر مناسب‌اند، در حالی که مدل‌های سبک‌تر برای خلاصه‌سازی، دسته‌بندی و پاسخ‌های کوتاه هزینهٔ به‌مراتب کمتری دارند. در فهرست بالا نرخ هر مدل به تفکیک توکن ورودی، توکن خروجی و کش آمده است تا بتوانید پیش از شروع، هزینهٔ تقریبی کار خود را برآورد کنید.

توکن کوچک‌ترین واحد متنی است که مدل پردازش می‌کند و به‌طور تقریبی هر هزار توکن معادل ۷۵۰ واژهٔ انگلیسی یا حدود ۵۰۰ واژهٔ فارسی است. هزینهٔ هر درخواست از جمع توکن‌های ورودی و خروجی به دست می‌آید، بنابراین کوتاه‌کردن دستور و محدودکردن طول پاسخ مستقیماً هزینه را کاهش می‌دهد. برخی مدل‌ها ردهٔ قیمتی دومی برای متن‌های بسیار بلند دارند که با عبور از آستانهٔ مشخص، کل درخواست را با نرخ آن رده حساب می‌کند.