
→ بازگشت به فهرست مدلها

Qwen3-Embedding 4B
Qwen · qwen3-embedding-4b
Qwen3-Embedding 4B، مدل امبدینگ برای جستوجوی معنایی، خوشهبندی و بازیابی اسناد است؛ پنجرهٔ متن آن 32 هزار توکن است.
قیمت شروع
۰
به ازای هر یک میلیون توکن
نحوهٔ پرداخت
بر اساس مصرف
وضعیت سرویس
فعال
سال انتشار
2025
معرفی Qwen3-Embedding 4B
Qwen3-Embedding 4B، مدل امبدینگ برای جستوجوی معنایی، خوشهبندی و بازیابی اسناد است؛ پنجرهٔ متن آن 32 هزار توکن است.
قیمتگذاری Qwen3-Embedding 4B
ورودی
۰
خروجی
۰
کش (خواندن)
۰
کش (نوشتن)
۰
مانند ورودی
شناسهٔ مدل
ارائهدهنده
حداکثر طول متن
ورودیها
خروجیها
وضعیت
سال انتشار
اشتراکگذاری مدل
کد نمونه و API برای Qwen3-Embedding 4B
نشانی پایه را به کاپایآی تغییر دهید و کلید API خود را قرار دهید؛ بقیهٔ درخواست با کلاینتهای سازگار بدون تغییر باقی میماند.
curl 'https://api.cupai.ir/v1/embeddings' \
-H 'Content-Type: application/json' \
-H 'Authorization: Bearer $CUPAI_API_KEY' \
-d '{
"model": "qwen3-embedding-4b",
"input": "Hello!"
}'بهجای CUPAI_API_KEY کلید خودتان را بگذارید.
ساخت کلید API
قابلیتها
قابلیتهای پشتیبانیشده توسط API این مدل.
text-to-text
پرسشهای پرتکرار دربارهٔ Qwen3-Embedding 4B
- هزینهٔ استفاده از Qwen3-Embedding 4B چطور محاسبه میشود؟
- بر اساس تعداد توکنهای ورودی و خروجی هر درخواست. نرخ هر بخش در جدول قیمت همین صفحه آمده و مبلغ آن از کیف پول شما کسر میشود.
- چطور به Qwen3-Embedding 4B متصل شوم؟
- نشانی پایه را به کاپایآی تغییر دهید، کلید API خود را در سربرگ درخواست قرار دهید و شناسهٔ مدل را در بدنهٔ درخواست بفرستید. نمونهٔ کد آماده در همین صفحه آمده است.
- پرداخت به چه صورتی انجام میشود؟
- پرداختها ریالی است و نیازی به کارت اعتباری خارجی ندارید. اعتبار خریداریشده روی همهٔ مدلهای در دسترس قابل استفاده است.
مدلهای دیگر
قیمتگذاری مدلها چطور کار میکند؟
هر مدل هوش مصنوعی ترکیب متفاوتی از سرعت، کیفیت پاسخ و هزینه دارد. مدلهای پرچمدار برای استدلال پیچیده، تحلیل متنهای طولانی و کدنویسی دقیقتر مناسباند، در حالی که مدلهای سبکتر برای خلاصهسازی، دستهبندی و پاسخهای کوتاه هزینهٔ بهمراتب کمتری دارند. در فهرست بالا نرخ هر مدل به تفکیک توکن ورودی، توکن خروجی و کش آمده است تا بتوانید پیش از شروع، هزینهٔ تقریبی کار خود را برآورد کنید.
توکن کوچکترین واحد متنی است که مدل پردازش میکند و بهطور تقریبی هر هزار توکن معادل ۷۵۰ واژهٔ انگلیسی یا حدود ۵۰۰ واژهٔ فارسی است. هزینهٔ هر درخواست از جمع توکنهای ورودی و خروجی به دست میآید، بنابراین کوتاهکردن دستور و محدودکردن طول پاسخ مستقیماً هزینه را کاهش میدهد. برخی مدلها ردهٔ قیمتی دومی برای متنهای بسیار بلند دارند که با عبور از آستانهٔ مشخص، کل درخواست را با نرخ آن رده حساب میکند.