لوگوی کاپای

→ بازگشت به فهرست مدل‌ها

نشان OpenAI

GPT-4o Transcribe

⁦OpenAI⁩ · ⁦gpt-4o-transcribe⁩

GPT-4o Transcribe، مدل تبدیل گفتار به متن از OpenAI برای رونویسی و زیرنویس‌گذاری فایل‌های صوتی است.

⁦16K⁩ توکنمتن،‏ صوت ← متننوع ورودی/خروجی

قیمت شروع

۰

به ازای هر یک میلیون توکن

نحوهٔ پرداخت

بر اساس مصرف

وضعیت سرویس

فعال

سال انتشار

2025

معرفی GPT-4o Transcribe

GPT-4o Transcribe، مدل تبدیل گفتار به متن از OpenAI برای رونویسی و زیرنویس‌گذاری فایل‌های صوتی است.

قیمت‌گذاری GPT-4o Transcribe

ورودی

۰

خروجی

۰

کش (خواندن)

۰

کش (نوشتن)

۰

مانند ورودی

شناسهٔ مدل

gpt-4o-transcribe

ارائه‌دهنده

OpenAI

حداکثر طول متن

16K

حداکثر توکن خروجی

2,000

ورودی‌ها

متن،‏ صوت

خروجی‌ها

متن

وضعیت

فعال

سال انتشار

2025

اشتراک‌گذاری مدل

https://cupai.ir/models/gpt-4o-transcribe

کد نمونه و API برای GPT-4o Transcribe

نشانی پایه را به کاپ‌ای‌آی تغییر دهید و کلید API خود را قرار دهید؛ بقیهٔ درخواست با کلاینت‌های سازگار بدون تغییر باقی می‌ماند.

curl 'https://api.cupai.ir/v1/audio/transcriptions' \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer $CUPAI_API_KEY' \
  -d '{
    "model": "gpt-4o-transcribe",
    "messages": [
      {
        "role": "user",
        "content": "Hello!"
      }
    ]
  }'

به‌جای CUPAI_API_KEY کلید خودتان را بگذارید.

ساخت کلید API

قابلیت‌ها

قابلیت‌های پشتیبانی‌شده توسط API این مدل.

text-to-text

audio-to-text

پرسش‌های پرتکرار دربارهٔ GPT-4o Transcribe

هزینهٔ استفاده از GPT-4o Transcribe چطور محاسبه می‌شود؟
بر اساس تعداد توکن‌های ورودی و خروجی هر درخواست. نرخ هر بخش در جدول قیمت همین صفحه آمده و مبلغ آن از کیف پول شما کسر می‌شود.
چطور به GPT-4o Transcribe متصل شوم؟
نشانی پایه را به کاپ‌ای‌آی تغییر دهید، کلید API خود را در سربرگ درخواست قرار دهید و شناسهٔ مدل را در بدنهٔ درخواست بفرستید. نمونهٔ کد آماده در همین صفحه آمده است.
پرداخت به چه صورتی انجام می‌شود؟
پرداخت‌ها ریالی است و نیازی به کارت اعتباری خارجی ندارید. اعتبار خریداری‌شده روی همهٔ مدل‌های در دسترس قابل استفاده است.

مدل‌های دیگر

قیمت‌گذاری مدل‌ها چطور کار می‌کند؟

هر مدل هوش مصنوعی ترکیب متفاوتی از سرعت، کیفیت پاسخ و هزینه دارد. مدل‌های پرچم‌دار برای استدلال پیچیده، تحلیل متن‌های طولانی و کدنویسی دقیق‌تر مناسب‌اند، در حالی که مدل‌های سبک‌تر برای خلاصه‌سازی، دسته‌بندی و پاسخ‌های کوتاه هزینهٔ به‌مراتب کمتری دارند. در فهرست بالا نرخ هر مدل به تفکیک توکن ورودی، توکن خروجی و کش آمده است تا بتوانید پیش از شروع، هزینهٔ تقریبی کار خود را برآورد کنید.

توکن کوچک‌ترین واحد متنی است که مدل پردازش می‌کند و به‌طور تقریبی هر هزار توکن معادل ۷۵۰ واژهٔ انگلیسی یا حدود ۵۰۰ واژهٔ فارسی است. هزینهٔ هر درخواست از جمع توکن‌های ورودی و خروجی به دست می‌آید، بنابراین کوتاه‌کردن دستور و محدودکردن طول پاسخ مستقیماً هزینه را کاهش می‌دهد. برخی مدل‌ها ردهٔ قیمتی دومی برای متن‌های بسیار بلند دارند که با عبور از آستانهٔ مشخص، کل درخواست را با نرخ آن رده حساب می‌کند.