لوگوی کاپای

→ بازگشت به فهرست مدل‌ها

نشان Google DeepMind

Gemini Omni Video

⁦Google DeepMind⁩ · ⁦gemini-omni-video⁩

Gemini Omni Video، مدل تولید ویدیو از گوگل دیپ‌مایند برای ساخت کلیپ کوتاه از روی پرامپت است.

متن،‏ تصویر،‏ صوت، و ویدیو ← صوت،‏ ویدیونوع ورودی/خروجی

قیمت هر کلیپ

۱۲۷٬۰۵۰ – ۳۱۷٬۶۲۵

به ازای هر ویدیو

نحوهٔ پرداخت

بر اساس مصرف

وضعیت سرویس

فعال

سال انتشار

2026

معرفی Gemini Omni Video

Gemini Omni Video، مدل تولید ویدیو از گوگل دیپ‌مایند برای ساخت کلیپ کوتاه از روی پرامپت است.

قیمت‌گذاری Gemini Omni Video

از ⁦۱۲۷٬۰۵۰⁩ تا ⁦۳۱۷٬۶۲۵⁩ برای هر کلیپ

کیفیتپایهبا ویدیوی مرجع

720p

۴ ثانیه

۱۲۸٬۰۰۰

—

720p

۶ ثانیه

۱۹۱٬۰۰۰

—

720p

۸ ثانیه

۲۵۵٬۰۰۰

—

720p

۱۰ ثانیه

۳۱۸٬۰۰۰

—

به ازای هر ویدیو

نرخ برخی ردیف‌های این جدول هنوز تنظیم نشده و با «—» نمایش داده می‌شود.

  • فقط این مدت‌ها پذیرفته می‌شوند: 4، 6، 8، 10 ثانیه (پیش‌فرض 6 ثانیه).
  • این مدل به ازای هر ویدیو قیمت‌گذاری می‌شود، نه به ازای هر ثانیه؛ هر سطر هزینهٔ کامل یک تولید با آن کیفیت و مدت است.
  • تصاویر مرجع، صداها و شخصیت‌ها هزینهٔ تولید ویدیو را تغییر نمی‌دهند.

شناسهٔ مدل

gemini-omni-video

ارائه‌دهنده

Google DeepMind

ورودی‌ها

متن،‏ تصویر،‏ صوت، و ویدیو

خروجی‌ها

صوت،‏ ویدیو

مبنای محاسبه

هر ویدیوی تولیدشده

وضعیت

فعال

سال انتشار

2026

اشتراک‌گذاری مدل

https://cupai.ir/models/gemini-omni-video

کد نمونه و API برای Gemini Omni Video

نشانی پایه را به کاپ‌ای‌آی تغییر دهید و کلید API خود را قرار دهید؛ بقیهٔ درخواست با کلاینت‌های سازگار بدون تغییر باقی می‌ماند.

curl 'https://api.cupai.ir/v1/video-generate' \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer $CUPAI_API_KEY' \
  -d '{
    "model": "gemini-omni-video",
    "prompt": "a calm seaside at dawn",
    "resolution": "720p",
    "duration": 6
  }'

به‌جای CUPAI_API_KEY کلید خودتان را بگذارید.

ساخت کلید API

قابلیت‌ها

قابلیت‌های پشتیبانی‌شده توسط API این مدل.

text-to-audio

text-to-video

image-to-audio

image-to-video

audio-to-audio

audio-to-video

video-to-audio

video-to-video

پرسش‌های پرتکرار دربارهٔ Gemini Omni Video

هزینهٔ استفاده از Gemini Omni Video چطور محاسبه می‌شود؟
این مدل به ازای هر ویدیوی تولیدشده محاسبه می‌شود، نه به ازای ثانیه یا توکن. هزینهٔ کامل هر تولید به کیفیت و مدت انتخابی بستگی دارد و در جدول نرخ همین صفحه آمده است.
چطور به Gemini Omni Video متصل شوم؟
نشانی پایه را به کاپ‌ای‌آی تغییر دهید، کلید API خود را در سربرگ درخواست قرار دهید و شناسهٔ مدل را در بدنهٔ درخواست بفرستید. نمونهٔ کد آماده در همین صفحه آمده است.
پرداخت به چه صورتی انجام می‌شود؟
پرداخت‌ها ریالی است و نیازی به کارت اعتباری خارجی ندارید. اعتبار خریداری‌شده روی همهٔ مدل‌های در دسترس قابل استفاده است.

مدل‌های دیگر

قیمت‌گذاری مدل‌ها چطور کار می‌کند؟

هر مدل هوش مصنوعی ترکیب متفاوتی از سرعت، کیفیت پاسخ و هزینه دارد. مدل‌های پرچم‌دار برای استدلال پیچیده، تحلیل متن‌های طولانی و کدنویسی دقیق‌تر مناسب‌اند، در حالی که مدل‌های سبک‌تر برای خلاصه‌سازی، دسته‌بندی و پاسخ‌های کوتاه هزینهٔ به‌مراتب کمتری دارند. در فهرست بالا نرخ هر مدل به تفکیک توکن ورودی، توکن خروجی و کش آمده است تا بتوانید پیش از شروع، هزینهٔ تقریبی کار خود را برآورد کنید.

توکن کوچک‌ترین واحد متنی است که مدل پردازش می‌کند و به‌طور تقریبی هر هزار توکن معادل ۷۵۰ واژهٔ انگلیسی یا حدود ۵۰۰ واژهٔ فارسی است. هزینهٔ هر درخواست از جمع توکن‌های ورودی و خروجی به دست می‌آید، بنابراین کوتاه‌کردن دستور و محدودکردن طول پاسخ مستقیماً هزینه را کاهش می‌دهد. برخی مدل‌ها ردهٔ قیمتی دومی برای متن‌های بسیار بلند دارند که با عبور از آستانهٔ مشخص، کل درخواست را با نرخ آن رده حساب می‌کند.