پرش به محتوای اصلی
پرش به محتوای مقاله

اشتراک‌های مصرف‌کننده در برابر هزینه‌های سازمانی برای تولید ویدیو با AI

·۲۸ خرداد ۱۴۰۵۸ دقیقه مطالعه۱ بازدید
راهنما
تولید ویدیوی هوش مصنوعی با Veo 3.1 از طریق Google Flow API
تولید ویدیوی هوش مصنوعی با Veo 3.1 از طریق Google Flow API
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر مدل اقتصادی دسترسی به Veo 3.1 از پرداخت به‌ازای هر ثانیه (Enterprise) به اشتراک ماهانه ثابت (Consumer) که منجر به کاهش ۸۷ درصدی هزینه‌ها شده است.

اگر امروز برای Gemini API رسمی هزینه پرداخت می‌کنید، قیمت تولید یک کلیپ ۸ ثانیه‌ای با Veo 3.1 می‌تواند از ۰.۸۰ دلار به رقم بسیار پایین ۰.۱۰ دلار برای هر بار تولید کاهش یابد. این مزیت اصلی استفاده از Google Flow API است که توسط سرویس useapi.net ارائه شده و سیستم پرداخت‌های متغیر (Metered Billing) پروژه‌های گوگل کلاد را دور می‌زند.

تولید ویدیوهای سطح‌بالای گوگل معمولاً در محیط‌های سازمانی Vertex AI یا Gemini API رخ می‌دهد. این پلتفرم‌ها هزینه را بر اساس هر ثانیه خروجی محاسبه می‌کنند. این موضوع برای سازندگانی که روی نماهای پیچیده آزمایش می‌کنند و نیاز به تکرار زیاد دارند، به‌سرعت گران می‌شود. اپلیکیشن مصرف‌کننده Google Flow مدل اشتراکی ارزان‌تری را ارائه می‌دهد، اما مشکل اینجاست که برای توسعه‌دهندگانی که می‌خواهند جریان‌های کاری خود را خودکار کنند، هیچ API عمومی ندارد.

همان‌طور که در تحلیل‌های قبلی ما درباره‌ی مدل‌های مولد ویدیو اشاره کردیم، دسترسی به ابزارهای حرفه‌ای بدون هزینه‌های سرسام‌آور، نقطه عطف پذیرش این فناوری است. به نقل از یک راهنمای فنی که در ۱۸ ژوئن ۲۰۲۶ منتشر شد، سرویس useapi.net این شکاف را پر کرده است. آن‌ها یک نقطه اتصال REST فراهم می‌کنند که مستقیماً یک حساب Google Flow شخصی کاربر را به حرکت در می‌آورد. این بدان معناست که شما مبلغ ثابت ۱۵ دلار در ماه برای دسترسی به API می‌پردازید و سپس از اعتبارات طرح استاندارد گوگل خود برای هر بار تولید ویدیو استفاده می‌کنید. این ساختار نیاز به ایجاد پروژه گوگل کلاد، دریافت تأییدیه‌های سازمانی یا پرداخت‌های متغیر به‌ازای هر درخواست را به‌طور کامل از بین می‌برد.

سطوح مدل و هزینه اعتبار

این سیستم از چندین نسخه Veo 3.1 پشتیبانی می‌کند که هر کدام تعادلی بین سرعت و کیفیت (Fidelity) برقرار کرده‌اند. شما مدل مورد نظر را در هر درخواست از طریق فیلد model انتخاب می‌کنید. مدل veo-3.1-fast به عنوان گزینه پیش‌فرض عمل می‌کند، در حالی که veo-3.1-quality بالاترین کیفیت ممکن را برای کلیپ‌های ۸ ثانیه‌ای فراهم می‌کند. برای کسانی که بودجه محدودی دارند، veo-3.1-lite ارزان‌ترین گزینه موجود است.

هزینه اعتبار بر اساس سطح طرح کاربر (Plan Tier) متفاوت است:

  • Veo 3.1 Fast: ۲۰ اعتبار برای کاربرانی که طرح Ultra ندارند؛ ۱۰ اعتبار برای کاربران Ultra. این مدل از مدت‌زمان‌های ۴، ۶ و ۸ ثانیه پشتیبانی می‌کند.
  • Veo 3.1 Quality: ۱۰۰ اعتبار برای هر بار تولید. این مدل منحصراً برای کلیپ‌های ۸ ثانیه‌ای محدود شده است.
  • Veo 3.1 Lite: ۱۰ اعتبار برای کاربران عادی؛ ۵ اعتبار برای کاربران Ultra. پشتیبانی از مدت‌زمان‌های ۴، ۶ و ۸ ثانیه.
  • Veo 3.1 Lite (اولویت پایین): ۰ اعتبار. این گزینه منحصراً برای مشترکین Google AI Ultra (با هزینه ۱۹۹ دلار در ماه) در دسترس است.

علاوه بر Veo، این API دسترسی به Gemini Omni Flash را فراهم می‌کند؛ یک مدل بومی صوتی (Audio-native) که مدت‌زمان‌های ۴، ۶، ۸ و ۱۰ ثانیه را پشتیبانی می‌کند. هزینه‌های اعتباری آن به ترتیب ۱۵، ۲۰، ۲۵ و ۳۰ واحد است. توجه داشته باشید که تولید کلیپ‌های ۱۰ ثانیه‌ای تنها از طریق مدل omni-flash امکان‌پذیر است.

جزئیات تولید تصویر

سرویس Google Flow همچنین می‌تواند از طریق یک نقطه اتصال مجزا به نام POST /images تصاویر ثابت تولید کند. این API سه مدل خاص را برای این منظور پشتیبانی می‌کند:

  • Imagen 4: برای تولید تصاویر با دقت و کیفیت بسیار بالا.
  • Nano Banana Pro: برای تولید تصاویر ثابت در سطح حرفه‌ای.
  • Nano Banana: برای تولید تصاویر استاندارد.

برخلاف مدل‌های ویدیویی، تولید تصویر در هر یک از طرح‌های گوگل AI گنجانده شده است. بنابراین، به‌جز اشتراک ثابت ماهانه useapi.net، هیچ هزینه اعتباری اضافی برای تولید تصویر پرداخت نمی‌کنید.

گردش کار دو مرحله‌ای

تولید ویدیو یک فرآیند ناهمگام (Asynchronous) است. شما نمی‌توانید صرفاً یک فایل را درخواست کنید و آن را فوراً دریافت نمایید؛ در عوض، باید از یک مکانیزم نظارتی (Polling) دو مرحله‌ای پیروی کنید. برای شروع، به یک توکن API از useapi.net و یک حساب متصل به Google Flow نیاز دارید.

اول، یک درخواست POST به آدرس https://api.useapi.net/v1/google-flow/videos می‌فرستید. در این مرحله، پرامپت، مدل، نسبت ابعاد (Aspect Ratio) و مدت‌زمان را تعریف می‌کنید. اگر مقدار async: true را قرار دهید، API بلافاصله یک پاسخ ۲-۰-۱ (Created) را همراه با یک jobid با حروف کوچک و وضعیتی به نام "created" برمی‌گرداند.

مثال درخواست:
curl -X POST "https://api.useapi.net/v1/google-flow/videos" -H "Authorization: Bearer $USEAPI_TOKEN" -H "Content-Type: application/json" -d '{ "prompt": "A serene mountain landscape at sunset, camera slowly panning right", "model": "veo-3.1-fast", "aspectRatio": "landscape", "duration": 8, "async": true }'

دوم، نقطه اتصال GET https://api.useapi.net/v1/google-flow/jobs/{jobId} را بررسی (Poll) می‌کنید. وضعیت درخواست از سه مرحله عبور می‌کند: created $\rightarrow$ started $\rightarrow$ completed. پس از رسیدن به وضعیت تکمیل شده، پاسخ شامل یک videoUrl امضا شده در آرایه response.media[] و مقدار remainingCredits (اعتبارات باقی‌مانده) حساب شما خواهد بود.

ویدیوهای Veo 3.1 معمولاً بسته به مدل و حالت انتخابی، بین ۶۰ تا ۱۸۰ ثانیه آماده می‌شوند. لینک videoUrl امضا شده حدود ۲۴ ساعت اعتبار دارد، بنابراین فایل‌ها باید سریعاً دانلود شوند. برای کسانی که ترجیح می‌دهند عملیات نظارتی را انجام ندهند، می‌توان یک replyUrl در بدنه درخواست ایجاد ارسال کرد تا پس از اتمام کار، یک وب‌هوک (Webhook) دریافت کنند.

منطق پیشرفته تصویر-به-ویدیو (I2V) و مرجع (R2V)

مدل Veo 3.1 دو روش متمایز برای استفاده از تصاویر به عنوان راهنمای تولید ویدیو دارد. هر دو روش نیازمند این هستند که ابتدا تصویر را از طریق نقطه اتصال POST /assets/email آپلود کنید. شما باید بایت‌های خام تصویر را با Content-Type مناسب (PNG، JPEG یا WebP) و حجم حداکثر ۲۰ مگابایت ارسال کنید. پاسخ سرور، شناسه مورد نیاز را در مسیر mediaGenerationId.mediaGenerationId قرار می‌دهد.

تصویر-به-ویدیو (I2V)

  • startImage: این شناسه را ارسال کنید تا تصویر آپلود شده شما دقیقاً به عنوان اولین فریم کلیپ قرار گیرد.
  • endImage: یک شناسه مرجع دوم را برای تثبیت فریم پایانی ارسال کنید. در این حالت، Veo انتقال (Transition) بین این دو تصویر را تولید می‌کند. توجه داشته باشید که endImage حتماً به وجود startImage نیاز دارد؛ تولید ویدیو تنها با فریم پایانی پشتیبانی نمی‌شود.
  • Omni-Flash: در این مدل، تنها startImage پذیرفته می‌شود.

مرجع-به-ویدیو (R2V)

  • تصاویر مرجع: از referenceImage_1 تا referenceImage_3 استفاده کنید. Veo تا ۳ تصویر مرجع را می‌پذیرد، اما این قابلیت فقط برای کلیپ‌های ۸ ثانیه‌ای فعال است و در مدل veo-3.1-quality پشتیبانی نمی‌شود.
  • منطق: این تصاویر به جای اینکه به عنوان یک فریم خاص عمل کنند، سوژه، شخصیت یا استایل کلی ویدیو را هدایت می‌کنند. روش R2V را نمی‌توان با startImage یا endImage ترکیب کرد.
  • کنترل‌های پیشرفته: شما می‌توانید با استفاده از نشانگرهای @referenceImage_N در متن پرامپت، به مراجع اشاره کنید. همچنین امکان افزودن referenceAudio_1 (با استفاده از نام‌های صوتی سیستم مانند "Zephyr") برای روایتگری، یا ارسال یک شخصیت تکرارپذیر از طریق character_1 وجود دارد.

اتوماسیون و دسته‌بندی

از آنجا که رسیدن به یک نمای ایده‌آل در هوش مصنوعی اغلب نیاز به ده‌ها تلاش دارد، useapi.net یک اسکریپت Node.js (نسخه ۲۱ به بالا) را از طریق گیت‌هاب ارائه داده است. این ابزار یک فایل prompts.json را می‌خواند و تمام مراحل آپلود، ارسال درخواست و نظارت بر کلیپ‌های متعدد را به‌طور خودکار مدیریت می‌کند. این اسکریپت ابتدا حساب را از طریق ایمیل شناسایی کرده و فیلد health را پیش از ارسال بررسی می‌کند.

برای اجرای محلی این اسکریپت، از دستور node ./google-flow.mjs API_TOKEN EMAIL استفاده کنید. کد منبع کامل و فایل‌های نمونه پرامپت در مخزن useapi/google-flow-api در گیت‌هاب در دسترس هستند.

یک چالش فنی در این اتوماسیون، سیستم reCAPTCHA مورد نیاز گوگل Flow است. کارگرهای (Worker) سرویس useapi.net این کپچاهای گوگل را به‌طور خودکار حل می‌کنند. حساب‌های جدید یک grant یک‌باره شامل ۱۰۰ اعتبار رایگان کپچا (توسط CapSolver) دریافت می‌کنند. پس از اتمام این اعتبار، کاربران می‌توانند کلیدهای ارائه‌دهنده کپچای خود را از طریق نقطه اتصال POST /accounts/captcha-providers تنظیم کنند.

تحلیل مقایسه‌ای قیمت‌ها

بر اساس بررسی منابع متعدد، شکاف قیمتی بین Gemini API رسمی و طرح‌های Flow Pro و Ultra از طریق useapi.net برای کلیپ‌های ۸ ثانیه‌ای بسیار چشم‌گیر است:

  • Veo 3.1 Fast: ۰.۸۰ دلار (رسمی) در برابر ~۰.۴۰ دلار (Flow Pro) و ~۰.۱۰ دلار (Flow Ultra).
  • Veo 3.1 Quality: ۳.۲۰ دلار (رسمی) در برابر ~۲.۰۰ دلار (Flow Pro) و ~۱.۰۰ دلار (Flow Ultra).
  • Veo 3.1 Lite: ۰.۴۰ دلار (رسمی) در برابر ~۰.۲۰ دلار (Flow Pro) و ~۰.۰۵ دلار (Flow Ultra).
  • Gemini Omni Flash: در API رسمی موجود نیست (فقط Flow)؛ هزینه ~۰.۵۰ دلار (Pro) و ~۰.۲۵ دلار (Ultra).
  • Nano Banana / Imagen 4: در API رسمی دارای هزینه متغیر است، اما در اشتراک ثابت useapi.net گنجانده شده است.

برای کاربران طرح ۱۹۹ دلاری Ultra، صف «اولویت پایین» برای Veo 3.1 Lite امکان تولید به‌طور متوسط ۱۰۰۰ ویدیو رایگان در روز را فراهم می‌کند. به همین ترتیب، تصاویر تولید شده توسط Nano Banana، Nano Banana Pro و Imagen 4 می‌توانند به‌طور متوسط تا ۵۰۰ تولید در روز داشته باشند. این اعداد میانگین استخراج شده از شلوغ‌ترین حساب‌های واقعی هستند و تضمین‌شده نیستند، زیرا گوگل سهمیه‌ها را بر اساس میزان تقاضا تغییر می‌دهد.

این تغییر در نحوه دسترسی به این معناست که سازندگان با حجم تولید بالا دیگر نیازی به پروژه‌های پیچیده گوگل کلاد یا تأییدیه‌های سازمانی برای مقیاس‌بندی تولیدات خود ندارند. با بهره‌گیری از یک اشتراک مصرف‌کننده از طریق API شخص ثالث، سد مالی برای تولید ویدیوهای باکیفیت به‌شدت پایین آمده است.

برای توسعه‌دهندگان، این یعنی امکان ساخت اپلیکیشن‌هایی که ویدیوهای باکیفیت تولید می‌کنند، بدون ریسک صورت‌حساب‌های غیرقابل‌پیش‌بینی بر اساس ثانیه. حرکت به سمت دسترسی‌های API با نرخ ثابت برای مدل‌های مصرف‌کننده، نشان‌دهنده روند رشد «APIهای پل» است که مدل‌های سطح سازمانی را برای توسعه‌دهندگان مستقل دموکراتیزه می‌کنند.

برای شروع پیاده‌سازی، می‌توانید مخزن رسمی useapi/google-flow-api را در گیت‌هاب کلون کرده و حساب Google Flow خود را با استفاده از یک توکن API متصل کنید. برای پشتیبانی بیشتر، کاربران می‌توانند از سرور دیسکورد رسمی، کانال تلگرام یا کانال یوتیوب برای مشاهده آموزش‌ها بازدید کنند.

گام بعدی شما

  • مخزن useapi/google-flow-api را در گیت‌هاب کلون کنید تا اتوماسیون تولید ویدیو را آغاز کنید.
  • اگر از طرح Ultra استفاده می‌کنید، مدل veo-3.1-lite را در حالت اولویت پایین تست کنید تا هزینه تولید را به صفر برسانید.
  • برای یادگیری نحوه ترکیب تصاویر مرجع (R2V) با پرامپت‌ها، آموزش‌های کانال یوتیوب useapi را دنبال کنید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این تحول با تکیه بر اعتبار زیرساخت‌های گوگل و واسطه‌های API، سد مالی ورود سازندگان مستقل به دنیای ویدیوی AI را می‌شکند. نتیجه آن، افزایش حجم تولید محتوای سینمایی با هزینه بسیار کمتر و حذف پیچیدگی‌های مدیریتی GCP است.

تأثیر برای ایران

به‌دلیل محدودیت‌های API گوگل و تحریم‌ها، دسترسی مستقیم به این سرویس برای توسعه‌دهندگان ایرانی دشوار است؛ اما استفاده از واسطه‌هایی مثل useapi.net می‌تواند مسیر جایگزینی برای کاهش هزینه‌های ارزی تولید محتوا باشد.

·نگاه ما
تحریریه دات‌هوش

جایگزینی مدل پرداخت metered با subscription در لایه API، نشان‌دهنده یک چرخش در استراتژی توزیع مدل‌های سنگین است. این رویکرد عملاً «هزینه حاشیه» را برای توسعه‌دهنده حذف می‌کند و اجازه می‌دهد ابزارهای تولید محتوا بدون ترس از هزینه‌های پیش‌بینی‌نشده، مقیاس‌پذیر شوند. به نظر ما، این مدل احتمالاً به استاندارد جدیدی برای دسترسی به مدل‌های گران‌قیمت تبدیل خواهد شد تا نرخ پذیرش در سطح خرد افزایش یابد.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.