پرش به محتوا

قیمت‌گذاری و صورتحساب

اعتبار دلاری حساب و شارژ آن از ۵۰ هزار سکه، نرخ روز هر دلار اعتبار، مالیات بر ارزش افزوده، این‌که هزینهٔ هر درخواست چطور حساب می‌شود و چرا درخواست ناموفق هزینه ندارد.

بازبینی: ۸ مهر ۱۴۰۵ ۵ دقیقه مطالعه

وب‌سرویس گیسو اشتراک ماهانه ندارد: حساب را شارژ می‌کنید و هزینهٔ هر درخواست، به‌اندازهٔ مصرف واقعی همان درخواست، از اعتبارتان کم می‌شود. ماهی که از API استفاده نکنید، چیزی کم نمی‌شود. این صفحه می‌گوید اعتبار چطور شارژ می‌شود و هزینهٔ هر درخواست دقیقاً چطور حساب می‌شود.

اعتبار دلاری#

  • قیمت مدل‌ها را سرویس‌دهنده‌ها به دلار تعیین می‌کنند، پس اعتبار حساب هم به دلار نگه داشته می‌شود و هزینهٔ هر درخواست به دلار کم می‌شود. موجودی را در اپ یا با GET /me ببینید.
  • شارژ از ۵۰,۰۰۰ سکه شروع می‌شود. نرخ امروز هر یک دلار اعتبار ۲۵۷,۹۰۰ سکه است و مبلغ شارژ با همین نرخ به دلار تبدیل می‌شود.
  • مالیات بر ارزش افزوده (۹٪) هنگام پرداخت روی مبلغ اضافه می‌شود و در صفحهٔ پرداخت، پیش از تأیید، جدا نشان داده می‌شود.
  • اعتبار API همان اعتبار حساب شما در گیسو و نِت اَرز است؛ استودیو و وب‌سرویس هر دو از همین اعتبار کم می‌کنند.

شارژ حساب#

  1. بخش اعتبار اپ را باز کنید

    در gisoo.pro/app/credit مبلغ را انتخاب کنید.

  2. پرداخت در صفحهٔ نِت اَرز

    گیسو برند هوش مصنوعی نِت اَرز است و فروشنده هم نِت اَرز؛ پس پرداخت را، چه با درگاه بانکی و چه از کیف پول، در صفحهٔ پرداخت نِت اَرز و با همان حساب انجام می‌دهید. رسید و پیامک پرداخت هم به نام نِت اَرز است.

  3. برگشت به گیسو

    بعد از پرداخت به اپ گیسو برمی‌گردید و اعتبار در حسابتان است.

هزینهٔ هر درخواست#

قیمت عمومی هر مدل در GET /models (فیلد pricing) منتشر شده است و صورتحساب دقیقاً با همین قیمت‌ها حساب می‌شود. بعد از هر درخواست، مصرفی که سرویس‌دهنده گزارش کرده در قیمت ضرب و از اعتبار کم می‌شود:

نوع مدلواحد قیمتاز کجای پاسخ
متن و گفت‌وگویک میلیون توکن ورودی و یک میلیون توکن خروجی، جداusage.prompt_tokens, usage.completion_tokens
امبدینگیک میلیون توکن ورودیusage.prompt_tokens
ساخت تصویر (GPT Image)توکن ورودی و توکن تصویر خروجیusage
گفتار به متندقیقهٔ صوت (Whisper) یا توکن (سری GPT Transcribe)مدت فایل / usage
متن به گفتاریک میلیون نویسهطول input
ویدیوثانیهٔ ویدیو، با ضریب اندازهٔ قابseconds, size
موسیقیهر قطعه—

یک نمونهٔ حساب‌شده#

یک پیام معمولی با gpt-4o-mini: ۱,۵۰۰ توکن ورودی و ۵۰۰ توکن خروجی. قیمت ورودی $0.21 و قیمت خروجی $0.84 برای هر یک میلیون توکن است، پس:

1,500 × $0.21 / 1M  +  500 × $0.84 / 1M  =  $0.000735

یعنی با نرخ امروز حدود ۱۹۰ سکه برای این پیام. کمترین شارژ (۵۰,۰۰۰ سکه) با همین مدل برای حدود ۲۶۳ پیام از این دست کافی است.

جزئیاتی که روی صورتحساب اثر دارند#

  • توکن کش‌شده: وقتی ابتدای درخواست‌هایتان تکراری است (مثلاً یک پیام system بلند)، سازنده‌هایی مثل OpenAI آن بخش را کش می‌کنند. توکن کش‌شده در prompt_tokens_details.cached_tokens می‌آید و با قیمت ارزان‌تر cached_input_per_million حساب می‌شود.
  • توکن فکر کردن: در مدل‌های استدلالی جزو خروجی است و در reasoning_tokens جدا دیده می‌شود.
  • ورودی بلند: چند مدل برای ورودی بیشتر از یک آستانه (مثلاً ۲۷۲ هزار توکن) قیمت بالاتری دارند؛ این قیمت‌ها با پسوند _long در pricing همان مدل آمده‌اند.
  • ابزارهای داخلی Responses API: هر بار جست‌وجوی وب یا اجرای کد جدا حساب می‌شود (جدول قیمت).
  • گرد کردن: هزینه را تا یک‌میلیونیم دلار حساب می‌کنیم و فقط در همین مقیاس به بالا گرد می‌کنیم.
JSON usage در پاسخ
"usage": {
  "prompt_tokens": 1500,
  "completion_tokens": 500,
  "total_tokens": 2000,
  "prompt_tokens_details": { "cached_tokens": 1024 },
  "completion_tokens_details": { "reasoning_tokens": 0 }
}

مبلغی که پیش از درخواست کنار گذاشته می‌شود#

پیش از فرستادن هر درخواست به سرویس‌دهنده، گیسو بیشترین هزینهٔ احتمالی آن را برآورد و از موجودی کنار می‌گذارد. بعد از پاسخ، فقط هزینهٔ واقعی کم می‌شود و بقیه برمی‌گردد. به همین دلیل اگر موجودی از برآورد کمتر باشد، درخواست با 402 insufficient_credit رد می‌شود، حتی اگر هزینهٔ واقعی‌اش کمتر می‌شد.

  • برآورد خروجی از max_tokens می‌آید. اگر نفرستید، ۴,۰۹۶ توکن فرض می‌شود؛ با یک سقف واقعی، مبلغ کمتری کنار گذاشته می‌شود.
  • چند درخواست همزمان، هر کدام برآورد خودشان را کنار می‌گذارند.
  • اگر هزینهٔ واقعی کمی از برآورد بیشتر شود، موجودی ممکن است کمی منفی شود؛ آن‌وقت درخواست بعدی تا شارژ حساب رد می‌شود.

چه چیزهایی هزینه ندارد#

  • درخواستی که سرویس‌دهندهٔ مدل پیش از تولید پاسخ با خطا تمام کند؛ مبلغ کنارگذاشته کامل برمی‌گردد.
  • خطاهای کلید، اعتبار، محدودیت و درخواست نادرست؛ این‌ها اصلاً به سرویس‌دهنده نمی‌رسند.
  • ویدیویی که ساخته نشود (برگشت خودکار).
  • GET /models، GET /me، GET /usage و GET /requests/{id}.
وقتی سرویس‌دهنده مصرف را گزارش نکند

گاهی سرویس‌دهنده، مثلاً در پاسخ جریانی که وسطش قطع شده، تعداد توکن را گزارش نمی‌کند. آن‌وقت مصرف از روی طول متن ورودی و خروجی برآورد می‌شود و درخواست در گزارش‌ها «برآوردی» علامت می‌خورد.

اعلان‌ها#

  • وقتی موجودی بعد از یک درخواست به زیر یک دلار برسد، اعلان «اعتبار رو به پایان» می‌گیرید.
  • وقتی درخواستی برای کمبود اعتبار یا پر شدن سقف یک کلید یا پروژه رد شود، اعلانش را می‌گیرید؛ هر اعلان حداکثر یک بار در ۲۴ ساعت.

کنترل خرج#

برای هر کلید سقف هزینه و برای هر پروژه بودجهٔ ماهانه بگذارید تا خطای یک برنامه یا کلید لورفته از حدی که می‌خواهید بیشتر خرج نکند. جزئیات در مدیریت هزینه و محدودیت‌ها و گزارش مصرف در موجودی و گزارش مصرف.

پاسخ پرسشتان را پیدا نکردید؟

شناسهٔ درخواست (هدر X-Request-Id) را با پرسشتان در تیکت بفرستید تا دقیق بررسی کنیم.

تیکت پشتیبانی