Skip to main content

مصرف و صورتحساب

سرویس هوش مصنوعی نوین کلاود به‌ازای مصرف واقعی محاسبه می‌شود. اشتراک ماهانه، هزینه ثابت و حداقل مصرف وجود ندارد — فقط بابت توکن‌هایی که مصرف می‌کنید پرداخت می‌کنید.

هزینه چگونه محاسبه می‌شود؟

هر درخواست دو بخش هزینه دارد:

هزینه کل = (توکن ورودی × قیمت ورودی مدل)
+ (توکن خروجی × قیمت خروجی مدل)

توکن ورودی — هر آنچه به مدل می‌فرستید: پیام شما، پیام سیستمی و تمام تاریخچه گفتگو.

توکن خروجی — متنی که مدل تولید می‌کند.

قیمت خروجی معمولاً سه تا پنج برابر قیمت ورودی است، چون تولید متن پرهزینه‌تر از خواندن آن است.

مشاهده مصرف هر درخواست

در پاسخ هر درخواست API، بخش usage تعداد دقیق توکن‌ها را برمی‌گرداند:

{
"usage": {
"prompt_tokens": 18,
"completion_tokens": 42,
"total_tokens": 60
}
}
  • prompt_tokens — توکن ورودی
  • completion_tokens — توکن خروجی
  • total_tokens — مجموع

کیف پول

هزینه‌ها از کیف پول ریالی حساب کاربری شما کسر می‌شود — همان کیف پولی که برای سایر سرویس‌های نوین کلاود استفاده می‌کنید. نیازی به کیف پول جداگانه برای هوش مصنوعی نیست.

موجودی فعلی در بالای صفحه هوش مصنوعی و در بخش کیف پول نمایش داده می‌شود.

موجودی ناکافی

اگر موجودی کیف پول کافی نباشد، درخواست‌ها با خطای 402 رد می‌شوند. سرویس بدهکار نمی‌شود و مصرف بدون موجودی امکان‌پذیر نیست.

برای شارژ، به بخش افزایش اعتبار بروید.

صفحه مصرف

بخش هوش مصنوعی → مصرف در کنسول کاربری گزارش کامل مصرف شما را نشان می‌دهد.

بازه‌های زمانی

گزارش را می‌توانید در سه بازه ببینید:

  • ۷ روز اخیر
  • ۳۰ روز اخیر (پیش‌فرض)
  • ۳ ماه اخیر

شاخص‌های کلی

در بالای صفحه این اعداد نمایش داده می‌شوند:

شاخصتوضیح
کل توکن‌هامجموع توکن ورودی و خروجی در بازه انتخابی
کل هزینهمبلغ کسرشده از کیف پول در بازه انتخابی
تعداد درخواست‌هاتعداد کل فراخوانی‌ها
میانگین توکن در هر درخواستبرای تشخیص درخواست‌های غیرعادی سنگین

نمودار مصرف به تفکیک مدل

نشان می‌دهد کدام مدل‌ها بیشترین سهم را در مصرف شما دارند. این نمودار مؤثرترین ابزار برای کاهش هزینه است: اگر مدلی گران سهم بزرگی دارد، بررسی کنید آیا می‌توان بخشی از کارها را به مدل ارزان‌تری سپرد.

جدول جزئیات مصرف

فهرست ریز درخواست‌ها با این ستون‌ها:

ستونتوضیح
تاریخزمان درخواست
مدلمدل استفاده‌شده
توکن ورودیتعداد توکن ارسالی
توکن خروجیتعداد توکن دریافتی
هزینهمبلغ کسرشده

کنترل هزینه

۱. سقف بودجه روی کلید

مؤثرترین محافظ. هنگام ساخت کلید در تنظیمات پیشرفته، سقف بودجه تعیین کنید. مصرف آن کلید هرگز از این سقف فراتر نمی‌رود، حتی اگر کیف پول موجودی داشته باشد.

جزئیات: کلیدهای API.

۲. محدودیت نرخ

با تعیین RPM و TPM جلوی مصرف ناگهانی را بگیرید — مثلاً وقتی باگی باعث ارسال مکرر درخواست می‌شود.

۳. انتخاب مدل متناسب با کار

بزرگ‌ترین صرفه‌جویی معمولاً از اینجا می‌آید. برای دسته‌بندی متن یا خلاصه‌سازی ساده، مدل سبک کافی است و می‌تواند ده‌ها برابر ارزان‌تر باشد. راهنمای انتخاب: مدل‌ها.

۴. کوتاه نگه داشتن تاریخچه

در گفتگوهای طولانی، تاریخچه در هر درخواست دوباره ارسال می‌شود و هزینه ورودی مدام بالا می‌رود. برای موضوع جدید، گفتگوی جدید شروع کنید یا پیام‌های قدیمی را حذف/خلاصه کنید.

۵. محدود کردن طول پاسخ

با پارامتر max_tokens سقف طول پاسخ را تعیین کنید تا از تولید متن‌های طولانی غیرضروری جلوگیری شود:

response = client.chat.completions.create(
model="openai/gpt-4o-mini",
messages=[{"role": "user", "content": "این متن را در یک جمله خلاصه کن: ..."}],
max_tokens=100,
)

۶. کلید جداگانه برای هر پروژه

با ساخت کلید مجزا برای هر پروژه یا محیط، می‌توانید در گزارش مصرف تشخیص دهید هزینه از کجا می‌آید.

سوالات متداول

آیا درخواست ناموفق هزینه دارد؟ درخواست‌هایی که با خطای 401، 402، 429 یا 404 رد می‌شوند هزینه‌ای ندارند، چون به مدل نرسیده‌اند.

اگر پاسخ را وسط کار متوقف کنم چه می‌شود؟ توکن‌های تولیدشده تا لحظه توقف محاسبه می‌شوند.

آیا متن فارسی توکن بیشتری مصرف می‌کند؟ بله. متن فارسی معمولاً نسبت به متن انگلیسی هم‌اندازه، توکن بیشتری مصرف می‌کند.

چرا عدد شمارنده چت با گزارش مصرف کمی فرق دارد؟ شمارنده داخل چت یک تخمین سریع برای نمایش لحظه‌ای است. عدد معتبر، همان گزارش صفحه مصرف است.

مصرف چت chat.novin.cloud هم اینجا ثبت می‌شود؟ بله، تمام مصرف از هر مسیری در همین گزارش جمع می‌شود.

گام بعدی