مصرف و صورتحساب
سرویس هوش مصنوعی نوین کلاود بهازای مصرف واقعی محاسبه میشود. اشتراک ماهانه، هزینه ثابت و حداقل مصرف وجود ندارد — فقط بابت توکنهایی که مصرف میکنید پرداخت میکنید.
هزینه چگونه محاسبه میشود؟
هر درخواست دو بخش هزینه دارد:
هزینه کل = (توکن ورودی × قیمت ورودی مدل)
+ (توکن خروجی × قیمت خروجی مدل)
توکن ورودی — هر آنچه به مدل میفرستید: پیام شما، پیام سیستمی و تمام تاریخچه گفتگو.
توکن خروجی — متنی که مدل تولید میکند.
قیمت خروجی معمولاً سه تا پنج برابر قیمت ورودی است، چون تولید متن پرهزینهتر از خواندن آن است.
مشاهده مصرف هر درخواست
در پاسخ هر درخواست API، بخش usage تعداد دقیق توکنها را برمیگرداند:
{
"usage": {
"prompt_tokens": 18,
"completion_tokens": 42,
"total_tokens": 60
}
}
prompt_tokens— توکن ورودیcompletion_tokens— توکن خروجیtotal_tokens— مجموع
کیف پول
هزینهها از کیف پول ریالی حساب کاربری شما کسر میشود — همان کیف پولی که برای سایر سرویسهای نوین کلاود استفاده میکنید. نیازی به کیف پول جداگانه برای هوش مصنوعی نیست.
موجودی فعلی در بالای صفحه هوش مصنوعی و در بخش کیف پول نمایش داده میشود.
اگر موجودی کیف پول کافی نباشد، درخواستها با خطای 402 رد میشوند. سرویس بدهکار نمیشود و مصرف بدون موجودی امکانپذیر نیست.
برای شارژ، به بخش افزایش اعتبار بروید.
صفحه مصرف
بخش هوش مصنوعی → مصرف در کنسول کاربری گزارش کامل مصرف شما را نشان میدهد.
بازههای زمانی
گزارش را میتوانید در سه بازه ببینید:
- ۷ روز اخیر
- ۳۰ روز اخیر (پیشفرض)
- ۳ ماه اخیر
شاخصهای کلی
در بالای صفحه این اعداد نمایش داده میشوند:
| شاخص | توضیح |
|---|---|
| کل توکنها | مجموع توکن ورودی و خروجی در بازه انتخابی |
| کل هزینه | مبلغ کسرشده از کیف پول در بازه انتخابی |
| تعداد درخواستها | تعداد کل فراخوانیها |
| میانگین توکن در هر درخواست | برای تشخیص درخواستهای غیرعادی سنگین |
نمودار مصرف به تفکیک مدل
نشان میدهد کدام مدلها بیشترین سهم را در مصرف شما دارند. این نمودار مؤثرترین ابزار برای کاهش هزینه است: اگر مدلی گران سهم بزرگی دارد، بررسی کنید آیا میتوان بخشی از کارها را به مدل ارزانتری سپرد.
جدول جزئیات مصرف
فهرست ریز درخواستها با این ستونها:
| ستون | توضیح |
|---|---|
| تاریخ | زمان درخواست |
| مدل | مدل استفادهشده |
| توکن ورودی | تعداد توکن ارسالی |
| توکن خروجی | تعداد توکن دریافتی |
| هزینه | مبلغ کسرشده |
کنترل هزینه
۱. سقف بودجه روی کلید
مؤثرترین محافظ. هنگام ساخت کلید در تنظیمات پیشرفته، سقف بودجه تعیین کنید. مصرف آن کلید هرگز از این سقف فراتر نمیرود، حتی اگر کیف پول موجودی داشته باشد.
جزئیات: کلیدهای API.
۲. محدودیت نرخ
با تعیین RPM و TPM جلوی مصرف ناگهانی را بگیرید — مثلاً وقتی باگی باعث ارسال مکرر درخواست میشود.
۳. انتخاب مدل متناسب با کار
بزرگترین صرفهجویی معمولاً از اینجا میآید. برای دستهبندی متن یا خلاصهسازی ساده، مدل سبک کافی است و میتواند دهها برابر ارزانتر باشد. راهنمای انتخاب: مدلها.
۴. کوتاه نگه داشتن تاریخچه
در گفتگوهای طولانی، تاریخچه در هر درخواست دوباره ارسال میشود و هزینه ورودی مدام بالا میرود. برای موضوع جدید، گفتگوی جدید شروع کنید یا پیامهای قدیمی را حذف/خلاصه کنید.
۵. محدود کردن طول پاسخ
با پارامتر max_tokens سقف طول پاسخ را تعیین کنید تا از تولید متنهای طولانی غیرضروری جلوگیری شود:
response = client.chat.completions.create(
model="openai/gpt-4o-mini",
messages=[{"role": "user", "content": "این متن را در یک جمله خلاصه کن: ..."}],
max_tokens=100,
)
۶. کلید جداگانه برای هر پروژه
با ساخت کلید مجزا برای هر پروژه یا محیط، میتوانید در گزارش مصرف تشخیص دهید هزینه از کجا میآید.
سوالات متداول
آیا درخواست ناموفق هزینه دارد؟
درخواستهایی که با خطای 401، 402، 429 یا 404 رد میشوند هزینهای ندارند، چون به مدل نرسیدهاند.
اگر پاسخ را وسط کار متوقف کنم چه میشود؟ توکنهای تولیدشده تا لحظه توقف محاسبه میشوند.
آیا متن فارسی توکن بیشتری مصرف میکند؟ بله. متن فارسی معمولاً نسبت به متن انگلیسی هماندازه، توکن بیشتری مصرف میکند.
چرا عدد شمارنده چت با گزارش مصرف کمی فرق دارد؟ شمارنده داخل چت یک تخمین سریع برای نمایش لحظهای است. عدد معتبر، همان گزارش صفحه مصرف است.
مصرف چت chat.novin.cloud هم اینجا ثبت میشود؟
بله، تمام مصرف از هر مسیری در همین گزارش جمع میشود.
گام بعدی
- کلیدهای API — تعیین سقف بودجه و محدودیت نرخ
- مدلها — انتخاب مدل مقرونبهصرفه
- مرجع API — پارامترهای کنترل مصرف