هزینه و تأخیر
کیفیت بدون هزینه و سرعت، نصفِ ماجراست. اینجا هر دو سرِ معادله را میبینیم.
هزینهی تولید
$0.28
۵۱۰۸۵۳ توکن در ۳۰ روز
هزینه بهازای هر لید
$0.14
عدد نهاییِ مورد علاقهی کارفرما
هزینهی داوری
$0.24
۱۹۶۶۸۴ توکن در ۴ اجرا
تأخیر پاسخ بات
۶.۲ ثانیه
p95: ۷.۳ ثانیه · بیشینه: ۷.۳ ثانیه
هزینهی تولید به تفکیک مدل
بر اساس توکنهای ثبتشده در جدول پیامهای چتبات، مرتبشده بر حسب هزینه.
| مدل | پیام | توکن ورودی | توکن خروجی | هزینه |
|---|---|---|---|---|
google/gemini-3.5-flash | ۱۰۷ | ۴۵۴۴۹۰ | ۵۶۳۶۳ | $0.28 |
نامشخص | ۳ | ۰ | ۰ | $0 |
| مجموع | ۱۱۰ | ۴۵۴۴۹۰ | ۵۶۳۶۳ | $0.28 |
جدول قیمت مرجع
دلار بهازای هر یک میلیون توکن — دستی در src/lib/pricing.ts نگهداری میشود.
| مدل | ورودی | خروجی |
|---|---|---|
google/gemini-3.5-flash | $۰.۳ | $۲.۵ |
google/gemini-2.5-flash | $۰.۳ | $۲.۵ |
google/gemini-3.1-flash-lite | $۰.۱ | $۰.۴ |
anthropic/claude-haiku-4.5 | $۱ | $۵ |
openai/gpt-5-mini | $۰.۲۵ | $۲ |
openai/gpt-5.4-nano | $۰.۱ | $۰.۴ |
openai/gpt-4o-mini | $۰.۱۵ | $۰.۶ |
qwen/qwen3-30b-a3b-instruct-2507 | $۰.۱ | $۰.۴ |
چرا این مهم است
اینجا دو هزینهی متفاوت وجود دارد که مدام با هم اشتباه گرفته میشوند: هزینهی کارکردنِ بات (هر پاسخی که به کاربر واقعی میدهد) و هزینهی سنجیدنِ بات (هر بار که داور مدلی کیسها را نمره میدهد). هر دو واقعیاند و از یک کیف پول پرداخت میشوند؛ اگر فقط اولی را ببینید، ارزیابی «رایگان» بهنظر میرسد و بیمحابا اجرا میشود، و اگر فقط دومی را ببینید، بهینهسازیِ اشتباهی را دنبال میکنید. ضمناً جدول قیمت بالا یک تخمین دستی است، نه صورتحساب: در src/lib/pricing.ts نوشته شده و باید با جدول قیمت فاز ۴ همگام بماند. اگر قیمتها کهنه شوند، همهی اعداد این صفحه بیسروصدا غلط میشوند.