خانه ← مدل‌ها و قیمت

تعرفهٔ رسمی، قیمت AZ API

همهٔ ارقام به دلار و بر پایهٔ هر یک میلیون توکن است. قیمت خط‌خورده تعرفهٔ رسمی ارائه‌دهنده و قیمت روشن، نرخ شما پس از تخفیف قراردادی ماست.

◎

OpenAI

−17%

بیشترین تخفیف سبد ما روی GPT-5، o3 و امبدینگ‌ها

◈

Google Gemini

−10%

مناسب کانتکست بلند و پردازش چندوجهی با حجم بالا

✳

Anthropic

−7%

خانوادهٔ Claude برای تحلیل سنگین و کدنویسی دقیق

مدل ↕ ورودی / ۱M توکن ↕ خروجی / ۱M توکن ↕ تخفیف ↕
OpenAIGPT-5پرچم‌دار استدلال و کدنویسی $1.25  $1.037 $10  $8.3 −17%
OpenAIGPT-5 miniسریع و مقرون‌به‌صرفه $0.25  $0.207 $2  $1.66 −17%
OpenAIGPT-4.1کاربرد عمومی، کانتکست ۱M $2  $1.66 $8  $6.64 −17%
OpenAIo3استدلال چندمرحله‌ای $2  $1.66 $8  $6.64 −17%
OpenAItext-embedding-3-largeجست‌وجوی معنایی و RAG $0.13  $0.108 — −17%
AnthropicClaude Opus 4.5سنگین‌ترین مدل تحلیلی $5  $4.65 $25  $23.25 −7%
AnthropicClaude Sonnet 4.5تعادل کیفیت و هزینه $3  $2.79 $15  $13.95 −7%
AnthropicClaude Haiku 4.5پاسخ‌دهی لحظه‌ای و انبوه $1  $0.93 $5  $4.65 −7%
GoogleGemini 2.5 Proکانتکست بلند و چندوجهی $1.25  $1.125 $10  $9 −10%
GoogleGemini 2.5 Flashحجم بالا با تأخیر کم $0.3  $0.27 $2.5  $2.25 −10%
GoogleGemini 2.5 Flash-Liteارزان‌ترین گزینهٔ مقیاس‌پذیر $0.1  $0.09 $0.4  $0.36 −10%

روی عنوان ستون‌ها بزنید تا مرتب شوند. ارقام مرجع بر پایهٔ تعرفهٔ عمومی ارائه‌دهندگان است و ممکن است تغییر کند؛ نرخ نهایی در پیشنهاد رسمی اعلام می‌شود.

برآوردگر

هزینهٔ ماهانهٔ شما چقدر می‌شود؟

حجم کار و مدل را انتخاب کنید تا برآورد تقریبی هزینه را ببینید.

فرض: توکن ورودی حدود سه برابر توکن خروجی. برآورد تقریبی است.

هزینهٔ ماهانه با AZ API
$0
تعرفهٔ رسمی: $0 — صرفه‌جویی شما $0
تعرفهٔ رسمی
نرخ شما
بررسی دقیق با کارشناس
ماشین‌حساب

چقدر صرفه‌جویی می‌کنید؟

هزینهٔ ماهانهٔ فعلی خود را به دلار بکشید تا اثر تخفیف قراردادی ما را زنده ببینید.

محاسبه بر پایهٔ تعرفهٔ رسمی هر ارائه‌دهنده انجام می‌شود.

صرفه‌جویی ماهانهٔ شما
$0
یعنی $0 در سال — معادل 0% از کل هزینه
هزینهٔ فعلی$0
هزینه با AZ API$0
دریافت پیشنهاد دقیق برای این حجم

راهنمای انتخاب

کدام مدل برای کدام کار؟

بیشترین هزینهٔ اضافی از انتخاب مدل گران برای کار سبک می‌آید. این جدول ذهنی را در مشاوره دقیق‌تر می‌کنیم.

هزینهٔ کم

کارهای انبوه و ساده

دسته‌بندی تیکت، برچسب‌گذاری، خلاصهٔ کوتاه، پاسخ‌های قالبی.

  • GPT-5 mini
  • Claude Haiku 4.5
  • Gemini 2.5 Flash-Lite
تعادل

محصول و پشتیبانی روزمره

چت‌بات مشتری، تولید محتوا، دستیار داخلی، RAG روی اسناد.

  • GPT-4.1
  • Claude Sonnet 4.5
  • Gemini 2.5 Flash
حداکثر کیفیت

تحلیل سنگین و کدنویسی

استدلال چندمرحله‌ای، بازبینی کد، تحلیل حقوقی و مالی، اسناد بلند.

  • GPT-5 · o3
  • Claude Opus 4.5
  • Gemini 2.5 Pro

جزئیات قیمت

چیزهایی که خوب است بدانید

توکن چیست و چطور محاسبه می‌شود؟
توکن واحد شمارش متن است؛ به‌طور تقریبی هر ۱۰۰۰ توکن حدود ۷۰۰ تا ۷۵۰ کلمهٔ انگلیسی یا کمتر از آن در فارسی است. هزینه بر پایهٔ مجموع توکن ورودی (پرسش و کانتکست) و توکن خروجی (پاسخ مدل) محاسبه می‌شود و نرخ خروجی معمولاً چند برابر ورودی است.
چطور هزینه را بیشتر کم کنیم؟
سه اهرم اصلی: انتخاب مدل سبک‌تر برای کارهای ساده، کوتاه‌کردن کانتکست تکراری، و استفاده از کش پرامپت در سناریوهای پرتکرار. در جلسهٔ مشاوره روی همین سه مورد برای کاربرد شما کار می‌کنیم.
تخفیف روی همهٔ مدل‌های یک ارائه‌دهنده اعمال می‌شود؟
بله، تخفیف قراردادی ما روی سبد مدل‌های همان ارائه‌دهنده اعمال می‌شود: ۱۷٪ برای OpenAI، ۱۰٪ برای Google و ۷٪ برای Anthropic. برای مدل‌های تازه‌منتشرشده، نرخ در پیشنهاد رسمی تأیید می‌شود.
برای حجم‌های بزرگ شرایط بهتری هست؟
برای مصرف ماهانهٔ بالا، شرایط پرداخت و سطح خدمات پشتیبانی قابل مذاکره است. فرم مشاوره را با برآورد حجم خود پر کنید تا پیشنهاد اختصاصی دریافت کنید.

از بلاگ AZ API

تازه‌ترین نوشته‌ها دربارهٔ هزینهٔ هوش مصنوعی

◱
تحلیل هزینه

۶۰٪ هزینهٔ API‌تان احتمالاً اضافه است؛ چرا؟

در بازبینی مصرف ده تیم محصول، الگوی تکراری دیدیم: مدل پرچم‌دار برای کاری که مدل سبک هم انجامش می‌داد. سه اهرم اصلی کاهش هزینه را با عدد بررسی می‌کنیم.

۷ دی ۱۴۰۵·۸ دقیقه مطالعه
⇄
مقایسهٔ مدل

راهنمای انتخاب بین GPT-5، Claude و Gemini

هیچ مدلی در همهٔ کارها بهترین نیست. یک چارچوب تصمیم بر پایهٔ نوع کار، طول کانتکست، تأخیر قابل‌تحمل و سقف بودجه.

۲ دی ۱۴۰۵·۱۱ دقیقه مطالعه
₮
بهینه‌سازی

کش پرامپت: ارزان‌ترین بهینه‌سازی که انجام نمی‌دهید

اگر بخش ثابتی از پرامپت شما در هر درخواست تکرار می‌شود، کش‌کردن آن می‌تواند هزینهٔ ورودی را چشمگیر کم کند.

۲۴ آذر ۱۴۰۵·۶ دقیقه مطالعه
◎
معماری

RAG یا کانتکست بلند؟ تصمیم بر پایهٔ هزینه

با ارزان‌تر شدن کانتکست بلند، آیا هنوز به بازیابی برداری نیاز دارید؟ محاسبهٔ نقطهٔ سربه‌سر برای اندازه‌های مختلف پایگاه دانش.

۱۸ آذر ۱۴۰۵·۹ دقیقه مطالعه
◈
مدیریت

سقف بودجه و کنترل مصرف در تیم‌های چندپروژه‌ای

چطور مصرف را به تیم و پروژه تفکیک کنیم، هشدار بگذاریم و جلوی صورتحساب غافلگیرکننده را بگیریم.

۱۱ آذر ۱۴۰۵·۵ دقیقه مطالعه
✳
مطالعهٔ موردی

چت‌بات پشتیبانی که هزینه‌اش از یک اپراتور کمتر باشد

طراحی یک مسیر دومرحله‌ای: مدل سبک برای دسته‌بندی و پاسخ‌های رایج، مدل قوی فقط برای موارد پیچیده. با اعداد واقعی یک فروشگاه آنلاین.

۴ آذر ۱۴۰۵·۷ دقیقه مطالعه
◱
جست‌وجو

امبدینگ ارزان، جست‌وجوی دقیق

انتخاب مدل امبدینگ، اندازهٔ چانک و استراتژی بازرتبه‌بندی؛ سه تصمیمی که کیفیت و هزینهٔ جست‌وجوی معنایی را تعیین می‌کند.

۲۷ آبان ۱۴۰۵·۶ دقیقه مطالعه

برآورد دقیق برای مصرف خودتان بگیرید

ترکیب بهینهٔ مدل‌ها و هزینهٔ ماهانهٔ تخمینی را در یک جلسهٔ کوتاه تحویل می‌گیرید.

دریافت مشاورهٔ رایگان