وقتی با Claude کار میکنید، دیر یا زود به این سؤال میرسید که از کدام مدل استفاده کنید. همیشه قویترین مدل بهتر نیست، ولی ارزانترین هم همیشه بهصرفه نیست. من در کارهای روزمرهٔ خودم، از تولید محتوا و تبلیغات تا شبکه و توسعهٔ نرمافزار، بارها با این انتخاب روبهرو شدهام. در این مقاله تفاوت ردهها را همراه با مثال توضیح میدهم.
خانوادهٔ Claude در حال حاضر چهار رده دارد و هر رده را میتوان با یک «سطح تلاش» تنظیم کرد. انتخاب درست یعنی انتخاب درست هر دوی اینها.
چهار ردهٔ مدل در یک نگاه
قیمتها بر اساس نرخ دلار امروز (یکشنبه ۲۹ شهریور ۱۴۰۵، حدود ۲۳۰,۲۰۰ تومان) به تومان تبدیل شدهاند. چون این نرخ روزانه تغییر میکند، برای محاسبهٔ دقیق هزینهٔ خودتان بهتر است نرخ روز را جداگانه بررسی کنید.
| رده | جایگاه | قیمت ورودی (هر ۱ میلیون توکن) | قیمت خروجی (هر ۱ میلیون توکن) | پنجرهٔ متن | سرعت |
|---|---|---|---|---|---|
| Fable 5.1 | قویترین مدل در دسترس عموم | حدود ۲,۳۰۰,۰۰۰ تومان | حدود ۱۱,۵۱۰,۰۰۰ تومان | ۱ میلیون توکن | کندتر |
| Opus 5 | پرچمدار عمومی | حدود ۱,۱۵۰,۰۰۰ تومان | حدود ۵,۷۵۵,۰۰۰ تومان | ۱ میلیون توکن | متوسط |
| Sonnet 5 | توازن سرعت و هوش | حدود ۴۶۰,۰۰۰ تومان | حدود ۲,۳۰۰,۰۰۰ تومان | ۱ میلیون توکن | سریع |
| Haiku 4.5 | سبک و ارزان | حدود ۲۳۰,۰۰۰ تومان | حدود ۱,۱۵۰,۰۰۰ تومان | ۲۰۰ هزار توکن | سریعترین |
مدل دیگری به نام Mythos 5.1 هم وجود دارد که همان مدل پایهٔ Fable 5.1 است، اما فقط در اختیار سازمانهای تأییدشده قرار میگیرد. قیمت آن با Fable یکسان است.
هر رده برای چه کاری مناسب است؟
Haiku: کارهای ساده، پرتکرار و فوری
Haiku برای کارهایی مناسب است که تعدادشان زیاد است، سرعت در آنها مهم است و پیچیدگی کمی دارند. نمونههایش چتبات سایتی است که به پرسشهایی مثل «ساعت کاریتان چند است؟» پاسخ میدهد، دستهبندی چند هزار تیکت پشتیبانی به فنی، مالی و فروش، یا استخراج نام و شماره تماس از فرمهای ورودی یک CRM. در این کارها مدل قویتر کیفیت محسوسی اضافه نمیکند و فقط هزینه را چند برابر میکند.
Sonnet: کارهای روزمرهٔ حرفهای
Sonnet برای بیشتر کارهای روزانه کافی است. نوشتن بیست متن تبلیغ برای یک کمپین Google Ads، تولید مقالهٔ سئو شده، خلاصهکردن یک جلسه، نوشتن ایمیل رسمی به مشتری خارجی یا یک اسکریپت سادهٔ شبکه در این دستهاند. خروجی معمولاً با یک بازبینی انسانی قابل استفاده است.
Opus: کارهای پیچیده با اجزای وابسته به هم
وقتی کار چند بخش دارد که باید با هم سازگار بمانند، Opus مناسب است. توسعهٔ یک افزونهٔ اختصاصی وردپرس با چند فایل، دیتابیس و پنل مدیریت، عیبیابی قطعی VoIP پشت NAT با بررسی همزمان کانفیگ روتر، فایروال و SIP، و طراحی معماری استقرار یک سیستم BPM برای سازمانی با چند واحد از این نوع کارها هستند. Anthropic هم Opus را نقطهٔ شروع بیشتر کارها توصیه میکند.
Fable: مسائل مبهم، طولانی و پرهزینه در صورت خطا
Fable برای کارهایی است که هم پیچیدهاند و هم طولانی. تحقیق بازار برای ورود به یک کشور جدید با دهها منبع، تحلیل رقبا و قیمتگذاری از این نوع است. ایجنتی که چند ساعت مستقل کار میکند تا یک سایت قدیمی را به معماری جدید منتقل و تست کند هم همینطور، و همچنین تحلیل یک قرارداد یا مدل مالی که فرضهای پنهان و تناقض دارد. طبق اعلام Anthropic، برتری Fable بیشتر در کارهای پژوهشی و عاملمحور دیده میشود (۵۲٫۶٪ در برابر ۲۹٪ برای Opus 5). در کدنویسی اختلاف کمتر است (۵۵٫۸٪ در برابر ۵۲٫۳٪).
یک کار ثابت روی چهار مدل
فرض کنید از هر چهار مدل بخواهیم برای یک مشتری جدید پروپوزال Google Ads بنویسند. نتایج زیر حاصل تجربهٔ من است و بنچمارک رسمی نیست.
- Haiku یک قالب عمومی و قابلقبول میدهد، اما سطحی است و جزئیات کسبوکار مشتری را درست وارد نمیکند.
- Sonnet پروپوزالی روان و حرفهای مینویسد که با یک بازبینی قابل ارسال است.
- Opus ساختار کمپین، بودجهبندی و کلمات کلیدی را منطقی به هم وصل میکند و تناقضهای بریف را تشخیص میدهد.
- Fable علاوه بر اینها خودش رقبا را بررسی میکند، فرضهای بودجه را زیر سؤال میبرد و سناریوهای جایگزین میدهد. برای یک پروپوزال معمولی این سطح بیش از نیاز است.
سطح تلاش (Effort) چیست؟
هر مدل را میتوان در چند سطح تلاش اجرا کرد. این سطح تعیین میکند مدل پیش از پاسخ چقدر «فکر کند»، یعنی چه مقدار توکن صرف استدلال کند. پنج سطح وجود دارد:
- Low: ترجمهٔ یک جمله به انگلیسی رسمی. فکر بیشتر در این کار ارزشی اضافه نمیکند.
- Medium: مقایسهٔ VMware و Proxmox برای یک شرکت سینفره. این سطح پیشفرض اپ Claude است.
- High: پیدا کردن باگ در یک کد چهارصدخطی. این سطح پیشفرض Claude Code است.
- Extra-High و Max: پیدا کردن ریشهٔ Loop در شبکهای با دوازده روتر. چنین مسئلهای چند فرضیه دارد و هر کدام باید جداگانه بررسی شود.
نام سطحها بین مدلها همارز نیست. طبق دادههای Artificial Analysis، Fable 5.1 در سطح Medium تقریباً همتراز Opus 5 در سطح High است (شاخص هوشمندی ۴۹ در برابر ۴۸). در همین مقایسه Fable حدود ۲۸ هزار توکن برای هر کار مصرف میکند و Opus حدود ۴۶ هزار، و اولین توکن Fable بعد از ۶٫۵ ثانیه میرسد و اولین توکن Opus بعد از ۱۶٫۷ ثانیه.
هزینهٔ واقعی چگونه محاسبه میشود؟
بسیاری فقط به قیمت هر توکن نگاه میکنند، ولی هزینهٔ واقعی از ضرب قیمت هر توکن در تعداد توکن مصرفی به دست میآید. مدل گرانتر در سطح تلاش پایینتر گاهی از مدل ارزانتر در سطح تلاش بالا سریعتر تمام میشود و هزینهاش هم به آن نزدیک است. به همین دلیل مقایسه باید روی کار واقعی خودتان انجام شود.
مزایا و معایب
ردههای بالاتر در کارهای چندمرحلهای کمتر خطا میکنند و کمتر به اصلاح نیاز دارند، ولی گرانتر و کندترند. ردههای پایینتر ارزان و سریعاند و برای مقیاس بالا مناسباند، اما در مسائل مبهم یا طولانی زودتر افت میکنند. سطح تلاش بالاتر در مسائل سخت کیفیت را بهتر میکند، ولی در کارهای ساده فقط هزینه و زمان را بالا میبرد.
جمعبندی: یک قاعدهٔ ساده برای انتخاب
اگر اشتباه در کار ارزان است و سریع اصلاح میشود، ردهٔ پایینتر کافی است. اگر اشتباه دیر معلوم میشود یا برای مشتری هزینه دارد، ردهٔ بالاتر صرفه دارد. پیشنهاد من این است که از Sonnet یا Opus شروع کنید و فقط وقتی به سقف توانشان رسیدید مدل یا سطح تلاش را بالاتر ببرید.
قیمتهای تومانی این مقاله بر اساس نرخ دلار آزاد در تاریخ ۲۹ شهریور ۱۴۰۵ محاسبه شده و ممکن است با نرخ روز شما فرق داشته باشد.

اولین باشید که نظر می دهید