رفتن به محتوا

راهنمای انتخاب مدل‌های Claude: تفاوت Fable، Opus، Sonnet و Haiku با مثال‌های واقعی

وقتی با Claude کار می‌کنید، دیر یا زود به این سؤال می‌رسید که از کدام مدل استفاده کنید. همیشه قوی‌ترین مدل بهتر نیست، ولی ارزان‌ترین هم همیشه به‌صرفه نیست. من در کارهای روزمرهٔ خودم، از تولید محتوا و تبلیغات تا شبکه و توسعهٔ نرم‌افزار، بارها با این انتخاب روبه‌رو شده‌ام. در این مقاله تفاوت رده‌ها را همراه با مثال توضیح می‌دهم.

خانوادهٔ Claude در حال حاضر چهار رده دارد و هر رده را می‌توان با یک «سطح تلاش» تنظیم کرد. انتخاب درست یعنی انتخاب درست هر دوی این‌ها.

چهار ردهٔ مدل در یک نگاه

قیمت‌ها بر اساس نرخ دلار امروز (یکشنبه ۲۹ شهریور ۱۴۰۵، حدود ۲۳۰,۲۰۰ تومان) به تومان تبدیل شده‌اند. چون این نرخ روزانه تغییر می‌کند، برای محاسبهٔ دقیق هزینهٔ خودتان بهتر است نرخ روز را جداگانه بررسی کنید.

رده جایگاه قیمت ورودی (هر ۱ میلیون توکن) قیمت خروجی (هر ۱ میلیون توکن) پنجرهٔ متن سرعت
Fable 5.1 قوی‌ترین مدل در دسترس عموم حدود ۲,۳۰۰,۰۰۰ تومان حدود ۱۱,۵۱۰,۰۰۰ تومان ۱ میلیون توکن کندتر
Opus 5 پرچم‌دار عمومی حدود ۱,۱۵۰,۰۰۰ تومان حدود ۵,۷۵۵,۰۰۰ تومان ۱ میلیون توکن متوسط
Sonnet 5 توازن سرعت و هوش حدود ۴۶۰,۰۰۰ تومان حدود ۲,۳۰۰,۰۰۰ تومان ۱ میلیون توکن سریع
Haiku 4.5 سبک و ارزان حدود ۲۳۰,۰۰۰ تومان حدود ۱,۱۵۰,۰۰۰ تومان ۲۰۰ هزار توکن سریع‌ترین

مدل دیگری به نام Mythos 5.1 هم وجود دارد که همان مدل پایهٔ Fable 5.1 است، اما فقط در اختیار سازمان‌های تأییدشده قرار می‌گیرد. قیمت آن با Fable یکسان است.

هر رده برای چه کاری مناسب است؟

Haiku: کارهای ساده، پرتکرار و فوری

Haiku برای کارهایی مناسب است که تعدادشان زیاد است، سرعت در آن‌ها مهم است و پیچیدگی کمی دارند. نمونه‌هایش چت‌بات سایتی است که به پرسش‌هایی مثل «ساعت کاری‌تان چند است؟» پاسخ می‌دهد، دسته‌بندی چند هزار تیکت پشتیبانی به فنی، مالی و فروش، یا استخراج نام و شماره تماس از فرم‌های ورودی یک CRM. در این کارها مدل قوی‌تر کیفیت محسوسی اضافه نمی‌کند و فقط هزینه را چند برابر می‌کند.

Sonnet: کارهای روزمرهٔ حرفه‌ای

Sonnet برای بیشتر کارهای روزانه کافی است. نوشتن بیست متن تبلیغ برای یک کمپین Google Ads، تولید مقالهٔ سئو شده، خلاصه‌کردن یک جلسه، نوشتن ایمیل رسمی به مشتری خارجی یا یک اسکریپت سادهٔ شبکه در این دسته‌اند. خروجی معمولاً با یک بازبینی انسانی قابل استفاده است.

Opus: کارهای پیچیده با اجزای وابسته به هم

وقتی کار چند بخش دارد که باید با هم سازگار بمانند، Opus مناسب است. توسعهٔ یک افزونهٔ اختصاصی وردپرس با چند فایل، دیتابیس و پنل مدیریت، عیب‌یابی قطعی VoIP پشت NAT با بررسی هم‌زمان کانفیگ روتر، فایروال و SIP، و طراحی معماری استقرار یک سیستم BPM برای سازمانی با چند واحد از این نوع کارها هستند. Anthropic هم Opus را نقطهٔ شروع بیشتر کارها توصیه می‌کند.

Fable: مسائل مبهم، طولانی و پرهزینه در صورت خطا

Fable برای کارهایی است که هم پیچیده‌اند و هم طولانی. تحقیق بازار برای ورود به یک کشور جدید با ده‌ها منبع، تحلیل رقبا و قیمت‌گذاری از این نوع است. ایجنتی که چند ساعت مستقل کار می‌کند تا یک سایت قدیمی را به معماری جدید منتقل و تست کند هم همین‌طور، و همچنین تحلیل یک قرارداد یا مدل مالی که فرض‌های پنهان و تناقض دارد. طبق اعلام Anthropic، برتری Fable بیشتر در کارهای پژوهشی و عامل‌محور دیده می‌شود (۵۲٫۶٪ در برابر ۲۹٪ برای Opus 5). در کدنویسی اختلاف کمتر است (۵۵٫۸٪ در برابر ۵۲٫۳٪).

یک کار ثابت روی چهار مدل

فرض کنید از هر چهار مدل بخواهیم برای یک مشتری جدید پروپوزال Google Ads بنویسند. نتایج زیر حاصل تجربهٔ من است و بنچمارک رسمی نیست.

  • Haiku یک قالب عمومی و قابل‌قبول می‌دهد، اما سطحی است و جزئیات کسب‌وکار مشتری را درست وارد نمی‌کند.
  • Sonnet پروپوزالی روان و حرفه‌ای می‌نویسد که با یک بازبینی قابل ارسال است.
  • Opus ساختار کمپین، بودجه‌بندی و کلمات کلیدی را منطقی به هم وصل می‌کند و تناقض‌های بریف را تشخیص می‌دهد.
  • Fable علاوه بر این‌ها خودش رقبا را بررسی می‌کند، فرض‌های بودجه را زیر سؤال می‌برد و سناریوهای جایگزین می‌دهد. برای یک پروپوزال معمولی این سطح بیش از نیاز است.

سطح تلاش (Effort) چیست؟

هر مدل را می‌توان در چند سطح تلاش اجرا کرد. این سطح تعیین می‌کند مدل پیش از پاسخ چقدر «فکر کند»، یعنی چه مقدار توکن صرف استدلال کند. پنج سطح وجود دارد:

  • Low: ترجمهٔ یک جمله به انگلیسی رسمی. فکر بیشتر در این کار ارزشی اضافه نمی‌کند.
  • Medium: مقایسهٔ VMware و Proxmox برای یک شرکت سی‌نفره. این سطح پیش‌فرض اپ Claude است.
  • High: پیدا کردن باگ در یک کد چهارصدخطی. این سطح پیش‌فرض Claude Code است.
  • Extra-High و Max: پیدا کردن ریشهٔ Loop در شبکه‌ای با دوازده روتر. چنین مسئله‌ای چند فرضیه دارد و هر کدام باید جداگانه بررسی شود.

نام سطح‌ها بین مدل‌ها هم‌ارز نیست. طبق داده‌های Artificial Analysis، Fable 5.1 در سطح Medium تقریباً هم‌تراز Opus 5 در سطح High است (شاخص هوشمندی ۴۹ در برابر ۴۸). در همین مقایسه Fable حدود ۲۸ هزار توکن برای هر کار مصرف می‌کند و Opus حدود ۴۶ هزار، و اولین توکن Fable بعد از ۶٫۵ ثانیه می‌رسد و اولین توکن Opus بعد از ۱۶٫۷ ثانیه.

هزینهٔ واقعی چگونه محاسبه می‌شود؟

بسیاری فقط به قیمت هر توکن نگاه می‌کنند، ولی هزینهٔ واقعی از ضرب قیمت هر توکن در تعداد توکن مصرفی به دست می‌آید. مدل گران‌تر در سطح تلاش پایین‌تر گاهی از مدل ارزان‌تر در سطح تلاش بالا سریع‌تر تمام می‌شود و هزینه‌اش هم به آن نزدیک است. به همین دلیل مقایسه باید روی کار واقعی خودتان انجام شود.

مزایا و معایب

رده‌های بالاتر در کارهای چندمرحله‌ای کمتر خطا می‌کنند و کمتر به اصلاح نیاز دارند، ولی گران‌تر و کندترند. رده‌های پایین‌تر ارزان و سریع‌اند و برای مقیاس بالا مناسب‌اند، اما در مسائل مبهم یا طولانی زودتر افت می‌کنند. سطح تلاش بالاتر در مسائل سخت کیفیت را بهتر می‌کند، ولی در کارهای ساده فقط هزینه و زمان را بالا می‌برد.

جمع‌بندی: یک قاعدهٔ ساده برای انتخاب

اگر اشتباه در کار ارزان است و سریع اصلاح می‌شود، ردهٔ پایین‌تر کافی است. اگر اشتباه دیر معلوم می‌شود یا برای مشتری هزینه دارد، ردهٔ بالاتر صرفه دارد. پیشنهاد من این است که از Sonnet یا Opus شروع کنید و فقط وقتی به سقف توانشان رسیدید مدل یا سطح تلاش را بالاتر ببرید.

قیمت‌های تومانی این مقاله بر اساس نرخ دلار آزاد در تاریخ ۲۹ شهریور ۱۴۰۵ محاسبه شده و ممکن است با نرخ روز شما فرق داشته باشد.

منتشر شده در هوش مصنوعیفناوری اطلاعات و ارتباطاتمقالاتمقالات تخصصی

اولین باشید که نظر می دهید

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

این سایت از اکیسمت برای کاهش جفنگ استفاده می‌کند. درباره چگونگی پردازش داده‌های دیدگاه خود بیشتر بدانید.