· 1 دقیقه مطالعه
Anthropic مدل Claude Sonnet 5.5 را با همان قیمت توکن عرضه کرد
Anthropic میگوید مدل میانرده جدیدش بیش از ۳۰٪ سریعتر است و هزینه هر کار با آن میتواند تا ۳۰٪ کمتر از Sonnet 5 باشد. این مدل در چند آزمون تقریباً به پای Opus 5.5 گرانتر میرسد.
Oossa · درباره Oossa
Anthropic مدل Claude Sonnet 5.5 را عرضه کرده است؛ مدلی برای کارهای روزمره مثل رفع اشکال، نوشتن مستندات، ساخت ارائه و ایجاد صفحهگسترده. این مدل هماکنون از طریق Anthropic و پلتفرمهای بزرگ ابری، از جمله Amazon Web Services، Google Cloud و Microsoft Azure، در دسترس است.
این شرکت میگوید Sonnet 5.5 پاسخها را بیش از ۳۰٪ سریعتر از مدل قبلی تولید میکند و توکنهای کمتری مصرف میکند؛ توکنها واحدهای متنیای هستند که یک مدل هوش مصنوعی پردازش میکند. در نتیجه، هزینه انجام کارها میتواند تا ۳۰٪ کمتر باشد. قیمت اعلامشده بهازای هر یک میلیون توکن با Sonnet 5 تغییری نکرده است: ۲ دلار برای ورودی و ۱۰ دلار برای خروجی. برآورد Anthropic از این صرفهجوییها هنوز در آزمونهای مستقل تأیید نشده است.
چقدر به Opus نزدیک است؟
در آزمون GDPval-AA که کارهای محیط کار را در ۴۴ حرفه میسنجد، Sonnet 5.5 امتیاز ۱٬۸۴۴ گرفت. امتیاز Opus 5.5 برابر با ۱٬۸۴۶ بود، در حالی که Sonnet 5 قدیمیتر ۱٬۴۴۹ امتیاز گرفت. در CursorBench، آزمونی بر پایه نشستهای برنامهنویسی، Sonnet 5.5 امتیاز ۵۵٫۵٪ گرفت؛ دو واحد درصد کمتر از Opus 5.5.
نتایج برنامهنویسی در بعضی معیارها نسبت به Sonnet 5 جهش چشمگیری داشت. Sonnet 5.5 در Terminal-Bench 4.0 امتیاز ۷۰٫۶٪ گرفت، در مقایسه با ۱۰٫۳٪ برای مدل قبلی. البته یک نکته وجود دارد: در FrontierCode، امتیاز این مدل در بالاترین سطح تلاش، موسوم به «Max»، از امتیازش در سطح «Xhigh» کمتر بود. Anthropic میگوید فرایند بازبینی کد گاهی باعث اتمام مهلت اجرا یا ایجاد تغییراتی فراتر از وظیفه تعیینشده میشد.
عرضه همراه با تدابیر حفاظتی بیشتر
Anthropic میگوید Sonnet 5.5 در انجام کارهای امنیت سایبری از Sonnet 5 توانمندتر است. درخواستهای پرخطر به Sonnet 5 ارجاع داده میشوند و متخصصان واجد شرایط میتوانند از طریق برنامه احراز هویت گسترشیافته، برای دسترسی به قابلیتهای پرخطرتر درخواست بدهند. این مدل همچنین تدابیری دارد که برای جلوگیری از تلاشها جهت کپیکردن خروجیهای آن و آموزش سامانههای دیگر طراحی شدهاند.
Sonnet در ردهای پایینتر از مدل Opus شرکت Anthropic قرار دارد؛ مدلی که برای کارهای پیچیدهتر در نظر گرفته شده است. Anthropic همچنین از Haiku 5.5، مدلی کمهزینهتر برای استفاده در مقیاس بالا، خبر داده، اما میگوید این مدل طی هفتههای آینده عرضه خواهد شد.
چرا مهم است
برای کسانی که از Claude در برنامهنویسی یا کارهای اداری استفاده میکنند، Sonnet 5.5 ممکن است بدون دریافت نرخهای بالاتر توکنِ مدل برتر Anthropic، نتیجههایی نزدیک به آن ارائه دهد. صرفهجویی ادعاشده به مصرف توکن کمتر در هر کار بستگی دارد؛ بنابراین هزینه واقعی متغیر خواهد بود و هنوز باید مستقلاً بررسی شود.
منابع و ارجاعها
| # | منبع | رسانه | تاریخ | نکته اصلی |
|---|---|---|---|---|
| 1 | Anthropic's Claude Sonnet 5.5 nearly matches Opus 5.5 on benchmarks while costing up to 30 percent less per task ↗ | The Decoder | ۶ مهر ۱۴۰۵ | Anthropic has released Claude Sonnet 5.5, the second model in its Claude 5.5 family. |
1 منبع
آخرین بهروزرسانی:
Oossa · خبرنامه
هفتهٔ هوش مصنوعی، به زبان ساده
هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.