Oossaهوش مصنوعی به‌سرعت پیشرفت می‌کند. ما آن را ساده توضیح می‌دهیم.
خبرنامه

· 1 دقیقه مطالعه

Anthropic مدل Claude Sonnet 5.5 را با همان قیمت توکن عرضه کرد

Anthropic می‌گوید مدل میان‌رده جدیدش بیش از ۳۰٪ سریع‌تر است و هزینه هر کار با آن می‌تواند تا ۳۰٪ کمتر از Sonnet 5 باشد. این مدل در چند آزمون تقریباً به پای Opus 5.5 گران‌تر می‌رسد.

Oossa · درباره Oossa

Anthropic مدل Claude Sonnet 5.5 را با همان قیمت توکن عرضه کرد
Photo by Glenn Carstens-Peters on Unsplash

Anthropic مدل Claude Sonnet 5.5 را عرضه کرده است؛ مدلی برای کارهای روزمره مثل رفع اشکال، نوشتن مستندات، ساخت ارائه و ایجاد صفحه‌گسترده. این مدل هم‌اکنون از طریق Anthropic و پلتفرم‌های بزرگ ابری، از جمله Amazon Web Services، Google Cloud و Microsoft Azure، در دسترس است.

این شرکت می‌گوید Sonnet 5.5 پاسخ‌ها را بیش از ۳۰٪ سریع‌تر از مدل قبلی تولید می‌کند و توکن‌های کمتری مصرف می‌کند؛ توکن‌ها واحدهای متنی‌ای هستند که یک مدل هوش مصنوعی پردازش می‌کند. در نتیجه، هزینه انجام کارها می‌تواند تا ۳۰٪ کمتر باشد. قیمت اعلام‌شده به‌ازای هر یک میلیون توکن با Sonnet 5 تغییری نکرده است: ۲ دلار برای ورودی و ۱۰ دلار برای خروجی. برآورد Anthropic از این صرفه‌جویی‌ها هنوز در آزمون‌های مستقل تأیید نشده است.

چقدر به Opus نزدیک است؟

در آزمون GDPval-AA که کارهای محیط کار را در ۴۴ حرفه می‌سنجد، Sonnet 5.5 امتیاز ۱٬۸۴۴ گرفت. امتیاز Opus 5.5 برابر با ۱٬۸۴۶ بود، در حالی که Sonnet 5 قدیمی‌تر ۱٬۴۴۹ امتیاز گرفت. در CursorBench، آزمونی بر پایه نشست‌های برنامه‌نویسی، Sonnet 5.5 امتیاز ۵۵٫۵٪ گرفت؛ دو واحد درصد کمتر از Opus 5.5.

نتایج برنامه‌نویسی در بعضی معیارها نسبت به Sonnet 5 جهش چشمگیری داشت. Sonnet 5.5 در Terminal-Bench 4.0 امتیاز ۷۰٫۶٪ گرفت، در مقایسه با ۱۰٫۳٪ برای مدل قبلی. البته یک نکته وجود دارد: در FrontierCode، امتیاز این مدل در بالاترین سطح تلاش، موسوم به «Max»، از امتیازش در سطح «Xhigh» کمتر بود. Anthropic می‌گوید فرایند بازبینی کد گاهی باعث اتمام مهلت اجرا یا ایجاد تغییراتی فراتر از وظیفه تعیین‌شده می‌شد.

عرضه همراه با تدابیر حفاظتی بیشتر

Anthropic می‌گوید Sonnet 5.5 در انجام کارهای امنیت سایبری از Sonnet 5 توانمندتر است. درخواست‌های پرخطر به Sonnet 5 ارجاع داده می‌شوند و متخصصان واجد شرایط می‌توانند از طریق برنامه احراز هویت گسترش‌یافته، برای دسترسی به قابلیت‌های پرخطرتر درخواست بدهند. این مدل همچنین تدابیری دارد که برای جلوگیری از تلاش‌ها جهت کپی‌کردن خروجی‌های آن و آموزش سامانه‌های دیگر طراحی شده‌اند.

Sonnet در رده‌ای پایین‌تر از مدل Opus شرکت Anthropic قرار دارد؛ مدلی که برای کارهای پیچیده‌تر در نظر گرفته شده است. Anthropic همچنین از Haiku 5.5، مدلی کم‌هزینه‌تر برای استفاده در مقیاس بالا، خبر داده، اما می‌گوید این مدل طی هفته‌های آینده عرضه خواهد شد.

چرا مهم است

برای کسانی که از Claude در برنامه‌نویسی یا کارهای اداری استفاده می‌کنند، Sonnet 5.5 ممکن است بدون دریافت نرخ‌های بالاتر توکنِ مدل برتر Anthropic، نتیجه‌هایی نزدیک به آن ارائه دهد. صرفه‌جویی ادعاشده به مصرف توکن کمتر در هر کار بستگی دارد؛ بنابراین هزینه واقعی متغیر خواهد بود و هنوز باید مستقلاً بررسی شود.

آیا این مقاله مفید بود؟

منابع و ارجاع‌ها

#منبعرسانهتاریخنکته اصلی
1Anthropic's Claude Sonnet 5.5 nearly matches Opus 5.5 on benchmarks while costing up to 30 percent less per task ↗The Decoder۶ مهر ۱۴۰۵Anthropic has released Claude Sonnet 5.5, the second model in its Claude 5.5 family.

1 منبع

آخرین به‌روزرسانی:

Oossallms.txt.md

اشتراک‌گذاری

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.

Anthropic مدل Claude Sonnet 5.5 را با همان قیمت توکن عرضه کرد – Oossa