اخبار

“کلود اوپوس ۵.۵: هوش بیشتر با هزینه کمتر از آنتروپیک!”

به گزارش خبرنگار پایگاه خبری، مدل جدید Claude Opus 5.5 از شرکت Anthropic با وعده بهبود عملکرد، دقت، ارتباط و ایمنی قوی‌تر معرفی شده است. این مدل قادر است پاسخ‌ها را بیش از ۳۰ درصد سریع‌تر تولید کند و هزینه‌های اجرایی آن تقریباً ۴۰ درصد کمتر از Opus 5 است. Anthropic همچنین محدودیت‌های استفاده برای مشترکین Pro، Max، Team و Enterprise را افزایش داده است.

در حوزه هوش مصنوعی، عملکرد، دقت و قیمت از مهم‌ترین عوامل برای کاربران حرفه‌ای به شمار می‌روند. با عرضه Claude Opus 5، Anthropic نتایج قابل توجهی در زمینه‌های عملکرد و دقت به دست آورد، اما دسترسی به این مدل هزینه بالایی داشت. با معرفی مدل جدید، این نگرانی کاهش یافته است.

Anthropic امروز Claude Opus 5.5 را معرفی کرد که نه تنها بهبودهایی در عملکرد و دقت ارائه می‌دهد، بلکه هزینه‌های اجرایی آن نیز به میزان تقریبی ۴۰ درصد کاهش یافته است. به گفته این شرکت، این مدل بهترین عملکرد را در میان مدل‌های آزمایش شده تا به امروز دارد. البته با این بهبودها، نگرانی‌هایی نیز وجود دارد که Anthropic اعلام کرده است با تدابیر جدید به آن‌ها رسیدگی خواهد کرد.

مدل جدید بهبود یافته در ارتباطات است. Anthropic اعلام کرده است که این موضوع برای کاربران Opus 5 یک نگرانی بوده است. به گفته آزمایش‌کنندگان اولیه، Opus 5.5 ارتباطات طبیعی‌تری برقرار می‌کند و نوشتار آن واضح‌تر و آسان‌تر قابل پیگیری است. پیام‌ها به راحتی قابل درک هستند که به گفته آزمایش‌کنندگان، در طول جلسات کاری طولانی مفید است. یکی از مهندسان Ramp نوشت: “خروجی‌های طولانی و دشوار برای پیگیری، بزرگ‌ترین مشکل من با مدل‌های پیشرفته بود و Claude Opus 5.5 این مشکل را حل کرده است. این مدل مانند یک همکار خوب می‌نویسد و قوانین نوشتاری ما را رعایت می‌کند.”

در زمینه عملکرد، Opus 5.5 از مدل‌هایی مانند Fable 5.1، Opus 5، GPT-6 Astra و GPT-5.6 Sol در معیارهایی مانند کدنویسی، کارهای علمی، استدلال چندرشته‌ای، استفاده از کامپیوتر و شناسایی نمودارهای بصری پیشی گرفته است. در معیارهایی مانند جریان‌های کاری تجاری و تحقیقات علمی، این مدل در رتبه دوم قرار دارد و تنها از GPT-6 Astra عقب‌تر است، در حالی که خروجی آن ۳۰ درصد سریع‌تر از Opus 5 تولید می‌شود.

البته معیارها تنها بخشی از داستان را روایت می‌کنند، بنابراین Anthropic شواهد واقعی را ارائه کرده است. به گفته این شرکت، یکی از آزمایش‌کنندگان اولیه توانسته است یک کد ۲۰۰,۰۰۰ خطی را در کمتر از سه ساعت بررسی و اصلاح کند. Opus 5 برای انجام همین کار بیش از ۲۰ ساعت و ۲.۵ برابر توکن بیشتری نیاز داشت. به همین ترتیب، در آزمایشی که مدل هوش مصنوعی را موظف به ترجمه نرم‌افزار از C به Rust کرده بود، Opus 5.5 به مدت ۹.۵ ساعت زمان نیاز داشت، در حالی که Fable 5.1 برای انجام همین کار ۱۲ ساعت صرف کرد.

Anthropic همچنین نمونه‌هایی از بهبودهای مشابه در کارایی و هوش را از آزمایش‌کنندگان اولیه در GitHub، Clio، Lovable، Quantum، Spotify و دیگران به اشتراک گذاشت. آزمایش‌کننده در GitHub دریافت که این مدل در انجام وظایف ترمینالی بیشتر از Opus 5 در کمتر از نصف مراحل موفق بوده است، در حالی که آزمایش‌کننده در Spotify این مدل را به خاطر توانایی‌اش در انجام وظایف با هزینه و زمان کمتر نسبت به مدل‌های قبلی ستایش کرد.

علاوه بر این، Anthropic به قابلیت طبقه‌بندی داخلی مدل اشاره کرد که به طور اساسی هر عمل را قبل از اجرا بررسی می‌کند. این مدل همچنین به طور گزارش شده‌ای دارای دفاع‌های قوی‌تری نسبت به نسخه‌های قبلی است. این مدل در کاهش حملات تزریق دستوری در هر زمینه‌ای، از جمله کدنویسی، استفاده از ابزارها، استفاده از کامپیوتر و مرور وب، با Opus 5 برابری می‌کند یا از آن پیشی می‌گیرد. به گفته این شرکت، “در یک معیار که توسط شرکت امنیتی هوش مصنوعی Gray Swan انجام شد، Opus 5.5 با Fable 5.1 برای پایین‌ترین نرخ موفقیت تزریق دستوری در میان تمام مدل‌های آزمایش شده برابر است.”

شاید بزرگ‌ترین جذابیت اینجا این باشد که Anthropic برای تمام این بهبودها هزینه بیشتری از شما دریافت نمی‌کند. قیمت API از ۵ دلار برای Opus 5 به ۴ دلار برای Opus 5.5 به ازای هر میلیون توکن ورودی کاهش یافته است. به همین ترتیب، قیمت برای هر میلیون توکن خروجی از ۲۵ دلار به ۲۰ دلار کاهش یافته است. هزینه‌های خواندن کش ۰.۲۰ دلار به ازای هر میلیون توکن است که از ۰.۵۰ دلار کاهش یافته، در حالی که هزینه‌های نوشتن کش ۵ دلار به ازای هر میلیون توکن است که از ۶.۲۵ دلار کاهش یافته است. به گفته این شرکت، به طور کلی، با بهبودهای در کارایی توکن، اجرای Opus 5.5 به طور تقریبی ۴۰ درصد کمتر از Opus 5 در بارهای کاری معمولی هزینه خواهد داشت.

مهم‌تر از همه، شما واقعاً نیازی به توسعه‌دهنده بودن یا استفاده از API‌ها برای دسترسی به Claude Opus 5.5 ندارید. این مدل برای کاربران عادی نیز در دسترس است و دارای محدودیت‌های استفاده پنج ساعته برای برنامه‌های Pro، Max، Team و Enterprise مبتنی بر صندلی است. اطلاعات بیشتر، از جمله نظرات دقیق آزمایش‌کنندگان اولیه، در پست وبلاگ Anthropic که در بالا لینک شده است، موجود است.

نوشته های مشابه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *