“کلود اوپوس ۵.۵: هوش بیشتر با هزینه کمتر از آنتروپیک!”

به گزارش خبرنگار پایگاه خبری، مدل جدید Claude Opus 5.5 از شرکت Anthropic با وعده بهبود عملکرد، دقت، ارتباط و ایمنی قویتر معرفی شده است. این مدل قادر است پاسخها را بیش از ۳۰ درصد سریعتر تولید کند و هزینههای اجرایی آن تقریباً ۴۰ درصد کمتر از Opus 5 است. Anthropic همچنین محدودیتهای استفاده برای مشترکین Pro، Max، Team و Enterprise را افزایش داده است.
در حوزه هوش مصنوعی، عملکرد، دقت و قیمت از مهمترین عوامل برای کاربران حرفهای به شمار میروند. با عرضه Claude Opus 5، Anthropic نتایج قابل توجهی در زمینههای عملکرد و دقت به دست آورد، اما دسترسی به این مدل هزینه بالایی داشت. با معرفی مدل جدید، این نگرانی کاهش یافته است.
Anthropic امروز Claude Opus 5.5 را معرفی کرد که نه تنها بهبودهایی در عملکرد و دقت ارائه میدهد، بلکه هزینههای اجرایی آن نیز به میزان تقریبی ۴۰ درصد کاهش یافته است. به گفته این شرکت، این مدل بهترین عملکرد را در میان مدلهای آزمایش شده تا به امروز دارد. البته با این بهبودها، نگرانیهایی نیز وجود دارد که Anthropic اعلام کرده است با تدابیر جدید به آنها رسیدگی خواهد کرد.
مدل جدید بهبود یافته در ارتباطات است. Anthropic اعلام کرده است که این موضوع برای کاربران Opus 5 یک نگرانی بوده است. به گفته آزمایشکنندگان اولیه، Opus 5.5 ارتباطات طبیعیتری برقرار میکند و نوشتار آن واضحتر و آسانتر قابل پیگیری است. پیامها به راحتی قابل درک هستند که به گفته آزمایشکنندگان، در طول جلسات کاری طولانی مفید است. یکی از مهندسان Ramp نوشت: “خروجیهای طولانی و دشوار برای پیگیری، بزرگترین مشکل من با مدلهای پیشرفته بود و Claude Opus 5.5 این مشکل را حل کرده است. این مدل مانند یک همکار خوب مینویسد و قوانین نوشتاری ما را رعایت میکند.”
در زمینه عملکرد، Opus 5.5 از مدلهایی مانند Fable 5.1، Opus 5، GPT-6 Astra و GPT-5.6 Sol در معیارهایی مانند کدنویسی، کارهای علمی، استدلال چندرشتهای، استفاده از کامپیوتر و شناسایی نمودارهای بصری پیشی گرفته است. در معیارهایی مانند جریانهای کاری تجاری و تحقیقات علمی، این مدل در رتبه دوم قرار دارد و تنها از GPT-6 Astra عقبتر است، در حالی که خروجی آن ۳۰ درصد سریعتر از Opus 5 تولید میشود.
البته معیارها تنها بخشی از داستان را روایت میکنند، بنابراین Anthropic شواهد واقعی را ارائه کرده است. به گفته این شرکت، یکی از آزمایشکنندگان اولیه توانسته است یک کد ۲۰۰,۰۰۰ خطی را در کمتر از سه ساعت بررسی و اصلاح کند. Opus 5 برای انجام همین کار بیش از ۲۰ ساعت و ۲.۵ برابر توکن بیشتری نیاز داشت. به همین ترتیب، در آزمایشی که مدل هوش مصنوعی را موظف به ترجمه نرمافزار از C به Rust کرده بود، Opus 5.5 به مدت ۹.۵ ساعت زمان نیاز داشت، در حالی که Fable 5.1 برای انجام همین کار ۱۲ ساعت صرف کرد.
Anthropic همچنین نمونههایی از بهبودهای مشابه در کارایی و هوش را از آزمایشکنندگان اولیه در GitHub، Clio، Lovable، Quantum، Spotify و دیگران به اشتراک گذاشت. آزمایشکننده در GitHub دریافت که این مدل در انجام وظایف ترمینالی بیشتر از Opus 5 در کمتر از نصف مراحل موفق بوده است، در حالی که آزمایشکننده در Spotify این مدل را به خاطر تواناییاش در انجام وظایف با هزینه و زمان کمتر نسبت به مدلهای قبلی ستایش کرد.
علاوه بر این، Anthropic به قابلیت طبقهبندی داخلی مدل اشاره کرد که به طور اساسی هر عمل را قبل از اجرا بررسی میکند. این مدل همچنین به طور گزارش شدهای دارای دفاعهای قویتری نسبت به نسخههای قبلی است. این مدل در کاهش حملات تزریق دستوری در هر زمینهای، از جمله کدنویسی، استفاده از ابزارها، استفاده از کامپیوتر و مرور وب، با Opus 5 برابری میکند یا از آن پیشی میگیرد. به گفته این شرکت، “در یک معیار که توسط شرکت امنیتی هوش مصنوعی Gray Swan انجام شد، Opus 5.5 با Fable 5.1 برای پایینترین نرخ موفقیت تزریق دستوری در میان تمام مدلهای آزمایش شده برابر است.”
شاید بزرگترین جذابیت اینجا این باشد که Anthropic برای تمام این بهبودها هزینه بیشتری از شما دریافت نمیکند. قیمت API از ۵ دلار برای Opus 5 به ۴ دلار برای Opus 5.5 به ازای هر میلیون توکن ورودی کاهش یافته است. به همین ترتیب، قیمت برای هر میلیون توکن خروجی از ۲۵ دلار به ۲۰ دلار کاهش یافته است. هزینههای خواندن کش ۰.۲۰ دلار به ازای هر میلیون توکن است که از ۰.۵۰ دلار کاهش یافته، در حالی که هزینههای نوشتن کش ۵ دلار به ازای هر میلیون توکن است که از ۶.۲۵ دلار کاهش یافته است. به گفته این شرکت، به طور کلی، با بهبودهای در کارایی توکن، اجرای Opus 5.5 به طور تقریبی ۴۰ درصد کمتر از Opus 5 در بارهای کاری معمولی هزینه خواهد داشت.
مهمتر از همه، شما واقعاً نیازی به توسعهدهنده بودن یا استفاده از APIها برای دسترسی به Claude Opus 5.5 ندارید. این مدل برای کاربران عادی نیز در دسترس است و دارای محدودیتهای استفاده پنج ساعته برای برنامههای Pro، Max، Team و Enterprise مبتنی بر صندلی است. اطلاعات بیشتر، از جمله نظرات دقیق آزمایشکنندگان اولیه، در پست وبلاگ Anthropic که در بالا لینک شده است، موجود است.





