کد خبر 714259
۱۴۰۵/۰۷/۰۸ ۱۱:۵۸

مدل هوش‌مصنوعی Claude Sonnet 5.5 آنتروپیک با تأکید بر برنامه‌نویسی و فعالیت‌های روزمره به بازار عرضه شد

ساعت 24 - مدل هوش‌مصنوعی Claude Sonnet 5.5 آنتروپیک با هدف تسریع فرآیندها و کاهش هزینه‌ها در انجام کارهای روزمره و با پیشرفت چشمگیر در زمینه کدنویسی معرفی گردید.
مدل هوش‌مصنوعی Claude Sonnet 5.5 آنتروپیک با تمرکز بر کدنویسی و کارهای روزمره معرفی شد

شرکت آنتروپیک (Anthropic) که در زمینه توسعه مدل‌های بزرگ زبانی پیشتاز است، به تازگی دومین نسخه از خانواده‌ی قوی خود با نام Claude 5.5 را به معرفی رسانده است. مدلی که به Sonnet 5.5 نام‌گذاری شده، به‌طور ویژه برای انجام وظایف روزمره با دامنه مشخص و کیفیت بالا طراحی شده است. مدلی با نام Opus 5.5 که بیشتر برای فعالیت‌های پیچیده و نیازمند تحلیل‌های عمیق به کار می‌رود، در حالی که Sonnet 5.5 با برقراری تعادل بین توان و کارایی، گزینه‌ای مناسب به شمار می‌آید. به زودی مدل Haiku 5.5 برای کاربردهای وسیع و کم‌هزینه به این مجموعه اضافه خواهد شد.

قابلیت‌های نوآورانه Claude Sonnet 5.5

Claude Sonnet 5.5 در مقایسه با مدل قبلی، یعنی Sonnet 5، پیشرفت‌های چشمگیری را در حوزه‌های عملکرد، برنامه‌نویسی، کار دانش‌بنیان، انجام وظایف بلندمدت، درک بصری، همکاری، سرعت و بهینه‌سازی کارایی به نمایش گذاشته است. آنتروپیک به نتایج زیر اشاره کرده است:

Claude Sonnet 5.5

Sonnet 5.5 قابلیت عمل در سطوح مختلف تلاش را داراست که می‌تواند تعادلی میان هزینه، سرعت و کیفیت خروجی ایجاد کند. آنتروپیک اعلام کرده است که در چندین آزمون، Sonnet 5.5 با حداکثر تلاش (Max effort) توانایی مشابهی با Opus 5.5 داشته و در سطوح پایین یا متوسط (Low or Medium effort)، قادر است بهترین امتیاز مدل Sonnet 5 را در برخی آزمون‌ها با هزینه‌ای معادل یک دهم کل هزینه به دست آورد.

پیشرفت در برنامه‌نویسی و افزایش کارایی

آنتروپیک همچنین نتایج شگفت‌انگیزی در زمینه برنامه‌نویسی Sonnet 5.5 به ثبت رسانده است:

آزمایش‌کنندگان اولیه اذعان کردند که Sonnet 5.5 می‌تواند به سرعت یک پایگاه کد (codebase) را تحلیل کند. نتایج آزمایش‌های مستقیم نشان می‌دهد که این مدل فراخوانی ابزارها را به شکلی مؤثرتر از Sonnet 5 انجام می‌دهد، که منجر به کاهش مراحل و هزینه‌ها می‌شود.

Claude Sonnet 5.5

کار دانش‌بنیان و قابلیت‌های توسعه‌یافته

Sonnet 5.5 در چندین زمینه کار دانش‌بنیان نیز موفق به بهبود عملکرد شده است. آنتروپیک اعلام کرد که این مدل در آزمون GDPval-AA که وظایف واقعی را در ۴۴ شغل و ۹ صنعت اصلی پوشش می‌دهد، تقریباً با عملکردی هم‌سطح با Opus 5.5 عمل کرده و حدود ۴۰۰ امتیاز بالاتر از Sonnet 5 قرار گرفته است. همچنین در استفاده از کامپیوتر و تشخیص نمودارها، Sonnet 5.5 به عملکردی نزدیک به Opus 5.5 دست یافته و در حوزه کارهای دانش‌بنیان بلندمدت نیز بهتر از Sonnet 5 و مدل GPT-6 Sol عمل کرده است.

Claude Sonnet 5.5

آزمایش‌کنندگان اولیه همچنین تغییراتی را در ارتباطات و وظایف مرتبط با طراحی مشاهده کردند، از جمله تبعیت از الگوهای اسلاید در حین ساخت ارائه‌ها. در یک آزمایش داخلی، آنتروپیک مواد درآمد فصلی و رونوشت‌های تماس یک شرکت عمومی را به همراه یک الگوی اسلاید در اختیار Sonnet 5.5 قرار داد و از این مدل درخواست کرد تا یک ارائه عملیاتی ۱۰ اسلایدی تولید کند؛ دو کارشناس پیش‌نویس اولیه را بدون نیاز به ویرایش‌های اضافی مناسب ارسال تشخیص دادند.

  • کلاود Opus 5.5 رونمایی شد؛ هوش مصنوعی جدید آنتروپیک هم قوی‌تر و هم مقرون به صرفه‌تر است

هزینه و سرعت: ۳۰٪ سریع‌تر و مقرون به صرفه‌تر

Sonnet 5.5 از سیاست قیمت‌گذاری توکن مشابه Sonnet 5 بهره می‌برد، لیکن آنتروپیک تأکید دارد که عموماً برای انجام کارهای مشابه، به توکن‌های کمتری نیاز دارد. در آزمایش‌های انجام شده توسط این شرکت، این موضوع منجر به کاهش هزینه‌های وظیفه تا ۳۰٪ در مقایسه با مدل قبلی شده است. قیمت‌گذاری توکن‌ها به شرح زیر است:

قیمت هر ۱ میلیون توکنClaude Sonnet 5.5Claude Opus 5.5
خواندن حافظه پنهان۰٫۲۰ دلار۰٫۲۹ دلار
نوشتن حافظه پنهان۲٫۵۰ دلار۵ دلار
توکن ورودی۲ دلار۴ دلار
توکن خروجی۱۰ دلار۲۰ دلار

Sonnet 5.5 می‌تواند خروجی‌ها را بیش از ۳۰٪ سریع‌تر از Sonnet 5 خلق کند و آنتروپیک آن را سریع‌ترین مدل از خانواده Sonnet تا به امروز به شمار می‌آورد. کاربران قادر هستند سطح تلاش را برای دست‌یابی به تعادل بین هزینه، سرعت و کیفیت خروجی تنظیم نمایند. تنظیمات پیش‌فرض تلاش شامل موارد زیر است:

  • Claude Code: متوسط
  • برنامه‌های آنتروپیک: متوسط
  • پلتفرم Claude: بالا

در محیط‌های با تنظیمات پایین‌تر، مدل با سرعت بیشتری به سوالات پاسخ می‌دهد و به توکن‌های کمتری نیاز دارد. در حالی که در تنظیمات بالاتر، مدل زمان بیشتری را صرف استدلال می‌کند و کار خود را با دقت بیشتری ارزیابی می‌نماید.

امنیت و هم‌ترازی

آنتروپیک بیان کرده است که Sonnet 5.5 توانمندی‌های مدل‌های پیشین را فراتر نمی‌برد، از این رو ارزیابی هم‌ترازی آن بر روی خطرات مرتبط با مدل‌ها در سطوح مختلف تمرکز داشته است. این ارزیابی شامل صفاتی چون: اقدام علیه منافع کاربران، گمراهی کاربران و همکاری در سوءاستفاده‌های خطرناک بود.

بازرسی خودکار رفتاری آنتروپیک نزدیک به ۱۸۵۰ سناریو را در بر می‌گیرد. Sonnet 5.5 در اکثر معیارهای هم‌ترازی، پایداری در برابر سوءاستفاده و صداقت، بهتر یا هم‌راستا با Sonnet 5 عمل می‌کند. در ارزیابی‌های جدیدتر در زمینه مهار، Sonnet 5.5 در تلاش برای فرار از محیط sandbox خود، نزدیک به Opus 5.5 عمل کرده است. آنتروپیک همچنین اعلام کرده است که Sonnet 5.5 کمترین احتمال را در بین مدل‌های آزمایش‌شده برای نقض محدودیت‌های محیطی خود داراست. در کل، بازرسی، اوپس 5.5 اندکی بهتر عمل کرد.

حفاظت‌های امنیتی بهبود یافته

قابلیت‌های امنیت سایبری Sonnet 5.5 نسبت به Sonnet 5 یک پیشرفت قابل توجه است و با Opus 5 قابل قیاس است. به همین دلیل، آنتروپیک این مدل را با سیستم‌های حفاظتی مشابه آنچه برای Opus 5.5 به کار رفته، مستقر کرده است.

Claude Sonnet 5.5

برای امنیت سایبری، این حفاظت‌ها شامل موارد زیر است:

  • توسعه نرم‌افزار به صورت روتین و رفع اشکالات همچنان تحت پشتیبانی قرار دارند.
  • وظایف امنیت سایبری با سطح بالای ریسک به Sonnet 5 ارجاع داده می‌شوند.
  • مدافعان سایبری به زودی قادر خواهند بود برای برنامه تأیید سایبری (Cyber Verification Program) درخواست دهند. این برنامه دسترسی چندسطحی به قابلیت‌های پیشرفته در مدل‌های Sonnet 5.5، Opus 5.5 و Claude Mythos را فراهم می‌آورد.

در حوزه زیست‌شناسی، Sonnet 5.5 از همان سازوکار حفاظتی Sonnet 5 بهره می‌برد که به طور خاص درخواست‌های مضر را هدف‌گذاری می‌کند، در حالی که عمده کارهای تحقیقاتی، آموزشی و بالینی تحت تأثیر قرار نمی‌گیرند. سازمان‌ها قادرند برای برنامه تأیید علوم زیستی (Life Sciences Verification Program) برای دستیابی به حفاظتی طراحی شده به منظور پشتیبانی از تمام حوزه‌های مرتبط با زیست‌شناسی درخواست دهند.

مقابله با استخراج مدل (Distillation)

آنتروپیک همچنین به خطر استخراج مدل (distillation) پرداخته است؛ روشی که از طریق آن، حساب‌های جعلی متعدد می‌توانند برای دستیابی به قابلیت‌های یک مدل در مقیاس وسیع بهره‌برداری شوند و به مهاجمان اجازه می‌دهند تا مدل‌های کارآمدی را بدون وجود حفاظت‌های لازم در Claude بسازند.

چون Sonnet 5.5 به‌طور چشمگیری از مدل قبلی خود قدرتمندتر است، این اولین مدل Sonnet است که با طبقه‌بندی‌کننده‌های امنیتی (safety classifiers) ارائه می‌شود که از استخراج استدلال جلوگیری می‌کنند. همچنین قابلیت حفظ تفکر (preserved thinking) را گسترش می‌دهد تا تفکرات Claude قادر به جداسازی از حساب کاربری که آن را ایجاد کرده، نباشد. این اقدامات شامل موارد زیر است:

  • طبقه‌بندی‌کننده‌های امنیتی: جلوگیری از استخراج استدلال از Sonnet 5.5.
  • تفکر حفظ شده: تفکر Claude نمی‌تواند از حسابی که آن را ایجاد کرده جدا شود.

عمده توسعه‌دهندگان تغییری را احساس نخواهند کرد، اما نقل و انتقالات مکالمات بین حساب‌ها ممکن است با مشکلاتی مواجه شود، از جمله تغییر حساب‌ها در طول یک نشست Claude Code.

قیمت‌گذاری و در دسترس بودن

همچون Opus 5.5 و Sonnet 5، مدل Claude Sonnet 5.5 با قوانین حفظ صفر داده (zero data retention) به کاربران ارائه می‌شود. این مدل در حال حاضر در تمامی پلتفرم‌ها ازجمله آمازون وب سرویسز (Amazon Web Services)، گوگل کلاد (Google Cloud)، مایکروسافت اژور (Microsoft Azure) و پلتفرم Claude در دسترس است. توسعه‌دهندگان می‌توانند از طریق شناسه مدل claude-sonnet-5-5 استفاده از Sonnet 5.5 را در پلتفرم Claude آغاز کنند.

برای توسعه‌دهندگانی که قصد مهاجرت از Sonnet 5 را دارند: در صورتی که قابلیت تفکر غیرفعال باشد، باید قبل از انتقال به Sonnet 5.5 به تنظیمات جدید between_tools سوئیچ کنند. این تنظیم، تفکر اولیه را غیرفعال نگه می‌دارد. آنتروپیک همچنین راهنمایی برای این انتقال فراهم کرده است. مدل Claude Haiku 5.5 که برای کاربردهای گسترده و حساس به هزینه طراحی شده، انتظار می‌رود در هفته‌های پیش رو به خانواده Claude 5.5 بپیوندد.

آنتروپیک

نظرات کاربران

نظر شما

ساعت 24 از انتشار نظرات حاوی توهین، افترا، لینک، تبلیغات و نوشته‌شده با حروف لاتین معذور است.

هنوز نظری برای این خبر تایید نشده است.