شرکت OpenAI هفته گذشته با غرور از مدل پیشرفته Astra به‌عنوان یکی از مهم‌ترین دستاوردهای علمی خود نام برده بود. اما حالا، تنها چند روز پس از آن تمجید، این شرکت اعلام کرده که روند فعالیت‌های داخلی مرتبط با توسعه Astra را متوقف می‌کند. دلیل این تصمیم، شناسایی قابلیت‌هایی در مدل هوش مصنوعی Astra است که می‌تواند برای انجام حملات سایبری قدرتمند به کار گرفته شود.

نگرانی‌های سایبری و چارچوب آمادگی OpenAI

OpenAI در بیانیه‌ای رسمی توضیح داد که «ارزیابی‌های داخلی اخیر از Astra، یکی از مدل‌های آینده ما، طی روزهای گذشته پیشرفت‌های چشمگیری را در حوزه کدنویسی عامل‌محور و امنیت سایبری نشان داده است.» این یافته‌ها در کنار بررسی‌های انجام‌شده توسط کارشناسان، شرکت را به این جمع‌بندی رسانده که «نمی‌توان توانمندی‌های حیاتی سایبری را بر اساس چارچوب آمادگی ما نادیده گرفت.»

چارچوب آمادگی OpenAI موقعیت‌هایی را تعریف می‌کند که در آن‌ها، اگر یک مدل تازه در حوزه‌هایی مانند «زیست‌شناسی»، «امنیت سایبری» و «خودبهبودی هوش مصنوعی» به سطح مشخصی از توانایی برسد، توسعه آن باید «متوقف شود». در بخش امنیت سایبری، آستانه «بحرانی» به این معناست که مدل قادر باشد «آسیب‌پذیری‌های روز صفر با هر میزان شدت» را در «سیستم‌های واقعیِ مقاوم‌سازی‌شده» و بدون نیاز به کمک انسان شناسایی کند. این سطح همچنین شامل توانایی مدل برای طراحی و اجرای «استراتژی‌های نوآورانه و جامع برای حملات سایبری علیه اهداف مقاوم‌سازی‌شده» تنها با دریافت یک «هدف کلی دلخواه» است.

اقدامات احتیاطی و شفافیت

OpenAI در پاسخ به نگرانی‌های مطرح‌شده درباره خطرات امنیتی احتمالی مدل هوش مصنوعی Astra اعلام کرده که در حال «اجرای کنترل‌های امنیتی سخت‌گیرانه‌تر» برای این مدل است. این تدابیر شامل ایجاد «محیط‌های تست ایزوله»، «دسترسی محدود به شبکه و ابزار» و مجموعه‌ای از اقدامات محافظتی دیگر می‌شود. در حال حاضر، OpenAI «فعالیت‌های داخلی مربوط به آسترا را که هنوز این الزامات تقویت‌شده کنترل امنیتی را برآورده نمی‌کنند، متوقف کرده است.»

این شرکت همچنین تأکید کرد که دلیل انتشار این هشدار درباره Astra، اهمیت «شفافیت با عموم مردم» در خصوص توانایی‌های بالقوه این مدل است.

OpenAI