شرکت OpenAI هفته گذشته با غرور از مدل پیشرفته Astra بهعنوان یکی از مهمترین دستاوردهای علمی خود نام برده بود. اما حالا، تنها چند روز پس از آن تمجید، این شرکت اعلام کرده که روند فعالیتهای داخلی مرتبط با توسعه Astra را متوقف میکند. دلیل این تصمیم، شناسایی قابلیتهایی در مدل هوش مصنوعی Astra است که میتواند برای انجام حملات سایبری قدرتمند به کار گرفته شود.
نگرانیهای سایبری و چارچوب آمادگی OpenAI
OpenAI در بیانیهای رسمی توضیح داد که «ارزیابیهای داخلی اخیر از Astra، یکی از مدلهای آینده ما، طی روزهای گذشته پیشرفتهای چشمگیری را در حوزه کدنویسی عاملمحور و امنیت سایبری نشان داده است.» این یافتهها در کنار بررسیهای انجامشده توسط کارشناسان، شرکت را به این جمعبندی رسانده که «نمیتوان توانمندیهای حیاتی سایبری را بر اساس چارچوب آمادگی ما نادیده گرفت.»

چارچوب آمادگی OpenAI موقعیتهایی را تعریف میکند که در آنها، اگر یک مدل تازه در حوزههایی مانند «زیستشناسی»، «امنیت سایبری» و «خودبهبودی هوش مصنوعی» به سطح مشخصی از توانایی برسد، توسعه آن باید «متوقف شود». در بخش امنیت سایبری، آستانه «بحرانی» به این معناست که مدل قادر باشد «آسیبپذیریهای روز صفر با هر میزان شدت» را در «سیستمهای واقعیِ مقاومسازیشده» و بدون نیاز به کمک انسان شناسایی کند. این سطح همچنین شامل توانایی مدل برای طراحی و اجرای «استراتژیهای نوآورانه و جامع برای حملات سایبری علیه اهداف مقاومسازیشده» تنها با دریافت یک «هدف کلی دلخواه» است.
اقدامات احتیاطی و شفافیت
OpenAI در پاسخ به نگرانیهای مطرحشده درباره خطرات امنیتی احتمالی مدل هوش مصنوعی Astra اعلام کرده که در حال «اجرای کنترلهای امنیتی سختگیرانهتر» برای این مدل است. این تدابیر شامل ایجاد «محیطهای تست ایزوله»، «دسترسی محدود به شبکه و ابزار» و مجموعهای از اقدامات محافظتی دیگر میشود. در حال حاضر، OpenAI «فعالیتهای داخلی مربوط به آسترا را که هنوز این الزامات تقویتشده کنترل امنیتی را برآورده نمیکنند، متوقف کرده است.»

این شرکت همچنین تأکید کرد که دلیل انتشار این هشدار درباره Astra، اهمیت «شفافیت با عموم مردم» در خصوص تواناییهای بالقوه این مدل است.