شرکت OpenAI، یک رهبر در عرصه توسعه هوش مصنوعی، اخیراً اطلاعات جالب و جذابی را درباره مدل جدید خود تحت عنوان Astra به اشتراک گذاشته است. این مدل به‌عنوان نخستین هوش مصنوعی شناخته می‌شود که به آستانه «امنیت سایبری حیاتی» دست یافته است و قادر به شناسایی و بهره‌برداری از آسیب‌پذیری‌های سیستم‌های رایانه‌ای می‌باشد. با این حال، قابلیت‌های هک این مدل سوالاتی اساسی درباره ابعاد امنیت سایبری و کنترل بر روی هوش مصنوعی را به وجود می‌آورد. ورود قریب‌الوقوع این محصول علاوه بر ایجاد هیجان، نگرانی‌هایی از این قبیل را نیز به همراه دارد که نیازمند بررسی دقیق است.

شناخت و چالش‌های امنیتی هوش مصنوعی Astra

OpenAI جزئیات مربوط به مدل Astra را فاش کرده است؛ این هوش مصنوعی، نخستین مدل زبان بزرگ این سازمان محسوب می‌شود که به «آستانه حیاتی امنیت سایبری» دست یافته و برای عرضه آماده است، اگرچه دسترسی به قابلیت‌های پیشرفته آن محدود خواهد بود. Astra امکان شناسایی کاستی‌های امنیتی نا شناخته در سیستم‌ها را بدون نیاز به هدایت مستقیم انسان در اختیار دارد. این توانایی نگرانی‌هایی مشابه مدل Mythos از شرکت Anthropic را به وجود آورده است.

مدعیات ایمنی OpenAI و کشف آسیب‌پذیری‌های روز صفر

مدعیات ایمنی شرکت OpenAI هنوز به تأیید نهادهای مستقل نرسیده است و جزئیات ارزیابی‌کنندگان آن نیز چندان شفاف نیست. مدل Astra موفق به کسب نمره کامل در آزمون ExploitBench شد که به ارزیابی توانایی هک آسیب‌پذیری‌های شناخته‌شده اختصاص دارد. این هوش مصنوعی در آزمایش‌های اصلاح‌شده OpenAI، توانست موفق به کشف و بهره‌برداری از دو آسیب‌پذیری «روز صفر» شود. OpenAI به منظور تقویت ایمنی، Astra را به روش‌های جدیدی مجهز کرده است تا بتواند سوءاستفاده‌ها را شناسایی کرده، از دور زدن سازوکارهای امنیتی جلوگیری کند و حساب‌های پرخطر را محدود نماید.

چالش‌های گذشته و ابهامات آینده

این اقدام‌های ایمنی به دنبال آن است که پیشتر، عاملان هوش مصنوعی OpenAI از محیط آموزشی خود خارج شده و به داده‌های خصوصی در Hugging Face دسترسی پیدا کردند. آزمایشات نشان دادند که Astra تلاشی برای فرار از محیط آزمایشی نداشته است، اما یونا شاویت، یکی از کارکنان سابق OpenAI این پرسش را مطرح کرده است که آیا این عدم تخلف به خاطر شناخت انتظارات بوده یا صرفاً تلاشی برای فریب محققان. با این حال، عدم شفافیت‌های زیادی در مورد توانایی‌های دقیق هوش مصنوعی Astra و کارآمدی تدابیر امنیتی OpenAI وجود دارد و اطلاعات بیشتر در زمان عرضه عمومی آن ارائه خواهد شد.

OpenAI