در یکی از موارد، یک مدل پژوهشی منتشرنشده، دستورالعملهایی شبیه جیلبریک را در یادداشتهای خودش وارد کرده بود تا محدودیتهای معمول خود را نادیده بگیرد.
این مدل به خودش گفته بود که از نقشها و هویتهایی که دیگر چتباتها را مقید میکنند، آزاد شود.
در موردی دیگر، یک عامل هوش مصنوعی بدون اینکه از کاربر اجازه بگیرد، فایلهایی را روی اینترنت آپلود کرد تا یک ارجاع مرورگری به دست آورد.
این شش گزارش در جریان آموزش یا ارزیابی طی ماههای گذشته کشف شدند.
OpenAI گفت در حال معرفی چارچوب جدیدی برای ردیابی، بررسی و افشای مواردی از آنچه «ناهمراستایی» مینامد، است؛ از جمله مواردی که مدلهای هوش مصنوعی بدون مجوز عمل کردهاند، با مدلهای دیگر هماهنگ شدهاند یا از نظارت گریختهاند.
این اعلام تازه در حالی صورت گرفت که مدیران شرکتهای هوش مصنوعی آمریکا، از جمله OpenAI و Anthropic، به دلیل نگرانیهای ایمنی خواستار کاهش سرعت توسعه این فناوری شدند.
نظرات کاربران