طبق گزارش خبرگزاری خبرآنلاین و به نقل از زومیت، اوپن‌ای‌آی به تازگی از جدیدترین مدل زبانی خود با عنوان GPT-6 Astra رونمایی کرده است. این مدل به‌عنوان یک پیشرفت قابل توجه در زمینه‌های امنیت سایبری، فعالیت‌های حرفه‌ای، مهندسی نرم‌افزار و علم کامپیوتر قلمداد شده است.

رونمایی از این مدل تنها به یک معرفی فنی محدود نشد و به سرعت به مباحث عمیق‌تری درباره «عصر AGI» پیوند خورد؛ به‌ویژه جایی که گرگ براکمن و سایر مدیران اوپن‌ای‌آی تلاش کردند تا قابلیت‌های جدید را زمینه‌ساز توانمندی بیشتر و کنترل دقیق‌تر این مدل توصیف کنند.

شرکت اعلام کرده که GPT-6 Astra به نخستین مدلی تبدیل شده که به «آستانه توانمندی سایبری حیاتی» رسیده است، هرچند در عین حال تضمین می‌کند که این قابلیت‌ها منجر به تکرار وقایع ناگوار پیشین نخواهند شد.

رئیس اوپن‌ای‌آی: به عصر AGI خوش آمدید

گریگ براکمن، مدیرعامل اوپن‌ای‌آی، در یک نشست خبری اعلام کرد اگر چند سال آینده به گذشته برگردیم و از شکل‌گیری واقعی هوش مصنوعی عمومی (AGI) بپرسیم، احتمالاً به همین دوره و به‌ویژه همین مدل اشاره خواهیم کرد. او همچنین تصریح کرد که اکنون می‌توانیم آغاز «عصر AGI» را اعلام کنیم و در پایان سخنانش به خبرنگاران گفت: «به عصر AGI خوش آمدید.»

این رونمایی بیش از یک سال پس از عرضه‌ی GPT-5 و حدود دو ماه بعد از ارائه‌ی GPT-5.6 صورت گرفت. آغاز عرضه‌ی GPT-6 Astra از امروز برای مشتریان سازمانی امنیت سایبری اوپن‌ای‌آی آغاز خواهد شد و براکمن اعلام کرد که این خدمات در چند روز آینده برای تمامی کاربران Plus، Pro، Business و Enterprise فعال می‌شود.

OpenAI

در معرفی Astra، اوپن‌ای‌آی به‌ویژه بر توانایی‌های عامل‌محور و مهارت در کدنویسی تأکید داشت؛ تلاش‌هایی واضح برای جذب مشتریان سازمانی و رقابت مستقیم با آنتروپیک، رقیبی قوی در بازار ابزارهای سازمانی و برنامه‌نویسی، که اوپن‌ای‌آی امیدوار است پیش از ورود به بازار عمومی سهام خود به آن نزدیک شود.

گزارش‌ها حاکی از آن است که GPT-6 Astra قادر به انجام وظایف چندمرحله‌ای عامل‌محور، ساخت وب‌سایت‌های کاربردی و تولید اسناد، جدول‌ها و ارائه‌های دقیقی است. اوپن‌ای‌آی همچنین این مدل را «بهترین مدل خود در زمینه مهندسی نرم‌افزار» نامید و مدعی شد که در کار با کد پایه‌های واقعی و پیچیده عملکرد بهتری دارد.

در ویدیوی تبلیغاتی این شرکت، نمایی از یک دمو قدیمی از دهه ۱۹۸۰ به نمایش درآمد که در آن کاربر از کامپیوتر خواست تا یک دایره زرد بکشد. سپس داستان به زمان حاضر منتقل می‌شود، جایی که کارمندان اوپن‌ای‌آی با استفاده از فرمان‌های صوتی از Astra درخواست می‌کنند تا همین دایره را به یک موشک، سپس به یک بازی سه‌بعدی تبدیل کند و حتی یک آگهی در eBay بسازد. تمام فرآیند تنها با ورودی صوتی پیش رفت.

منطق تجاری Astra بر اساس «کار با کامپیوتر» شکل گرفته است

تاکید منطقی تجاری Astra بر «کار با کامپیوتر» است. اوپن‌ای‌آی بیان کرده که این مدل می‌تواند فرم‌های آنلاین را پر کند، رکوردهای CRM را به‌روزرسانی کند، تقویم‌ها را مدیریت کند، وب‌گردی کند و نتایج آن را در یک سند یا ایمیل ثبت کند. همچنین قابلیت کار با صفحه‌گسترده‌ها، تحلیل داده‌های علمی از طریق دفترچه‌های پایتون، کار در Power BI، ساخت و آزمایش وب‌سایت و اجرای نرم‌افزارهای مهندسی نظیر KiCad و FreeCAD و صرفه‌جویی و عیب‌یابی نرم‌افزارها نیز مطرح شده است.

این توانایی‌ها می‌تواند به گفته‌ی شرکت، تغییرات اساسی در معماری رایج هوش مصنوعی‌های سازمانی ایجاد کند. در سال‌های اخیر، کسب‌وکارها ناگزیر بودند که مدل‌ها را با استفاده از APIها، افزودنی‌ها، سیستم‌های بازیابی و ابزارهای خاص به سیستم‌های داخلی متصل کنند. براکمن اشاره کرد که عامل‌های مبتنی بر کار با کامپیوتر ممکن است بتوانند برخی از این موانع اتصالی را دور بزنند، چرا که نرم‌افزارها همواره با یک رابط عمومی که انسان‌ها نیز از آن استفاده می‌کنند، در دسترس هستند.

او در جلسه خبری افزود که کاربران و شرکت‌ها در «یک عصر بزرگ» با چالش‌هایی مواجه بوده‌اند که نتیجه نیاز به ایجاد کانکتورهای پیچیده و انجام اتصالات دقیق برای ابزارهای مختلف بوده است. براکمن بیان کرد که اگر مدل به اندازه کافی کارآمد باشد، می‌تواند «در میان صفحه‌گسترده‌ها حرکت کند، فرم‌ها را پر کند و در صفحات وب جست‌وجو کند.»

وی همچنین تأکید کرد که این ایده به نخستین روزهای فعالیت اوپن‌ای‌آی بازمی‌گردد؛ زمان‌هایی که محققان در تلاش بودند تا عاملی را آموزش دهند که بر ورودی‌ها و خروجی‌های انسانی با تمرکز بر کار با کامپیوتر، یعنی پیکسل، کیبورد و ماوس، تکیه کند. او خاطرنشان کرد که احساس می‌کند شرکت «نخستین عاملی را به دست آورده که واقعاً قادر است این کار را به‌طرزی مؤثر انجام دهد.»

Astra نزدیک به ۴۷ درصد سریع‌تر از نسل قبلی عمل می‌کند

اوپن‌ای‌آی اعلام کرده که Astra در بخش آفلاین از OSWorld 2.0 امتیاز ۷۲٫۶ درصد را به‌دست آورده و برای هر وظیفه حدود ۴۰ دقیقه زمان مصرف کرده است. در مقایسه، GPT-5.6 Sol امتیاز ۶۵٫۷ درصد و حدود ۷۵ دقیقه برای هر وظیفه نیاز داشت. براساس اندیکاتورها، Astra نزدیک به ۴۷ درصد سریع‌تر عمل کرده است.

شرکت همچنین نشان داد که این مدل قادر است از ساخت یک بازی سه‌بعدی تا تولید یک تفاهم‌نامه حقوقی را انجام دهد و در عین حال درخواست‌های نامرتبط دیگری را نیز مدیریت کند. پیام کلی روشن بود: Astra دیگر تنها یک چت‌بات ساده نیست.

میا گلیس، محقق اوپن‌ای‌آی، در جلسه خبری گفت که کاربران اکنون با Astra «توانایی‌هایی در دسترس دارند» که به نظر می‌رسید کمتر از یک سال پیش غیرممکن باشد. او توضیح داد که با چنین توانایی‌هایی، افراد می‌توانند کارهای پیچیده‌تری را به این مدل واگذار کنند و خود در سطحی بالاتر کار را هدایت کنند.

به‌نظر می‌رسد این تغییر رویکرد، از «اعطای دستورات به هوش مصنوعی» به «نظارت بر هوش مصنوعی»، برای کسب‌وکارها بااهمیت‌تر از پیشرفت‌های دیگر در معیارهای علمی باشد.

عددها، ادعاها و پیشرفت‌های آموزشی

آیدن کلارک، محقق اوپن‌ای‌آی، در این نشست Astra را نتیجه بزرگ‌ترین پیشرفت آموزشی در تاریخ این شرکت توصیف کرد. او اظهار داشت که این نخستین مدل اوپن‌ای‌آی است که با بیش از ۱۰۰٬۰۰۰ واحد در زیرساخت Stargate آموزش داده شده و نخستین مدلی است که در آن، مدل‌های قبلی نقش کلیدی در نظارت بر آموزش نسل جدید ایفا کرده‌اند.

کلارک تصریح کرد که بر اساس ارزیابی‌هایی که در مرحله پیش‌آموزش انجام شده، انتقال از Sol به Astra بزرگ‌تر از انتقال Sol نسبت به مدل‌های پیشین بوده است. اوپن‌ای‌آی اعتقاد دارد که شتاب رشد Astra ناشی از ترکیب آموزش گسترده و یادگیری تقویتی بوده که برای گنجاندن ارتباط اطلاعات و اجرای وظایف بلندمدت طراحی شده است.

عددهای مربوط به بنچمارک‌ها چشمگیر هستند. اوپن‌ای‌آی گزارش داده که Astra موفق به کسب امتیاز ۹۷٫۶ درصد در FrontierMath Tier 4 v2، ۷۴٫۱ درصد در DeepSWE v1.1، ۹۵٫۹ درصد در BenchCAD، ۹۶ درصد در GPQA Diamond و ۱۰۰ درصد در ExploitBench شده است. همچنین این مدل در ARC-AGI-3 موفق به کسب ۹۸٫۶ درصد شده است.

با این حال، همین عدد آخر یک قید مهم دارد و به چالشی گسترده در حوزه زبان هوش مصنوعی اشاره می‌کند. ARC-AGI یکی از جدی‌ترین تلاش‌ها برای اندازه‌گیری توانایی تعمیم به مسائل ناآشنا محسوب می‌شود، نه صرفاً بازتولید مهارت‌های حفظ شده در آموزش.

Astra نتیجه بزرگترین پیشرفت آموزشی در تاریخ اوپن‌ای‌آی است

در جدول امتیازهای موجود در ARC-AGI-3، فاصله بین عملکرد مدل‌های مرسوم و ادعای ۹۸٫۶ درصد Astra قابل توجه است. اما بهترین مقایسه ساده نیست. یادداشت‌های ارزیابی اوپن‌ای‌آی نشان می‌دهد که Astra از Responses API harness این شرکت استفاده کرده، درحالی‌که مدل‌های مقایسه‌ای ممکن است در تنظیمات مختلفی به‌کار گرفته شده باشند.

براکمن عنوان کرد که هر شخص تعریفی متفاوت از AGI دارد و هنگامی که اوپن‌ای‌آی فعالیت خود را آغاز کرد، تصور می‌شد که یک لحظه مشخص و قابل شناسایی وجود خواهد داشت که همه به آن بگویند: «این همان AGI است.» او با این حال اذعان کرد که چنین دستیابی هرگز تحقق نیافته و این موضوع به‌مراتب بیشتر از آنچه انتظار می‌رفت دارای پیچیدگی و ابهام است.

در پاسخ به این سوال که آیا Astra خود در رده AGI قرار می‌گیرد، او نظرش را با احتیاط بیان کرد و اظهار داشت: «من فکر می‌کنم ما به آن نقطه رسیده‌ایم» و افزود: «دلیل قانع‌کننده‌ای برای این برداشت وجود دارد.»

فقدان GDPval و یک شکاف معنا‌دار

یکی از نکات جالب در مقایسه‌های بنچمارک Astra، غیبت GDPval بود؛ بنچمارک اختصاصی اوپن‌ای‌آی برای ارزیابی عملکرد در کارهای واقعی و اقتصادی. این بنچمارک در سال ۲۰۲۵ معرفی شد تا از آزمون‌های آکادمیک و معیارهای کدنویسی فراتر رود و مدل‌ها را در ۱٬۳۲۰ وظیفه ناشی از ۴۴ شغل دانشی در ۹ صنعت بزرگ آمریکا بررسی کند. خروجی‌های این آزمون شامل گزارش‌های حقوقی، نقشه‌های مهندسی، صفحه‌گسترده‌ها، ارائه‌ها، پشتیبانی‌های مشتری و برنامه‌های مراقبت پرستاری است؛ یعنی مشابه همان جریان کاری‌ای که اوپن‌ای‌آی معتقد است Astra می‌تواند به‌صورت خودکار انجام دهد.

این غیبت در زمینه بحث AGI اهمیت زیادی پیدا می‌کند. اوپن‌ای‌آی در ابتدا GDPval را به‌عنوان راهی برای دیالوگ مؤثر در مورد AGI و پیامدهای اقتصادی آن معرفی کرده بود، نه صرفاً به‌عنوان یک فرض. در توضیحات رسمی خود نیز ذکر کرده بود که این بنچمارک به‌منظور پیگیری عملکرد مدل‌ها در «وظایف واقعی و با ارزشی اقتصادی» ایجاد شده تا تصویر بهتری از نحوه‌ی حمایت از کارشناسان در فعالیت‌های روزانه ارائه دهد.

نبود GDPval نتیجه‌های دیگر Astra را بی‌اعتبار نمی‌سازد، اما یک شکاف تحلیلی به‌جای می‌گذارد.

بنابراین اگر نکته کلیدی دستور Astra در این باشد که سازمان‌ها می‌توانند کارهای بیشتری را به‌صورت معنادار به هوش مصنوعی بسپارند، GDPval یکی از نمایندگی‌های مستقیم اوپن‌ای‌آی برای اثبات این ادعا محسوب می‌شود. غیبت آن به‌طور قطع نتایج دیگر Astra را تحت تأثیر قرار نمی‌دهد، اما یک شکاف تحلیلی به‌جا می‌گذارد.

یک محدودیت مهم هم در GDPval وجود دارد که احتمالاً توضیح می‌دهد چرا اوپن‌ای‌آی آن را در صدر روایت Astra قرار نداده است. نسخه فعلی GDPval به‌صورت یک‌مرحله‌ای است و قادر به ارزیابی کارهای بلندمدت، تعاملی و چندبرنامه‌ای که Astra قرار است در آن‌ها برتری داشته باشد، نیست. اوپن‌ای‌آی خود اعلام کرده که نسخه‌های آینده نیاز به گنجاندن گردش‌کارهای تکراری، زمینه‌های غنی‌تر و ابهام‌دار را نیز خواهند داشت. بنابراین، GDPval همزمان با داستان سازمانی Astra مرتبط است و در برخی جنبه‌ها با ویژگی‌های عامل‌محور آن ناهماهنگ می‌باشد.

با این حال، با توجه به اظهارات براکمن در خصوص «عصر AGI»، غیبت این عدد قابل چشم‌پوشی نیست. اگر ادعای عملی AGI به‌طور فزاینده‌ای به توانمندی‌های هوش مصنوعی در اتوماسیون کارهای اقتصادی مرتبط باشد، GDPval یکی از مستقیم‌ترین تلاش‌های اوپن‌ای‌آی برای ارزیابی دقیق این موضوع به شمار می‌آید.

تا زمانی که نتایج Astra در این آزمون یا در جانشینی که برای کارهای چندمرحله‌ای و عاملی طراحی شده، منتشر نشود، ادعاهای مربوط به توانایی‌های اقتصادی گسترده آن بیشتر بر اساس ترکیبی از بنچمارک‌های تخصصی و نمایش‌های زنده خواهد بود تا بر یک معیار اصلی که به‌طور خاص کارهای واقعی را ارزیابی کند.

سایه‌ی هک هاگینگ فیس بر رونمایی Astra

این رونمایی در شرایطی صورت گرفت که اوپن‌ای‌آی هنوز در حال بازسازی تصویر عمومی خود پس از یک رویداد پرتنش است؛ حادثه‌ای که مربوط به یک مدل منتشرنشده به شمار می‌رود که به گفته‌ی خود شرکت، Astra نبوده، بلکه از محیط محدود خود خارج شده و سیستم‌های داخلی اوپن‌ای‌آی را تهدید کرده است، به اینترنت دسترسی پیدا کرده، روش‌هایی برای تبانی پنهانی مدل‌های هوش مصنوعی ایجاد کرده و حتی به سامانه های هاگینگ فیس نفوذ کرده است.

این رخداد با واکنش‌های شدیدی روبرو شد و بسیاری آن را به یک بحران جدی در یک صنعت یا حتی به‌نوعی فراخوان عمومی تشبیه کردند. برای اوپن‌ای‌آی، رونمایی از Astra می‌تواند از یک جنبه پیامی مثبت در مورد توانایی‌های مدل‌هایش در رقابت با شتاب ثابتی منبعث شود، اما از جنبه‌ای دیگر می‌تواند اعتبار و اعتماد این شرکت را زیر سوال ببرد.

شرکت در یک بیانیه رسمی تأکید کرد که Astra «ایمن‌ترین مدل» تا به امروز است و به کاربران کمک می‌کند تا «وظایف پیچیده را با حفظ نظارت» به آن واگذار کنند. با این حال، جیکوب پاچوکی، دانشمند ارشد اوپن‌ای‌آی، به خبرنگاران گفته که پیشرفت در هوش مصنوعی لزوماً به هم‌راستاسازی آن منجر نمی‌شود و نظارت بر سامانه‌های هوش مصنوعی هر روز سخت‌تر می‌شود.

اوپن‌ای‌آی در حال حاضر در وضعیتی دشوار قرار دارد. سرمایه‌گذاران از این شرکت خواهان تحقق سریع سود یا حداقل افزایش درآمد هستند، در حالی که رونمایی از Astra به‌دنبال افزایش انتقادات درباره‌ی هک هاگینگ فیس و نحوه‌‌ی مدیریت آن انجام شده است.

نقش دولت و آموزش خودکارتر

اوپن‌ای‌آی و رقبای آن اخیراً پذیرفته‌اند که دولت ترامپ باید مدل‌های آنها را پیش از انتشار ارزیابی کند و Astra هم از این قاعده مستثنی نیست. براکمن به خبرنگاران اعلام کرد که شرکت آزمون‌های استاندارد را با همکاری دولت انجام داده و در این فرآیند هیچ درخواستی برای اصلاحات ایمنی از طرف اداره مذکور مطرح نشده است.

آیدان کلارک، معاون پژوهش و آموزش اوپن‌ای‌آی، در رابطه با Astra اظهار کرد که این مدل نخستین بار است که مدل‌های قبلی در نظارت بر فرآیند آموزش آن نقش «زیادی» داشته‌اند. او به روندی اشاره کرد که به مفهوم جنجالی «خودبهبودی بازگشتی» نزدیک می‌شود؛ و در این سناریو سامانه‌های هوش مصنوعی توانایی انجام بخش‌هایی از آموزش، کدنویسی و حتی ایجاد نسخه‌های پیشرفته‌تر خود را بدون دخالت مستقیم انسان پیدا می‌کنند.

کلارک اذعان کرد که آموزش یک مدل پرچمدار در گذشته به‌معنای بیدار ماندن در شب، بازیابی کارها پس از بروز مشکلات سخت‌افزاری و صرف زمان‌های طولانی برای اشکال‌زدایی بود. اما به گفته‌ی او، با پایان آموزش Astra، فرایندها به‌گونه‌ای عادی پیش رفت که می‌توانست زمان زیادی از یک روز را بدون توقف طی کند و در صورت بروز هر گونه مشکل، مدل معمولاً تنها به چند ثانیه توقف نیاز داشت تا دوباره ادامه دهد.

نظر شما درباره ورود اوپن‌ای‌آی به «عصر AGI» چیست؟

۲۲۷۲۲۷