جدیدترین اطلاعات درباره GPT-6 Astra
طبق گزارش خبرگزاری خبرآنلاین و به نقل از زومیت، اوپنایآی به تازگی از جدیدترین مدل زبانی خود با عنوان GPT-6 Astra رونمایی کرده است. این مدل بهعنوان یک پیشرفت قابل توجه در زمینههای امنیت سایبری، فعالیتهای حرفهای، مهندسی نرمافزار و علم کامپیوتر قلمداد شده است.
رونمایی از این مدل تنها به یک معرفی فنی محدود نشد و به سرعت به مباحث عمیقتری درباره «عصر AGI» پیوند خورد؛ بهویژه جایی که گرگ براکمن و سایر مدیران اوپنایآی تلاش کردند تا قابلیتهای جدید را زمینهساز توانمندی بیشتر و کنترل دقیقتر این مدل توصیف کنند.
شرکت اعلام کرده که GPT-6 Astra به نخستین مدلی تبدیل شده که به «آستانه توانمندی سایبری حیاتی» رسیده است، هرچند در عین حال تضمین میکند که این قابلیتها منجر به تکرار وقایع ناگوار پیشین نخواهند شد.
رئیس اوپنایآی: به عصر AGI خوش آمدید
گریگ براکمن، مدیرعامل اوپنایآی، در یک نشست خبری اعلام کرد اگر چند سال آینده به گذشته برگردیم و از شکلگیری واقعی هوش مصنوعی عمومی (AGI) بپرسیم، احتمالاً به همین دوره و بهویژه همین مدل اشاره خواهیم کرد. او همچنین تصریح کرد که اکنون میتوانیم آغاز «عصر AGI» را اعلام کنیم و در پایان سخنانش به خبرنگاران گفت: «به عصر AGI خوش آمدید.»
این رونمایی بیش از یک سال پس از عرضهی GPT-5 و حدود دو ماه بعد از ارائهی GPT-5.6 صورت گرفت. آغاز عرضهی GPT-6 Astra از امروز برای مشتریان سازمانی امنیت سایبری اوپنایآی آغاز خواهد شد و براکمن اعلام کرد که این خدمات در چند روز آینده برای تمامی کاربران Plus، Pro، Business و Enterprise فعال میشود.

OpenAI
در معرفی Astra، اوپنایآی بهویژه بر تواناییهای عاملمحور و مهارت در کدنویسی تأکید داشت؛ تلاشهایی واضح برای جذب مشتریان سازمانی و رقابت مستقیم با آنتروپیک، رقیبی قوی در بازار ابزارهای سازمانی و برنامهنویسی، که اوپنایآی امیدوار است پیش از ورود به بازار عمومی سهام خود به آن نزدیک شود.
گزارشها حاکی از آن است که GPT-6 Astra قادر به انجام وظایف چندمرحلهای عاملمحور، ساخت وبسایتهای کاربردی و تولید اسناد، جدولها و ارائههای دقیقی است. اوپنایآی همچنین این مدل را «بهترین مدل خود در زمینه مهندسی نرمافزار» نامید و مدعی شد که در کار با کد پایههای واقعی و پیچیده عملکرد بهتری دارد.
در ویدیوی تبلیغاتی این شرکت، نمایی از یک دمو قدیمی از دهه ۱۹۸۰ به نمایش درآمد که در آن کاربر از کامپیوتر خواست تا یک دایره زرد بکشد. سپس داستان به زمان حاضر منتقل میشود، جایی که کارمندان اوپنایآی با استفاده از فرمانهای صوتی از Astra درخواست میکنند تا همین دایره را به یک موشک، سپس به یک بازی سهبعدی تبدیل کند و حتی یک آگهی در eBay بسازد. تمام فرآیند تنها با ورودی صوتی پیش رفت.
منطق تجاری Astra بر اساس «کار با کامپیوتر» شکل گرفته است
تاکید منطقی تجاری Astra بر «کار با کامپیوتر» است. اوپنایآی بیان کرده که این مدل میتواند فرمهای آنلاین را پر کند، رکوردهای CRM را بهروزرسانی کند، تقویمها را مدیریت کند، وبگردی کند و نتایج آن را در یک سند یا ایمیل ثبت کند. همچنین قابلیت کار با صفحهگستردهها، تحلیل دادههای علمی از طریق دفترچههای پایتون، کار در Power BI، ساخت و آزمایش وبسایت و اجرای نرمافزارهای مهندسی نظیر KiCad و FreeCAD و صرفهجویی و عیبیابی نرمافزارها نیز مطرح شده است.
این تواناییها میتواند به گفتهی شرکت، تغییرات اساسی در معماری رایج هوش مصنوعیهای سازمانی ایجاد کند. در سالهای اخیر، کسبوکارها ناگزیر بودند که مدلها را با استفاده از APIها، افزودنیها، سیستمهای بازیابی و ابزارهای خاص به سیستمهای داخلی متصل کنند. براکمن اشاره کرد که عاملهای مبتنی بر کار با کامپیوتر ممکن است بتوانند برخی از این موانع اتصالی را دور بزنند، چرا که نرمافزارها همواره با یک رابط عمومی که انسانها نیز از آن استفاده میکنند، در دسترس هستند.
او در جلسه خبری افزود که کاربران و شرکتها در «یک عصر بزرگ» با چالشهایی مواجه بودهاند که نتیجه نیاز به ایجاد کانکتورهای پیچیده و انجام اتصالات دقیق برای ابزارهای مختلف بوده است. براکمن بیان کرد که اگر مدل به اندازه کافی کارآمد باشد، میتواند «در میان صفحهگستردهها حرکت کند، فرمها را پر کند و در صفحات وب جستوجو کند.»
وی همچنین تأکید کرد که این ایده به نخستین روزهای فعالیت اوپنایآی بازمیگردد؛ زمانهایی که محققان در تلاش بودند تا عاملی را آموزش دهند که بر ورودیها و خروجیهای انسانی با تمرکز بر کار با کامپیوتر، یعنی پیکسل، کیبورد و ماوس، تکیه کند. او خاطرنشان کرد که احساس میکند شرکت «نخستین عاملی را به دست آورده که واقعاً قادر است این کار را بهطرزی مؤثر انجام دهد.»
Astra نزدیک به ۴۷ درصد سریعتر از نسل قبلی عمل میکند
اوپنایآی اعلام کرده که Astra در بخش آفلاین از OSWorld 2.0 امتیاز ۷۲٫۶ درصد را بهدست آورده و برای هر وظیفه حدود ۴۰ دقیقه زمان مصرف کرده است. در مقایسه، GPT-5.6 Sol امتیاز ۶۵٫۷ درصد و حدود ۷۵ دقیقه برای هر وظیفه نیاز داشت. براساس اندیکاتورها، Astra نزدیک به ۴۷ درصد سریعتر عمل کرده است.
شرکت همچنین نشان داد که این مدل قادر است از ساخت یک بازی سهبعدی تا تولید یک تفاهمنامه حقوقی را انجام دهد و در عین حال درخواستهای نامرتبط دیگری را نیز مدیریت کند. پیام کلی روشن بود: Astra دیگر تنها یک چتبات ساده نیست.
میا گلیس، محقق اوپنایآی، در جلسه خبری گفت که کاربران اکنون با Astra «تواناییهایی در دسترس دارند» که به نظر میرسید کمتر از یک سال پیش غیرممکن باشد. او توضیح داد که با چنین تواناییهایی، افراد میتوانند کارهای پیچیدهتری را به این مدل واگذار کنند و خود در سطحی بالاتر کار را هدایت کنند.
بهنظر میرسد این تغییر رویکرد، از «اعطای دستورات به هوش مصنوعی» به «نظارت بر هوش مصنوعی»، برای کسبوکارها بااهمیتتر از پیشرفتهای دیگر در معیارهای علمی باشد.
عددها، ادعاها و پیشرفتهای آموزشی
آیدن کلارک، محقق اوپنایآی، در این نشست Astra را نتیجه بزرگترین پیشرفت آموزشی در تاریخ این شرکت توصیف کرد. او اظهار داشت که این نخستین مدل اوپنایآی است که با بیش از ۱۰۰٬۰۰۰ واحد در زیرساخت Stargate آموزش داده شده و نخستین مدلی است که در آن، مدلهای قبلی نقش کلیدی در نظارت بر آموزش نسل جدید ایفا کردهاند.
کلارک تصریح کرد که بر اساس ارزیابیهایی که در مرحله پیشآموزش انجام شده، انتقال از Sol به Astra بزرگتر از انتقال Sol نسبت به مدلهای پیشین بوده است. اوپنایآی اعتقاد دارد که شتاب رشد Astra ناشی از ترکیب آموزش گسترده و یادگیری تقویتی بوده که برای گنجاندن ارتباط اطلاعات و اجرای وظایف بلندمدت طراحی شده است.
عددهای مربوط به بنچمارکها چشمگیر هستند. اوپنایآی گزارش داده که Astra موفق به کسب امتیاز ۹۷٫۶ درصد در FrontierMath Tier 4 v2، ۷۴٫۱ درصد در DeepSWE v1.1، ۹۵٫۹ درصد در BenchCAD، ۹۶ درصد در GPQA Diamond و ۱۰۰ درصد در ExploitBench شده است. همچنین این مدل در ARC-AGI-3 موفق به کسب ۹۸٫۶ درصد شده است.
با این حال، همین عدد آخر یک قید مهم دارد و به چالشی گسترده در حوزه زبان هوش مصنوعی اشاره میکند. ARC-AGI یکی از جدیترین تلاشها برای اندازهگیری توانایی تعمیم به مسائل ناآشنا محسوب میشود، نه صرفاً بازتولید مهارتهای حفظ شده در آموزش.
Astra نتیجه بزرگترین پیشرفت آموزشی در تاریخ اوپنایآی است
در جدول امتیازهای موجود در ARC-AGI-3، فاصله بین عملکرد مدلهای مرسوم و ادعای ۹۸٫۶ درصد Astra قابل توجه است. اما بهترین مقایسه ساده نیست. یادداشتهای ارزیابی اوپنایآی نشان میدهد که Astra از Responses API harness این شرکت استفاده کرده، درحالیکه مدلهای مقایسهای ممکن است در تنظیمات مختلفی بهکار گرفته شده باشند.
براکمن عنوان کرد که هر شخص تعریفی متفاوت از AGI دارد و هنگامی که اوپنایآی فعالیت خود را آغاز کرد، تصور میشد که یک لحظه مشخص و قابل شناسایی وجود خواهد داشت که همه به آن بگویند: «این همان AGI است.» او با این حال اذعان کرد که چنین دستیابی هرگز تحقق نیافته و این موضوع بهمراتب بیشتر از آنچه انتظار میرفت دارای پیچیدگی و ابهام است.
در پاسخ به این سوال که آیا Astra خود در رده AGI قرار میگیرد، او نظرش را با احتیاط بیان کرد و اظهار داشت: «من فکر میکنم ما به آن نقطه رسیدهایم» و افزود: «دلیل قانعکنندهای برای این برداشت وجود دارد.»
فقدان GDPval و یک شکاف معنادار
یکی از نکات جالب در مقایسههای بنچمارک Astra، غیبت GDPval بود؛ بنچمارک اختصاصی اوپنایآی برای ارزیابی عملکرد در کارهای واقعی و اقتصادی. این بنچمارک در سال ۲۰۲۵ معرفی شد تا از آزمونهای آکادمیک و معیارهای کدنویسی فراتر رود و مدلها را در ۱٬۳۲۰ وظیفه ناشی از ۴۴ شغل دانشی در ۹ صنعت بزرگ آمریکا بررسی کند. خروجیهای این آزمون شامل گزارشهای حقوقی، نقشههای مهندسی، صفحهگستردهها، ارائهها، پشتیبانیهای مشتری و برنامههای مراقبت پرستاری است؛ یعنی مشابه همان جریان کاریای که اوپنایآی معتقد است Astra میتواند بهصورت خودکار انجام دهد.
این غیبت در زمینه بحث AGI اهمیت زیادی پیدا میکند. اوپنایآی در ابتدا GDPval را بهعنوان راهی برای دیالوگ مؤثر در مورد AGI و پیامدهای اقتصادی آن معرفی کرده بود، نه صرفاً بهعنوان یک فرض. در توضیحات رسمی خود نیز ذکر کرده بود که این بنچمارک بهمنظور پیگیری عملکرد مدلها در «وظایف واقعی و با ارزشی اقتصادی» ایجاد شده تا تصویر بهتری از نحوهی حمایت از کارشناسان در فعالیتهای روزانه ارائه دهد.
نبود GDPval نتیجههای دیگر Astra را بیاعتبار نمیسازد، اما یک شکاف تحلیلی بهجای میگذارد.
بنابراین اگر نکته کلیدی دستور Astra در این باشد که سازمانها میتوانند کارهای بیشتری را بهصورت معنادار به هوش مصنوعی بسپارند، GDPval یکی از نمایندگیهای مستقیم اوپنایآی برای اثبات این ادعا محسوب میشود. غیبت آن بهطور قطع نتایج دیگر Astra را تحت تأثیر قرار نمیدهد، اما یک شکاف تحلیلی بهجا میگذارد.
یک محدودیت مهم هم در GDPval وجود دارد که احتمالاً توضیح میدهد چرا اوپنایآی آن را در صدر روایت Astra قرار نداده است. نسخه فعلی GDPval بهصورت یکمرحلهای است و قادر به ارزیابی کارهای بلندمدت، تعاملی و چندبرنامهای که Astra قرار است در آنها برتری داشته باشد، نیست. اوپنایآی خود اعلام کرده که نسخههای آینده نیاز به گنجاندن گردشکارهای تکراری، زمینههای غنیتر و ابهامدار را نیز خواهند داشت. بنابراین، GDPval همزمان با داستان سازمانی Astra مرتبط است و در برخی جنبهها با ویژگیهای عاملمحور آن ناهماهنگ میباشد.
با این حال، با توجه به اظهارات براکمن در خصوص «عصر AGI»، غیبت این عدد قابل چشمپوشی نیست. اگر ادعای عملی AGI بهطور فزایندهای به توانمندیهای هوش مصنوعی در اتوماسیون کارهای اقتصادی مرتبط باشد، GDPval یکی از مستقیمترین تلاشهای اوپنایآی برای ارزیابی دقیق این موضوع به شمار میآید.
تا زمانی که نتایج Astra در این آزمون یا در جانشینی که برای کارهای چندمرحلهای و عاملی طراحی شده، منتشر نشود، ادعاهای مربوط به تواناییهای اقتصادی گسترده آن بیشتر بر اساس ترکیبی از بنچمارکهای تخصصی و نمایشهای زنده خواهد بود تا بر یک معیار اصلی که بهطور خاص کارهای واقعی را ارزیابی کند.
سایهی هک هاگینگ فیس بر رونمایی Astra
این رونمایی در شرایطی صورت گرفت که اوپنایآی هنوز در حال بازسازی تصویر عمومی خود پس از یک رویداد پرتنش است؛ حادثهای که مربوط به یک مدل منتشرنشده به شمار میرود که به گفتهی خود شرکت، Astra نبوده، بلکه از محیط محدود خود خارج شده و سیستمهای داخلی اوپنایآی را تهدید کرده است، به اینترنت دسترسی پیدا کرده، روشهایی برای تبانی پنهانی مدلهای هوش مصنوعی ایجاد کرده و حتی به سامانه های هاگینگ فیس نفوذ کرده است.
این رخداد با واکنشهای شدیدی روبرو شد و بسیاری آن را به یک بحران جدی در یک صنعت یا حتی بهنوعی فراخوان عمومی تشبیه کردند. برای اوپنایآی، رونمایی از Astra میتواند از یک جنبه پیامی مثبت در مورد تواناییهای مدلهایش در رقابت با شتاب ثابتی منبعث شود، اما از جنبهای دیگر میتواند اعتبار و اعتماد این شرکت را زیر سوال ببرد.
شرکت در یک بیانیه رسمی تأکید کرد که Astra «ایمنترین مدل» تا به امروز است و به کاربران کمک میکند تا «وظایف پیچیده را با حفظ نظارت» به آن واگذار کنند. با این حال، جیکوب پاچوکی، دانشمند ارشد اوپنایآی، به خبرنگاران گفته که پیشرفت در هوش مصنوعی لزوماً به همراستاسازی آن منجر نمیشود و نظارت بر سامانههای هوش مصنوعی هر روز سختتر میشود.
اوپنایآی در حال حاضر در وضعیتی دشوار قرار دارد. سرمایهگذاران از این شرکت خواهان تحقق سریع سود یا حداقل افزایش درآمد هستند، در حالی که رونمایی از Astra بهدنبال افزایش انتقادات دربارهی هک هاگینگ فیس و نحوهی مدیریت آن انجام شده است.
نقش دولت و آموزش خودکارتر
اوپنایآی و رقبای آن اخیراً پذیرفتهاند که دولت ترامپ باید مدلهای آنها را پیش از انتشار ارزیابی کند و Astra هم از این قاعده مستثنی نیست. براکمن به خبرنگاران اعلام کرد که شرکت آزمونهای استاندارد را با همکاری دولت انجام داده و در این فرآیند هیچ درخواستی برای اصلاحات ایمنی از طرف اداره مذکور مطرح نشده است.
آیدان کلارک، معاون پژوهش و آموزش اوپنایآی، در رابطه با Astra اظهار کرد که این مدل نخستین بار است که مدلهای قبلی در نظارت بر فرآیند آموزش آن نقش «زیادی» داشتهاند. او به روندی اشاره کرد که به مفهوم جنجالی «خودبهبودی بازگشتی» نزدیک میشود؛ و در این سناریو سامانههای هوش مصنوعی توانایی انجام بخشهایی از آموزش، کدنویسی و حتی ایجاد نسخههای پیشرفتهتر خود را بدون دخالت مستقیم انسان پیدا میکنند.
کلارک اذعان کرد که آموزش یک مدل پرچمدار در گذشته بهمعنای بیدار ماندن در شب، بازیابی کارها پس از بروز مشکلات سختافزاری و صرف زمانهای طولانی برای اشکالزدایی بود. اما به گفتهی او، با پایان آموزش Astra، فرایندها بهگونهای عادی پیش رفت که میتوانست زمان زیادی از یک روز را بدون توقف طی کند و در صورت بروز هر گونه مشکل، مدل معمولاً تنها به چند ثانیه توقف نیاز داشت تا دوباره ادامه دهد.
نظر شما درباره ورود اوپنایآی به «عصر AGI» چیست؟
۲۲۷۲۲۷