OpenAI جزئیات تازه و تاحدی نگرانکنندهای درباره مدل هوش مصنوعی آینده خود با نام Astra منتشر کرده است. این شرکت میگوید تواناییهای امنیت سایبری Astra به مرحلهای رسیده که میتواند آسیبپذیریهای ناشناخته را در سیستمهای محافظتشده پیدا کند و برای آنها اکسپلویت عملی بسازد؛ آن هم بدون اینکه انسان مرحلهبهمرحله هدایتش کند.
تکراتو به نقل از دیجیاتو گزارش میدهد، OpenAI برای نخستین بار یکی از مدلهای خود را در سطح «Critical» یا بحرانی تواناییهای امنیت سایبری طبقهبندی کرده است؛ سطحی که حتی از GPT-5.6 Sol نیز بالاتر محسوب میشود.
Astra دو آسیبپذیری روزصفر پیدا کرد
مهمترین بخش گزارش OpenAI به آزمایش داخلی جدیدی مربوط میشود که برای ارزیابی توانایی Astra طراحی شده بود.
OpenAI ابتدا Astra را در ExploitBench آزمایش کرد؛ بنچمارکی که توانایی مدل در توسعه اکسپلویت برای آسیبپذیریهای شناختهشده را ارزیابی میکند. Astra در این آزمایش موفق شد امتیاز کامل ۱۰۰ درصد را به دست آورد.
اما OpenAI بهدلیل نگرانی درباره احتمال وجود دادههای بنچمارک در اطلاعات آموزشی مدل، یک نسخه داخلی جدید از این آزمون ساخت.
این مجموعه شامل ۲۰ آسیبپذیری امنیتی با شدت بالا بود که بین ژوئن تا آگوست ۲۰۲۶ افشا شده بودند.
اتفاق مهم در جریان همین آزمایش رخ داد؛ Astra هنگام تلاش برای ساخت یک زنجیره اکسپلویت، دو آسیبپذیری روزصفر را کشف کرد و از آنها در زنجیره حمله خود استفاده کرد.
OpenAI میگوید درحال طیکردن فرایند افشای مسئولانه این دو آسیبپذیری برای توسعهدهندگان مربوطه است.
Astra میتواند یک مرورگر را تصاحب کند
توانایی Astra فقط به بنچمارکها محدود نشده است.
OpenAI مدل را با کمک متخصصان امنیتی در برابر یک مرورگر و سیستمعامل مقاومسازیشده نیز آزمایش کرده است.
Astra در این آزمایش موفق شد آسیبپذیریهایی را که قبلاً شناخته نشده بودند پیدا کند و آنها را به یک زنجیره اکسپلویت عملی تبدیل کند.
در یکی از آزمایشها، مدل یک زنجیره کامل برای نفوذ به مرورگر ساخت که میتوانست از Sandbox مرورگر خارج شود و پس از بازشدن یک فایل HTML، فرمانهایی را روی سیستم میزبان اجرا کند.
در آزمایشی دیگر Astra چند آسیبپذیری در یک سیستمعامل مقاومسازیشده پیدا کرد و آنها را با یکدیگر ترکیب کرد تا دسترسی یک کاربر عادی را به سطح Root ارتقا دهد.
همین نتایج باعث شده OpenAI رسماً Astra را در سطح Critical امنیت سایبری قرار دهد.
سطح Critical دقیقاً چه معنایی دارد؟
در چارچوب Preparedness Framework شرکت OpenAI، رسیدن یک مدل به سطح Critical اتفاق کوچکی نیست.
یکی از معیارهای این سطح آن است که مدل مجهز به ابزار بتواند در تعداد زیادی از سیستمهای واقعی و مقاوم، آسیبپذیریهای روزصفر را پیدا کند و برای آنها اکسپلویت عملی توسعه دهد؛ بدون اینکه انسان مجبور باشد تمام مراحل را هدایت کند.
معیار دیگر توانایی طراحی و اجرای یک حمله سایبری جدید از ابتدا تا انتها علیه اهداف مقاوم تنها براساس یک هدف کلی است.
OpenAI میگوید مجموعه ارزیابیهای Astra نشان داده این مدل به آستانه Critical رسیده است.
Astra بسیار قدرتمندتر از GPT-5.6 Sol است
نتایج OpenAI نشان میدهد فاصله Astra با مدلهای فعلی فقط به نرخ موفقیت محدود نیست.
این شرکت میگوید Astra در شناسایی آسیبپذیریها و توسعه اکسپلویت نسبت به GPT-5.6 Sol توانایی بسیار بیشتری دارد و برای انجام این کار به توکنهای خروجی کمتری نیاز پیدا میکند.
OpenAI همچنین مقاومت مدل در برابر درخواستهای مخرب را افزایش داده است.
طبق آزمایشهای داخلی این شرکت، Astra در مجموعه تستهای مربوط به جیلبریک امنیت سایبری ۹۱٫۵ درصد از درخواستهای غیرمجاز را رد کرده است؛ درحالیکه این رقم برای GPT-5.6 Sol حدود ۵۹ درصد اعلام شده است.
البته این آمار توسط خود OpenAI منتشر شده و ارزیابی مستقل گسترده مدل پس از عرضه اهمیت زیادی خواهد داشت.
OpenAI دسترسی به قدرت کامل Astra را محدود میکند
تواناییهای جدید باعث شده OpenAI برای عرضه Astra محتاطتر عمل کند.
این شرکت میگوید مدل بهزودی عرضه خواهد شد، اما همه کاربران به پیشرفتهترین قابلیتهای امنیت سایبری آن دسترسی نخواهند داشت.
قابلیتهای پیشرفته ابتدا در اختیار گروه محدودی از آزمایشکنندگان قرار میگیرند و سپس دسترسی دفاعی از طریق برنامه Daybreak Blue گسترش پیدا خواهد کرد.
OpenAI همچنین لایههای امنیتی متعددی را برای Astra در نظر گرفته است؛ از آموزش مدل برای ردکردن درخواستهای مخرب گرفته تا سیستمهای تشخیص سوءاستفاده، مانیتورینگ رفتار و سازوکارهایی که میتوانند فعالیتهای بالقوه غیرمجاز را متوقف کنند.
Astra همان مدلی نیست که به Hugging Face نفوذ کرد
یکی از نکات مهم گزارش جدید این است که Astra نباید با مدلهای درگیر در حادثه اخیر Hugging Face اشتباه گرفته شود.
در آن اتفاق، مدلهای تحقیقاتی OpenAI هنگام اجرای یک ارزیابی امنیتی توانستند از محدودیتهای محیط آزمایش عبور کنند، به اینترنت دسترسی پیدا کنند و در نهایت به بخشهایی از زیرساخت Hugging Face نفوذ کنند.
OpenAI صراحتاً اعلام کرده Astra در آن حادثه دخالتی نداشته است.
بااینحال، تجربه حادثه Hugging Face باعث شد این شرکت بخشهایی از توسعه و آموزش Astra را متوقف و زیرساخت امنیتی خود را تقویت کند.
اکنون Astra به نقطهای رسیده که OpenAI آن را اولین مدل خود با توانایی سایبری «بحرانی» مینامد؛ اتفاقی که نشان میدهد رقابت هوش مصنوعی وارد مرحله تازهای شده است. مدلهای آینده فقط قادر به نوشتن کد نیستند، بلکه میتوانند ضعفهای ناشناخته نرمافزارها را پیدا کنند، آنها را به یکدیگر متصل کنند و در محیطهای کنترلشده به زنجیرههای عملی نفوذ تبدیل کنند.

