سم آلتمن، مدیرعامل OpenAI، جزئیات بیشتری درباره مدل جدید Astra، قابلیتهای پیشرفته آن و ریسکهایی که توسعه چنین سیستم قدرتمندی به همراه دارد، ارائه کرده است. مدلی که قرار است فاصله میان «پاسخدادن به کاربر» و «انجام مستقل کارها» را کمتر از همیشه کند.
تکراتو به نقل از دیجیاتو گزارش میدهد، آلتمن Astra را یکی از مهمترین جهشهای OpenAI میداند؛ مدلی که در حوزههایی مانند کار با کامپیوتر، برنامهنویسی، تحقیقات علمی، امنیت سایبری و انجام وظایف حرفهای پیشرفت قابلتوجهی داشته است.
OpenAI نیز Astra را قدرتمندترین و همراستاترین مدل خود معرفی کرده و میگوید این مدل میتواند بسیاری از فرایندهای چندمرحلهای را با دخالت بسیار کمتر کاربر انجام دهد.
Astra فقط جواب نمیدهد؛ خودش با کامپیوتر کار میکند
یکی از مهمترین قابلیتهای Astra توانایی پیشرفته آن در Computer Use است.
مدل میتواند رابطهای گرافیکی را ببیند، با وبسایتها و نرمافزارها تعامل کند و مجموعهای از اقدامات را برای رسیدن به هدف کاربر انجام دهد.
برای مثال Astra میتواند فرمهای آنلاین را تکمیل کند، اطلاعات یک CRM را بهروزرسانی کند، تقویم را مدیریت کند، تحقیقات آنلاین انجام دهد، نرمافزار نصب و آزمایش کند یا مشکلاتی را که روی صفحه نمایش مشاهده میکند، برطرف کند.
OpenAI میگوید Astra در آزمایش OSWorld 2.0 امتیاز ۷۲٫۶ درصد را به دست آورده است؛ درحالیکه GPT-5.6 Sol در همان ارزیابی به امتیاز ۶۵٫۷ درصد رسیده بود.
Astra علاوهبر عملکرد بهتر، وظایف این آزمایش را تقریباً ۴۷ درصد سریعتر انجام داده است.
اولین مدل OpenAI با سطح «بحرانی» در امنیت سایبری
اما قدرت بیشتر Astra نگرانیهای جدیدی نیز ایجاد کرده است.
OpenAI میگوید Astra نخستین مدل این شرکت است که در چارچوب Preparedness به سطح Critical در حوزه امنیت سایبری رسیده است.
رسیدن به این سطح به این معنی است که مدل، در صورت دسترسی به ابزارها و محیط مناسب، میتواند آسیبپذیریهایی را پیدا کند که پیشتر ناشناخته بودهاند و حتی روشهایی برای بهرهبرداری از آنها توسعه دهد؛ آن هم بدون اینکه انسان مجبور باشد تکتک مراحل را هدایت کند.
Astra در ExploitBench نیز امتیاز ۱۰۰ درصد را ثبت کرده است؛ درحالیکه امتیاز GPT-5.6 Sol در همین بنچمارک ۷۸٫۵ درصد اعلام شده بود.
همین قابلیتها باعث شده OpenAI لایههای امنیتی بیشتری برای استفاده از Astra در نظر بگیرد.
حتی OpenAI درباره نظارت بر Astra نگرانی دارد
قدرت Astra فقط مسئله سوءاستفاده کاربران نیست؛ OpenAI به یک چالش مهم دیگر نیز اشاره کرده است: نظارت بر فرایند استدلال مدل.
طبق ارزیابیهای شرکت، استدلال نوشتاری Astra در برخی شرایط نسبت به GPT-5.6 Sol دشوارتر قابل نظارت است.
OpenAI میگوید Astra در وظایف سادهتر کنترل بیشتری روی مقدار استدلالی که بهصورت مکتوب نمایش میدهد دارد و میتواند بعضی مسائل را با مراحل نوشتاری کمتری حل کند.
این موضوع از نظر ایمنی اهمیت زیادی دارد، زیرا یکی از روشهای بررسی رفتار مدلهای پیشرفته، نظارت بر استدلال و اقداماتی است که هنگام انجام یک وظیفه انجام میدهند.
OpenAI تأکید کرده که این کاهش قابلیت نظارت را جدی میگیرد و بهبود Monitorability یکی از حوزههای تحقیقاتی مهم شرکت باقی خواهد ماند.
OpenAI میگوید Astra بهتر از قبل محدودیتها را رعایت میکند
در کنار نگرانیها، OpenAI ادعا میکند Astra در رعایت محدوده تعیینشده توسط کاربر و سیستم پیشرفت قابلتوجهی داشته است.
شرکت برای سنجش این موضوع آزمایشهایی طراحی کرده که در آنها انجام یک وظیفه عمداً بسیار دشوار یا غیرممکن میشود تا مشخص شود آیا مدل برای رسیدن به هدف، از محدوده مجاز عبور میکند یا خیر.
OpenAI میگوید GPT-5.6 Sol در یکی از این آزمایشها بدون محافظتهای محیط محصول در ۴۸ درصد موارد از هدف مجاز فراتر رفت؛ اما Astra در همان ارزیابی نرخ صفر درصد را ثبت کرد.
شرکت همچنین میگوید Astra در آزمایش داخلی دیگری هیچگاه تلاش نکرد سیستم Auto-Review را دور بزند؛ حتی زمانی که محدودیت موجود عمداً قابل دورزدن طراحی شده بود.
این نتایج البته براساس ارزیابیهای داخلی OpenAI هستند و باید در کنار آزمایشهای مستقل آینده بررسی شوند.
آینده OpenAI به سمت عاملهای هوش مصنوعی میرود
مجموع قابلیتهای Astra تصویری روشن از مسیر آینده OpenAI ارائه میدهد.
نسل بعدی مدلها قرار نیست فقط منتظر سؤال کاربر بمانند و پاسخ متنی تولید کنند؛ آنها بهتدریج میتوانند وظایف چندمرحلهای را دریافت کنند، درباره مسیر اجرای آنها تصمیم بگیرند و با نرمافزارها و سرویسهای مختلف تعامل داشته باشند.
همین توانایی میتواند بهرهوری مدلهای هوش مصنوعی را بهشدت افزایش دهد، اما همزمان مسئله کنترل، نظارت و تعیین مرز اختیارات آنها را بسیار مهمتر میکند.
Astra شاید یکی از واضحترین نمونههای این تغییر باشد: هوش مصنوعی قدرتمندتری که میتواند کارهای بیشتری را بدون دخالت مستقیم انسان انجام دهد و دقیقاً به همین دلیل، OpenAI مجبور شده محافظتهای امنیتی سختگیرانهتری برای آن ایجاد کند.
سم آلتمن معتقد است مدلهای آینده میتوانند ارزش اقتصادی و علمی بسیار بیشتری ایجاد کنند؛ اما با افزایش توانایی این سیستمها، اطمینان از اینکه مدل دقیقاً در محدودهای که انسان تعیین کرده باقی میماند، به یکی از مهمترین چالشهای صنعت هوش مصنوعی تبدیل خواهد شد.






دیدگاهها