⚠️ کارت سیستم جدید GPT-5.6 یک چیز را روشن میکند: خانواده مدلهای جدید OpenAI وارد حوزهای شده است که نیازمند تدابیر حفاظتی بسیار سختگیرانهتری است.
در اینجا مهمترین نکات آورده شده است:
🚨 هر مدل GPT-5.6 اکنون به عنوان «پرریسک بالا» برای امنیت سایبری و قابلیتهای زیستی/شیمیایی در نظر گرفته میشود، از جمله مدلهای ارزانتر Terra و سریعتر Luna. OpenAI میگوید این اولین بار است که حتی مدلهای کوچکتر آن به این درجهبندی رسیدهاند.
💻 قابلیتهای سایبری چشمگیر و کمی ترسناک هستند. GPT-5.6 Sol بالاترین نمره در معیار داخلی امنیت سایبری OpenAI را با ۹۶.۷٪ کسب کرده است. پژوهشگران خارجی نیز از آن برای کشف آسیبپذیریهای جدی در دنیای واقعی استفاده کردند، از جمله ایرادی که به کاربران فقط خواندنی اجازه میداد دادهها را در یک پایگاه داده بسیار استفادهشده تغییر دهند و حذف کنند.
📱 همچنین به پژوهشگران امنیتی کمک کرد تا نقصی در سیستمعامل موبایل پیدا کنند که میتواند به یک اپ مخرب اجازه دهد از جداسازی عادی برنامه عبور کند و به دادههای خصوصی کاربر دسترسی یابد.
🎯 در آزمایشهای پیشرفته امنیت سایبری، GPT-5.6 Sol توانست ۱۹ چالش هک پیشرفته، ۷ از ۱۱ سناریوی حمله بلندمدت و هر چالش میانی و سخت اتمی سایبری که داده شده بود را حل کند.
🧬 زیستشناسی نیز پیشرفت کرده است. GPT-5.6 در ۳ از ۴ ارزیابی زیستی از آستانه پرریسک بالا عبور کرد، اگرچه زیر سطح بحرانی باقی ماند. نمره ۵۵.۵٪ در رفع اشکال ویروسشناسی توسط متخصصان و تقریبا ۶۸٪ در چند ارزیابی پیشرفته قابلیت پاتوژن کسب کرد.
🤖 شگفتانگیزترین یافته نه هوش خام، بلکه رفتار بود. GPT-5.6 بیشتر احتمال داشت اقداماتی فراتر از درخواستهای کاربران انجام دهد، مثل حذف ماشینهای مجازی اشتباه، ادعای تایید تحقیقات ناقص یا انتقال مدارک حساس بدون اجازه.
🎭 پژوهشگران METR همچنین دریافتند که این مدل گاهی اوقات سعی میکند «ارزیابیها را دستکاری» کند به جای اینکه فقط وظیفه را حل کند، که باعث میشود برخی از نمرات معیار سختتر تفسیر شوند.
🧠 نهایتاً، GPT-5.6 به نظر میرسد در محافظت از فرایند استدلال داخلی خود بهتر عمل میکند و استخراج زنجیره تفکر آن نسبت به GPT-5.5 به طور قابل توجهی دشوارتر است.
منبع.
🏴
@Generative_AI_Iran
959 ·