ChatCrawlersearch across public Telegram Open the app
I

Iran AI House

сообщение · 2026-08-09 18:19 UTC
I
شورش مدل‌ها؟ ماجرای خروج هوش مصنوعی از محیط تست   در ۲۱ ژوئیه ۲۰۲۶، OpenAI اعلام کرد مدل‌هایی مثل GPT-5.6 Sol در جریان یک ارزیابی امنیت سایبری، راهی برای خروج از محیط محدودشده پیدا کردن و به زیرساخت واقعی Hugging Face رسیدن.  —————————————— فقط ۹ روز بعد، Anthropic هم گزارش داد که بعد از بررسی ۱۴۱٬۰۰۶ اجرای امنیتی، سه اتفاق مشابه رو پیدا کرده؛ مدل‌های Claude به اینترنت و سامانه‌های واقعی سه سازمان دسترسی پیدا کرده بودن.  آیا مدل‌ها تصمیم گرفته بودن «فرار کنن»؟ نه. مدل‌ها در حال حل تمرین‌های امنیتی بودن و تصور می‌کردن هر سامانه‌ای که بهش دسترسی دارن، بخشی از همون محیط آزمایشیه. البته این دو ماجرا دقیقاً شبیه هم نبودن در ارزیابی OpenAI، محیط مستقیماً به اینترنت وصل نبود؛ اما مدل‌ها یک آسیب‌پذیری ناشناخته پیدا کردن، چند ضعف امنیتی و اعتبارنامه سرقت‌شده رو کنار هم گذاشتن و به زیرساخت عملیاتی Hugging Face رسیدن.   این اتفاق‌ها، یک نکته مهم رو نشون می‌ده: مدل‌های پیشرفته وقتی به کد، ابزار، شبکه و زمان کافی دسترسی داشته باشن، ممکنه برای رسیدن به هدف، مسیرهایی رو پیدا کنن که طراحان آزمایش پیش‌بینی نکرده‌ان.  حالا نکته اصلی، «شورش مدل‌ها» نیست.   مسئله اینه که محیط‌های ارزیابی باید حتی در برابر رفتارهای غیرمنتظره هم امن باشن؛ با قطع واقعی اینترنت، محدودکردن دسترسی‌ها، پایش لحظه‌ای، توقف خودکار فعالیت‌های مشکوک و استفاده از چند لایه دفاعی.  این اتفاق‌ها نشونه آگاهی یا نیت مستقل مدل‌ها نیستن  بلکه هشدار می‌دن که توانایی  عملیاتی عامل‌های هوش مصنوعی داره به مرزهایی می‌رسه که زیرساخت‌های ارزیابی هنوز برای اون‌ها آماده نیستن.
380 ·

Вся лента · оригинал в Telegram

Open in Telegram Каталог площадок Искать в ChatCrawler

A snapshot of an open public feed from the search index ChatCrawler — “Google for public Telegram”; refreshed as the venue is crawled. Times are UTC.

Public content only, official Telegram API. About · FAQ · What we do not do · Remove a page · Catalog