Programming For Everyone
Replymessage unavailableآنچه امروز در دنیای هوش مصنوعی مایه نگرانی شده، پدیدهای به نام Model Distillation (تقطیر مدل) است. شرکتهای بزرگ مثل Anthropic و OpenAI میلیاردها دلار هزینه میکنند تا مدلهای پیشرو (Frontier) مثل Claude یا GPT را آموزش دهند. بخش بزرگی از این هزینه صرف Alignment (تراز کردن اخلاقی) میشود تا مدل یاد بگیرد به درخواستهای خطرناک (ساخت بمب، حملات سایبری، بیوسلاح) پاسخ ندهد.
اما ماجرا اینجاست که بازیگران دیگر (از شرکتهای رقیب گرفته تا نهادهای نظامی و اطلاعاتی در کشورهایی مثل چین و به طور اخص در توییت Deepseek)، با استفاده از API این مدلها، صدها هزار سوال پیچیده از آنها میپرسند و پاسخها را ذخیره میکنند.
سپس یک مدل بومی و کوچکتر را بر اساس این پاسخها آموزش میدهند. نتیجه؟ مدل جدید، «هوش» مدل اصلی را به ارث میبرد، اما تمام گاردریلها و فیلترهای اخلاقی آن را جا میگذارد. این یعنی دستیابی به قدرت یک مدل فوقپیشرفته، بدون هیچ قید و بند امنیتی.
این یک دزدی معمولی نیست، این "توزیع بمب اتم دیجیتال" است. با Distill کردن مدلهایی مثل Claude، عملاً گاردریلها حذف میشوند و قابلیتهای خطرناک (بیوسلاح، سایبری، دیساینفورمیشن) مستقیماً به دست نهادهای نظارتی و نظامی میافتد. این یعنی دور زدن کامل کنترل صادرات چیپ و ایجاد یک تهدید نامتقارن که میتواند به فاجعه در زیرساختها ختم شود. وقت آن رسیده که جامعه AI این Proliferation را جدیتر از یک رقابت تجاری ببیند.
@DevTwitter | <Navid Taheri/>