Фотография
click to show
click to show
مدل Kimi K3 معرفی شد؛ غول ۲.۸ تریلیون پارامتری که به جنگ GPT-5.5 و Claude Opus 4.8 آمده
مدل Kimi K3، جدیدترین مدل هوش مصنوعی شرکت Moonshot، بهتازگی معرفی شده و از همین حالا سر و صدای زیادی توی دنیای هوش مصنوعی به پا کرده. این مدل با ۲.۸ تریلیون پارامتر، پنجره متنی یک میلیون توکنی و قابلیت چندوجهی (Multimodal) که بهصورت بومی از متن، تصویر و ویدیو پشتیبانی میکنه، برای انجام کارهای پیچیده، پروژههای طولانیمدت و ساخت ایجنتهای هوشمند طراحی شده.
شرکت Moonshot AI اعلام کرده که Kimi K3 از همین حالا روی Kimi.com، Kimi Work، Kimi Code و API در دسترسه و قراره وزنهای متنبازش هم تا ۲۷ جولای ۲۰۲۶ منتشر بشن؛ اتفاقی که میتونه یکی از مهمترین انتشارهای دنیای مدلهای متنباز امسال باشه.
یکی از مهمترین تفاوتهای Kimi K3 با نسل قبل، استفاده از دو فناوری جدید Kimi Delta Attention (KDA) و Attention Residuals (AttnRes) هست. این تغییرات باعث شدن مدل بتونه توی پردازش کانتکستهای خیلی طولانی، تا ۶.۳ برابر سریعتر عمل کنه و در عین حال، بهرهوری آموزشش هم با کمتر از ۲ درصد هزینه اضافه، حدود ۲۵ درصد بیشتر بشه.
علاوه بر این، Moonshot AI با بهبود معماری Mixture of Experts (MoE) و فرآیند آموزش، اعلام کرده که راندمان کلی مقیاسپذیری K3 نسبت به K2 حدود ۲.۵ برابر بهتر شده. یعنی این مدل میتونه از توان پردازشی، هوشمندانهتر استفاده کنه و خروجی باکیفیتتری ارائه بده.
عملکرد Kimi K3 توی بنچمارکها هم واقعاً چشمگیره. طبق نتایج رسمی، این مدل توی بخش Agent تونسته در بنچمارکهایی مثل BrowseComp، SpreadsheetBench 2 و Automation Bench رتبه اول رو به دست بیاره و توی آزمونهایی مثل GDPval، JobBench و AA-Briefcase هم با اختلاف خیلی کم جزو بهترین مدلهای دنیا باشه.
توی بخش کدنویسی هم Kimi K3 عملکرد خیلی خوبی داشته و در Program Bench و SWE Marathon رتبه اول رو گرفته. علاوه بر این، توی بنچمارکهایی مثل Terminal Bench 2.1، DeepSWE و FrontierSWE هم رقابت خیلی نزدیکی با مدلهایی مثل Fable 5 و GPT-5.6 Sol داشته و فقط با اختلاف کمی پشت صدر جدول قرار گرفته.
توی بخش بینایی (Vision) هم Kimi K3 تقریباً توی همه آزمونها جزو برترینها بوده و نشون داده که فقط یه مدل قوی برای متن و کدنویسی نیست، بلکه توی تحلیل و درک تصاویر هم عملکرد خیلی خوبی داره.
علاوه بر بنچمارکهای عمومی، Moonshot AI نتایج چند بنچمارک داخلی رو هم منتشر کرده که براساس سناریوهای واقعی کاربران طراحی شدن. Kimi K3 Max توی آزمونهای Online Exp Bench، DECK-Bench و Finance-Bench تونسته امتیاز بالاتری نسبت به Claude Opus 4.8 و GPT-5.5 کسب کنه.
این یعنی Kimi K3 فقط توی بنچمارکهای آزمایشگاهی خوب عمل نمیکنه، بلکه توی کارهای واقعی مثل تحقیق، تحلیل اطلاعات، مدیریت اسناد و انجام وظایف چندمرحلهای هم عملکرد قابل اعتمادی داره.
شرکت Moonshot AI چند نمونه جالب از تواناییهای این مدل هم منتشر کرده. مثلاً Kimi K3 توی یکی از آزمایشها، طی حدود ۱۵ ساعت تونسته یه الگوریتم جدید برای بهینهسازی کرنلهای یادگیری عمیق طراحی کنه و زمان اجرای عملیات رو از ۲۸۳.۶ میلیثانیه به ۱۱۴.۴ میلیثانیه برسونه؛ اون هم بدون اینکه دقت محاسبات تغییر کنه.
توی یه آزمایش دیگه هم اعلام شده که Kimi K3 تونسته طی ۴۸ ساعت و بدون دخالت انسان، طراحی و بهینهسازی یه تراشه فیزیکی رو از صفر تا صد انجام بده؛ موضوعی که نشون میده این مدل برای انجام پروژههای طولانی و خودکار ساخته شده.
یکی دیگه از قابلیتهای جالب Kimi K3، ویژگی Vision in the Loop هست. یعنی مدل میتونه بین کدنویسی، دیدن اسکرینشاتهای زنده، تحلیل تصاویر و اصلاح خروجی مدام رفتوبرگشت انجام بده و حتی ایدهها، تصاویر یا ویدیوها رو به اپلیکیشنها و تجربههای تعاملی قابل اجرا تبدیل کنه.
همین قابلیت باعث میشه Kimi K3 برای برنامهنویسها، طراحها و کسایی که روی پروژههای پیچیده و چندمرحلهای کار میکنن، یه گزینه خیلی جذاب باشه.
بازخورد کاربران هم تا اینجا خیلی امیدوارکننده بوده. خیلی از توسعهدهندهها توی X (توییتر سابق)، کیفیت Kimi K3 رو با مدلهایی مثل Claude Opus 4.8 و Fable 5 مقایسه کردن و از عملکردش توی برنامهنویسی، ساخت رابط کاربری و انجام کارهای Agentic تعریف کردن.
علاوه بر این، طبق اعلام Arena.ai، Kimi K3 تونسته با کسب ۱۶۷۹ امتیاز به رتبه اول Frontend Code Arena برسه و Fable 5 رو پشت سر بذاره؛ اون هم در حالی که نسخه قبلیش یعنی K2.6 فقط رتبه هجدهم رو داشت. این پیشرفت چشمگیر باعث شده خیلیها Kimi K3 رو یکی از جدیترین رقبای مدلهای پرچمدار OpenAI و Anthropic بدونن و ازش بهعنوان یکی از مهمترین مدلهای متنباز سال ۲۰۲۶ یاد کنن.
@reza_jafari_ai
2.3K ·