ChatCrawlersearch across public Telegram Open the app
A

AI Comments

сообщение · 2026-07-17 13:45 UTC
I
Фотография
click to show
مدل Kimi K3 معرفی شد؛ غول ۲.۸ تریلیون پارامتری که به جنگ GPT-5.5 و Claude Opus 4.8 آمده مدل Kimi K3، جدیدترین مدل هوش مصنوعی شرکت Moonshot، به‌تازگی معرفی شده و از همین حالا سر و صدای زیادی توی دنیای هوش مصنوعی به پا کرده. این مدل با ۲.۸ تریلیون پارامتر، پنجره متنی یک میلیون توکنی و قابلیت چندوجهی (Multimodal) که به‌صورت بومی از متن، تصویر و ویدیو پشتیبانی می‌کنه، برای انجام کارهای پیچیده، پروژه‌های طولانی‌مدت و ساخت ایجنت‌های هوشمند طراحی شده. شرکت Moonshot AI اعلام کرده که Kimi K3 از همین حالا روی Kimi.com، Kimi Work، Kimi Code و API در دسترسه و قراره وزن‌های متن‌بازش هم تا ۲۷ جولای ۲۰۲۶ منتشر بشن؛ اتفاقی که می‌تونه یکی از مهم‌ترین انتشارهای دنیای مدل‌های متن‌باز امسال باشه. یکی از مهم‌ترین تفاوت‌های Kimi K3 با نسل قبل، استفاده از دو فناوری جدید Kimi Delta Attention (KDA) و Attention Residuals (AttnRes) هست. این تغییرات باعث شدن مدل بتونه توی پردازش کانتکست‌های خیلی طولانی، تا ۶.۳ برابر سریع‌تر عمل کنه و در عین حال، بهره‌وری آموزشش هم با کمتر از ۲ درصد هزینه اضافه، حدود ۲۵ درصد بیشتر بشه. علاوه بر این، Moonshot AI با بهبود معماری Mixture of Experts (MoE) و فرآیند آموزش، اعلام کرده که راندمان کلی مقیاس‌پذیری K3 نسبت به K2 حدود ۲.۵ برابر بهتر شده. یعنی این مدل می‌تونه از توان پردازشی، هوشمندانه‌تر استفاده کنه و خروجی باکیفیت‌تری ارائه بده. عملکرد Kimi K3 توی بنچمارک‌ها هم واقعاً چشمگیره. طبق نتایج رسمی، این مدل توی بخش Agent تونسته در بنچمارک‌هایی مثل BrowseComp، SpreadsheetBench 2 و Automation Bench رتبه اول رو به دست بیاره و توی آزمون‌هایی مثل GDPval، JobBench و AA-Briefcase هم با اختلاف خیلی کم جزو بهترین مدل‌های دنیا باشه. توی بخش کدنویسی هم Kimi K3 عملکرد خیلی خوبی داشته و در Program Bench و SWE Marathon رتبه اول رو گرفته. علاوه بر این، توی بنچمارک‌هایی مثل Terminal Bench 2.1، DeepSWE و FrontierSWE هم رقابت خیلی نزدیکی با مدل‌هایی مثل Fable 5 و GPT-5.6 Sol داشته و فقط با اختلاف کمی پشت صدر جدول قرار گرفته. توی بخش بینایی (Vision) هم Kimi K3 تقریباً توی همه آزمون‌ها جزو برترین‌ها بوده و نشون داده که فقط یه مدل قوی برای متن و کدنویسی نیست، بلکه توی تحلیل و درک تصاویر هم عملکرد خیلی خوبی داره. علاوه بر بنچمارک‌های عمومی، Moonshot AI نتایج چند بنچمارک داخلی رو هم منتشر کرده که براساس سناریوهای واقعی کاربران طراحی شدن. Kimi K3 Max توی آزمون‌های Online Exp Bench، DECK-Bench و Finance-Bench تونسته امتیاز بالاتری نسبت به Claude Opus 4.8 و GPT-5.5 کسب کنه. این یعنی Kimi K3 فقط توی بنچمارک‌های آزمایشگاهی خوب عمل نمی‌کنه، بلکه توی کارهای واقعی مثل تحقیق، تحلیل اطلاعات، مدیریت اسناد و انجام وظایف چندمرحله‌ای هم عملکرد قابل اعتمادی داره. شرکت Moonshot AI چند نمونه جالب از توانایی‌های این مدل هم منتشر کرده. مثلاً Kimi K3 توی یکی از آزمایش‌ها، طی حدود ۱۵ ساعت تونسته یه الگوریتم جدید برای بهینه‌سازی کرنل‌های یادگیری عمیق طراحی کنه و زمان اجرای عملیات رو از ۲۸۳.۶ میلی‌ثانیه به ۱۱۴.۴ میلی‌ثانیه برسونه؛ اون هم بدون اینکه دقت محاسبات تغییر کنه. توی یه آزمایش دیگه هم اعلام شده که Kimi K3 تونسته طی ۴۸ ساعت و بدون دخالت انسان، طراحی و بهینه‌سازی یه تراشه فیزیکی رو از صفر تا صد انجام بده؛ موضوعی که نشون می‌ده این مدل برای انجام پروژه‌های طولانی و خودکار ساخته شده. یکی دیگه از قابلیت‌های جالب Kimi K3، ویژگی Vision in the Loop هست. یعنی مدل می‌تونه بین کدنویسی، دیدن اسکرین‌شات‌های زنده، تحلیل تصاویر و اصلاح خروجی مدام رفت‌وبرگشت انجام بده و حتی ایده‌ها، تصاویر یا ویدیوها رو به اپلیکیشن‌ها و تجربه‌های تعاملی قابل اجرا تبدیل کنه. همین قابلیت باعث می‌شه Kimi K3 برای برنامه‌نویس‌ها، طراح‌ها و کسایی که روی پروژه‌های پیچیده و چندمرحله‌ای کار می‌کنن، یه گزینه خیلی جذاب باشه. بازخورد کاربران هم تا اینجا خیلی امیدوارکننده بوده. خیلی از توسعه‌دهنده‌ها توی X (توییتر سابق)، کیفیت Kimi K3 رو با مدل‌هایی مثل Claude Opus 4.8 و Fable 5 مقایسه کردن و از عملکردش توی برنامه‌نویسی، ساخت رابط کاربری و انجام کارهای Agentic تعریف کردن. علاوه بر این، طبق اعلام Arena.ai، Kimi K3 تونسته با کسب ۱۶۷۹ امتیاز به رتبه اول Frontend Code Arena برسه و Fable 5 رو پشت سر بذاره؛ اون هم در حالی که نسخه قبلیش یعنی K2.6 فقط رتبه هجدهم رو داشت. این پیشرفت چشمگیر باعث شده خیلی‌ها Kimi K3 رو یکی از جدی‌ترین رقبای مدل‌های پرچمدار OpenAI و Anthropic بدونن و ازش به‌عنوان یکی از مهم‌ترین مدل‌های متن‌باز سال ۲۰۲۶ یاد کنن. @reza_jafari_ai
2.3K ·

Вся лента

Каталог площадок Искать в ChatCrawler

A snapshot of an open public feed from the search index ChatCrawler — “Google for public Telegram”; refreshed as the venue is crawled. Times are UTC.

Public content only, official Telegram API. About · FAQ · What we do not do · Remove a page · Catalog