Machine Learning Lab.
🤖 Alibaba'dan yangi gigant: Qwen3.8-Max
Alibaba'ning Qwen jamoasi bugun Qwen3.8-Max'ni rasman taqdim etdi — bu hozirgacha Qwen oilasidagi eng qudratli model. Model 2,4 trillion parametrli mixture-of-experts (MoE) arxitekturasida qurilgan, biroq har bir so'rovda taxminan 95 milliard parametr faollashadi — bu uni real ishlatish uchun ancha samarali qiladi. Kontekst oynasi 1 million tokengacha, matn, rasm va videoni bir vaqtda qayta ishlay oladi. Narxi: kirish — $2/million token, chiqish — $6/million token, keshlash esa $0.25/million token. Eng muhimi — keyingi hafta (10-avgust atrofida) Qwen3.8-Max hamda kichikroq Qwen3.8-27B modellari ochiq vazn (open-weight) sifatida chiqariladi. Bu Qwen'ning "Max" darajasidagi birinchi ochiq modeli bo'lishi kutilmoqda.
Bu xitoylik AI laboratoriyalari o'rtasidagi tezlashayotgan poyganing yana bir ko'rsatkichi — bir necha hafta oldin Moonshot AI o'zining 2,8 trillion parametrli Kimi K3 modelini ochiq vazn bilan chiqargan edi, endi Alibaba ham shu yo'ldan bormoqda. Ochiq modellarning yiriklashib borishi tadqiqotchilar va kichik kompaniyalar uchun frontier darajadagi modellarga kirish imkoniyatini kengaytiradi, garchi 2,4 trillion parametrli modelni mahalliy ishga tushirish uchun juda katta infratuzilma (bir necha yuz gigabayt VRAM) kerak bo'ladi. Shuni ta'kidlash kerakki, Alibaba'ning "eng qudratli modellardan biri, faqat Claude Fable 5'dan keyin" degan da'vosi kompaniyaning o'zi tomonidan aytilgan bo'lib, hali mustaqil benchmarklar bilan tasdiqlanmagan.
Bu yerdagi eng qiziq narsa — parametrlar soni emas, balki ochiq vaznli "Max" darajasidagi modellarning paydo bo'lishi. Bu tadqiqot va ta'lim sohasi uchun katta imkoniyat, ammo amalda ko'pchilik uchun bunday ulkan modelni mahalliy serverda ishga tushirish real emas — cloud API orqali foydalanish hozircha yagona amaliy yo'l bo'lib qoladi. Vendor e'lon qilgan raqamlarga ham ehtiyotkorlik bilan qarash kerak, mustaqil baholashlar chiqquncha.
🔗
https://qwen.ai/blog?id=qwen3.8
👉
@mach