24 серпня 2026
Serhii Sakhno 🇺🇦Хз що по цені. Але по спекам Nvidia GB10 навіть поряд не стоїть
не менше 3к баксів думаю?
Panda🤔ну я зробив знижку на те що китайці, але да
Та. Але спеки сильно кращі. Пропускна здатність десь в 4 рази вища.
Serhii Sakhno 🇺🇦Та. Але спеки сильно кращі. Пропускна здатність десь в 4 рази вища.
Але тут треба дивитися що таке near-memory bandwidth. Бо маркетингові заяви у всіх гарні)
Panda🤔я вчора якийсь леново дивився, то там ціна в нього 5к була
Насправді якщо врахуватити податки та логістику, часто різниця не така велика. Якщо це це більш менш офіціал з нормальним сервісом. То невелика націнка за сервіс взагалі не проблема.
Panda🤔https://www.xda-developers.com/qwen-3-8-27b-reverse-engineering-job-frontier-model/
а блін, я фігню сказав, воно на офіційному сайті лєніво коштує 5850
Фотография
натисніть — покажемо
натисніть — покажемо
Власне питання які цікавлять найбільше. Або що ховається за маркетингом)
https://x.com/plotarmordev/status/2091854328130883987
Alexтекст ще не в індексі
Я думаю тут справа в іншому.
Саме тому на раст він гарно також пише - вся справа у компіляторі.
Він так само пише лайно на ТС, якщо дозволити Record<string, unknown>. А з гарними типами виходить краще
Benтекст ще не в індексі
Бери MoE версію як Qwen3.6 35b a3b де активні параметри викинеш на відюху, а решту що не влізе на оперативку. Буде бодай якась робоча швидкість генерації. Ще по слухам мб упродовж місяця вийде 3.8 MoE.
Якщо хоч саме dense модельку то мб доведеться тобі Q3 квант юзати із контекстом в RAM. Але все що ниже Q4 зазвичай має проблему залупінга або використання тулзів. Але на r/LocalLlama бачив що юзабельно для людей. Там же можеш знайти гайди як то всьо провернуть
Sergiiтекст ще не в індексі
36 звучить маловато. Для чого юзаєш модельку? Як саб агента чи шо? ІМО 72-96к це юзабельний мінімум для майже всіх випадків
Alexтекст ще не в індексі
Ну я би сказав що із коробки більшість моделей сильно опираються на запаєний "inner knowledge" сформований на тренувальних даних. Й без тулзів для збіру контексту й веб пошуку +- інструкції юзати їх, модельки часто можуть застарілі функції, способи реалізації юзати чи тупо в thinking надумати собі що "ця версія не існує, мабуть користувач мав на увазі..." й тому подібне. У мене особисто дуже проявлялось в геймдеві на нових рушіях як Godot 4.6+ де без LSP, Context7, Web Search й т.п. Модельки часто вигадували якісь методи двіжка чи юзали ті що позначені obsolete або криво юзали. Але водночас докрутка цих всих тулзів на пошук інфи й перевірки результатів підвищує кількість зжертих токенів й розмір контексту сесії, тому для тих хто живе на підписках чи юзає локальні із малим контекстом може бути не камільфо. В цьому плані новіші модельки матимуть новійший датасет й менш потребуватимуть "тулзів у формі коліщаток до ровера".
Stanislav Khavruk36 звучить маловато. Для чого юзаєш модельку? Як саб агента чи шо? ІМО 72-96к це юзабельний мінімум для майже всіх випадків
Аналіз фото, чатбот щоб з апішкою працював, плеврайт...Для розробки звісно що чятік та антропік. Сенс про те що вони вже не бредогенератори навіть попри такі невеличкі розміри.
25 серпня 2026
Сьогодні експериментальним шляхом виявив, що команди у ~/.claude переписують рівень проекта. Я так розумію, зі скілами так само?
Здається, ми вже маємо проблему з неймінгом. Наприклад, coderabbit створює свій code-review скіл. Чи означає це, що Клод перестане бачити свій власний вбудований? Або як розрізняти, чиє рев'ю буде викликане?