ChatCrawlerпоиск по публичному Telegram Открыть приложение
D

Developer Community | Open Movie Database

сообщение · 2026-06-28 14:29 UTC
E
Ответсообщение недоступно
Фотография
нажмите — покажем
С добавлением воркфлоу в Claude Code я заметил, что там зачастую работают модели Sonnet и Haiku для рутинных задач. Они дешевле, но по производительности особо не отличаются от Opus. В целом время работы в облачных моделях стало ужасным. Во многих задачах складывается впечатление, что модель просто ждёт, а не делает задачу. Начал тестировать локальные модели не только по качеству реализации, но и по времени работы. На моей пекарне чуть больше ресурсов, чем нужно, и значит, можно их задействовать в полезной нагрузке. А значит, реально заменить модели Sonnet и Haiku на локальную. Провёл тесты, результаты оказались отличными на MoE-моделях. Мой фаворит, Gemma-4-26B-A4B, оказалась сверхбыстрой и при этом достаточно качественной. Прирост производительности — в 5 раз. А чтобы она работала вместо этих двух моделек, буду использовать CCR. MoE-модели в целом очень приятны в домашнем использовании: там немного активных параметров, но при этом качество ответов практически такое же. Это видно, например, по Qwen Coder Next: модель имеет размер 51 GB, но 3B активных параметров. Она не влезает полностью на две мои видюхи, но ей это не мешает. А у Gemma 4 31B все 31B активные, и она полностью помещается на две видюхи, но производительность у неё низкая из-за того, что на каждый токен ей нужно пересчитать все активные веса. На скрине — таблица с отчётом.
380 ·

Вся лента · оригинал в Telegram

Открыть в Telegram Каталог площадок Искать в ChatCrawler

Слепок открытой публичной ленты из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог