Ответсообщение недоступно
А если выбросить ритуальные заклинания про новый уровень и открытые веса (не модели)?
Практический потолок локального инференса для 100% участников чата — gemma 4 31B или аналогичный по размеру qwen. Это уровень claude haiku, только в несколько раз медленнее.
Практический потолок файн-тюнинга модели с открытыми весами — это около 4B. На самом деле даже меньше — чтобы прогнать обучение на большей модели, понадобится несколько десятков часов работы A100/H100, а это уже тысячи долларов на арендованных картах. И датасеты для обучения и других стадий тоже как-то надо получить/сделать/небесплатно.
Поэтому, извините, в чем открытость и новоуровневость моделей, если вы не можете ничего из этого использовать, а можете только, как с любой другой моделью, ходить к ней через API/харнесс?