ChatCrawlerпоиск по публичному Telegram Открыть приложение
M

Machine learning chat

сообщение · 2024-06-30 18:41 UTC
С
Ответсообщение недоступно
Я предполагаю, что проблема в onnx. Возможно, он не оптимизирует под квантованную модельку вычисления, а падает скорость, потому что после квантизации сам граф модельки побольше становится обычно. Я бы попробовал в OV все квантизовать и там посмотреть на скорость, но в первую очередь проверить VNNI на наличие

Вся лента · оригинал в Telegram

Открыть в Telegram Каталог площадок Искать в ChatCrawler

Слепок открытой публичной ленты из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог