Веб-версияОткрыть в Telegram

ПостNot the Dimension, the Norm: What Matters in Gradient-Free Weight Perturbation of Language Models

18 августа 2026
S
Sparse Hash AI
Not the Dimension, the Norm: What Matters in Gradient-Free Weight Perturbation of Language Models https://www.alphaxiv.org/overview/2608.01624 Это исследование показало, что при адаптации больших языковых моделей без градиентов норма возмущения является единственным надежно влияющим фактором, а не размерность поиска или конкретная геометрия подпространства. Оно показало, что возмущение всего 12-16 скаляров может достичь производительности, сопоставимой с полноразмерным случайным поиском (в пределах 1,8 пункта точности), при этом оптимальные масштабы возмущения находятся в пределах постоянного окна для разных моделей и задач. ——— Уже существуют градиентные методы fine-tuning'а, где подстройка применяется к небольшому числу скаляров. В этой работе предложен безградиентный метод. Результат подтверждает верность гипотезы Neural Thickets – идеи о том, что эффективные эксперты по задачам плотно расположены вокруг предварительно обученных весов. Размерность поиска не является критической – четыре подобранных скаляра дают такое же качество как и 1100 скаляров. Обнаружено, что безградиентному поиску не требуется согласование направления подпространства с сингулярными направлениями исходных весов – оно может быть случайным. Роль SVD заключается в калибровке масштаба возмущений, а не в задаче их направлений. Ключом к успешной адаптации является не обязательно в каком направлении вы встряхиваете веса модели, а насколько сильно вы их встряхиваете.
2 · 97 ·

Рядом в ленте

SSparse Hash AIhttps://d.fixupx.com/ErenChenAI/status/2086830581820579924SSparse Hash AIInformation Abundance Paradox: Long-Context Training Undermines Parametric Knowledge Парадокс информационного изобилия: обучение с длинным контекстом подрывает
это сообщение
SSparse Hash AIp-Spin Glass Network Efficient Single-Batch Continual Learning Сеть р-спинового стекла: Эффективное однопакетное непрерывное обучение https://www.alphaxiv.org/aSSparse Hash AIRecirculation Рециркуляция https://www.alphaxiv.org/abs/2608.17981 ——— Простой способ снизить перплексию и повысить точность рассуждения на инференсе, не требую

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем