Веб-версияОткрыть в Telegram

ПостInformation Abundance Paradox: Long-Context Training Undermines Parametric Knowledge

17 августа 2026
S
Sparse Hash AI
Information Abundance Paradox: Long-Context Training Undermines Parametric Knowledge Парадокс информационного изобилия: обучение с длинным контекстом подрывает параметрические знания https://www.alphaxiv.org/abs/2608.12218 ——— На большом контексте в виду избытка в нём релевантной информации у моделей развивается "контекстная зависимость" – оптимизатор смещает градиентное давление со слоёв FFN, связанных со знанием, в сторону слоёв внимания. Модель учится не понимать, а искать ответ в контексте. Для задач понимания естественного языка производительность вначале улучшается с увеличением контекста, достигает пика, а затем неуклонно снижается.
3 · 120 ·

Рядом в ленте

SSparse Hash AI🔥 Kilobyte Models: Neural Networks as a Seed and a Quantized Latent Килобайтные модели: Нейронные сети как сид и квантованное латентное представление https://wwSSparse Hash AIhttps://d.fixupx.com/ErenChenAI/status/2086830581820579924
это сообщение
SSparse Hash AINot the Dimension, the Norm: What Matters in Gradient-Free Weight Perturbation of Language Models https://www.alphaxiv.org/overview/2608.01624 Это исследование SSparse Hash AIp-Spin Glass Network Efficient Single-Batch Continual Learning Сеть р-спинового стекла: Эффективное однопакетное непрерывное обучение https://www.alphaxiv.org/a
SSparse Hash AISparse Hash AI@SparseHashAI · канал · Технологии
176подписчиков850постов в индексе
Лента площадки Открыть в Telegram

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем