Sparse Hash AI
Фотография
нажмите — покажем
нажмите — покажем
Hidden Decoding at Scale: Latent Computation Scaling for Large Language Models
Скрытое декодирование в масштабе: Масштабирование латентных вычислений для больших языковых моделей
https://www.alphaxiv.org/abs/2607.08186
———
Представлено как альтернатива зацикленным трансформерам. Hidden Decoding – каждому токену выдаётся не один, а n эмбеддингов. Соответственно в n раз увеличивается входная последовательность и вычисления.
68 ·