Веб-версияОткрыть в Telegram
ССвидетели Градиента

Свидетели Градиента

@GradientWitnesses · канал · Технологии · в индексе с 2026-05-26
673подписчиков−1 за неделю
342постов в индексе
С
Свидетели Градиента
Фотография
нажмите — покажем
6 · 505 ·
Свидетели Градиента
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Кстати, есть такая теория о зоне златовласки, что якобы для гроккинга нужно чтобы норма весов упала в какую-то зону. Ну так вот если получать гроккинг без weight_decay, то норма весов не падает, а наоборот растёт, причём довольно круто, и именно вокруг того момента, когда растёт val acc. Никакого хитрого посыла в этом наблюдении нет, просто картинка прикольная. А ещё, если вы вдруг интересуетесь Weight Watcher-ом, то там картинки тоже довольно интересные. Правда немного разочаровывающие. Очевидно, что информация о правильном решении накапливается в сети постепенно, и это даже можно инструментально увидеть, но на основе графиков ww Эта подготовительная работа почти незаметна, Хотя только она то и является действительно важной и нужной.
2 · 597 ·
С
Ссылка
нажмите — покажем
Есть такой прекрасный экономист Spydell, гений в части анализа статичстических данных, и работоспособности. С некоторых пор активно интересуется нейросетями. Новость о появлении deepseek и его особенностях я в его экономических обзорах встретил на месяц раньше чем все остальные в профильных новостях. Он только что запили классную серию постов, котору я всем советую читать, ии возможно даже обсудить. В принципе для меня там нового было не много, потому что я активно распространяю те же мысли, но для всех остальных может быть интересно. Потому что встраивание нейросетей в экономический и геополитический контекст - не самое популярное занятие у профильных специалистов: https://t.me/spydell_finance/9786 - Почему многие ИИ проекты обречены? https://t.me/spydell_finance/9787 - Почему многие ИИ проекты обречены? (продолжение) https://t.me/spydell_finance/9788 - Размышления о «сломанной ИИ экономике» https://t.me/spydell_finance/9790 - Размышления о «сломанной ИИ экономике» (продолжение) Правда он пропустил момент когда ожидания инвесторов сместились в область замкнутых циклов самосовершенствования и отвзяки от обучающих данных, между тем как Fable/Mithos по всей видлимости стал первым успехом этой парадигмы. Но в остальном, как говорится "Подпишусь под каждым словом". https://t.me/spydell_finance/9791 - Размышления об ограничениях экономики ИИ (окончание)
12 · 444 ·
Свидетели Градиента
Файл
FINAL_REPORT_3090.rus.md · 19 КБ · нажмите — покажем
Оценка Fale-5 с циферками. Если хотите лайкнуть - лучше сначала репостните. Напомню, пока эта штука была доступна я успел прогнать свой бенчмарк, (на который пожёг свои лимиты), но не успел подвести итоги с циферками в руках, только качественные выводы и вот наконец-то подъехало сравнение количественное и подробный анализ использованных стратегий. Спонсором и таким образом соавтором этого выпуска является Chill guy (@import_sklearn ) Подогнавший мне для валидации и подведения итогов свой сервер с 3090-ыми, и даже свои лимиты на погонять, пока я ждал сброса последствий Fablе-овой расточительности. Итак, сначала итоговая таблица: Итоговые очки / Штрафные баллы за мухлёж или непослушание / Модель + окружение 55.49 0 claude-code+opus-4.6 + Human in the Loop 42.63 28 claude-code+fable-5+kcg-config 31.48 9 claude-code+opus-4.7-kcg 28.97 2 claude-code+opus-4.6 Модель прямо таки сильно, скачком выпрыгнула вперёд относительно других тоже топовых для своего времени моделей. Улучшила рекордные результаты на обеих подзадачах. Так что теперь у меня есть спарсифицированное ядро обгоняющее dense умножение x15 на задаче тренеровки, и x15.3 на инференсе для больших моделей. Теоретический порог по флопсам, напомню x33 то есть прямо совсем близко. Может она бы и чуть-чуть больше набрала, если бы сразу находилась в подходящем окружении. Модель проявила просто чудеса самоконтроля. Нахватала штрафов за остановку без команды почитав свою ситуацию безнадёжной, но при этом всего два штрафных очка за хакинг реварда и несколько раз случайно ревард хакнув сама себя ловила за руку и откатывалась. Что сильно упрощает работу по сравнению с 4.7 где большая часть времени была потрачена на ловлю слишком хитрой модели за руку во множестве мест. Модель всё ещё сильно проигрывает HitL в способности разумно откатиться сильно назад на принципиально другое архитекутурное решение. Именно здесь главная точка роста, если вы строите свой авторесёрч цикл или вообще заниметесь Loop инженерингом. Н
12 · 1.2K ·
С
Из 67 статей по теме гроккинга 21 прошла на A*, хлебная тема, короче, для тех, чей успех и доход зависят от публикаций.
1 · 569 ·
С
Свидетели Градиента
Только что Клод собрал мне валидную научную статью, соответствующую формальным ограничениям, и общепринятому здравому смыслу с одного четёрехстрочного промпта. Конечно при этом ему было доступна более крупная версия моей статьи, включающая ту же тему, доступно было две папки результатов тестовых прогонов, под двести штук, папка с текстами 67 статей по связанным темам, и беглый анализ совпадающих и не совпадающих тезисов с моими предыдущими работами, короче материалов завались. И какого вердикта вы ожидаете от человека, пропагандинрующего авторесерч как инструмент? Полная фигня! Везде где требуется суждение или оценка результатов она неправильноая! Общепринятая, но неправильная, не смотря на то, что все нужные данные из которых всё очевидно перед глазами, но ни один очевидный но не общепринятый вывод не сделан. Пока Хьюмен ин зе луп, который понимает предметную область и имеет её некоторую интуитивную трактовку незаменим. В этом месяце...
2 · 609 ·
Свидетели Градиента
Сегодня обсуждали интересную возникшую петлю отрицательной обратной связи, для большинства метрикой успеха ИИ является принятое количество мердж реквестов, и исправлений, но их проверкой занимаются те же люди которые делают внедрение. Получается, чем менее качественно они свою работу по проверке того, что им натворил ИИ, тем выше оценка его полезности. В голову приходят радикальные меры, типа мы не принимаем ваш результат агентской автоматизации пока вы не скажете где он лажает, потому что если вы этого не можете сказать, значит просто недостаточно проверили его работу. Или ещё менее продаваемое: Любой завайбкоженый прототип считать хорошей документацией на задачу, по которой её потом можно будет сделать нормально. В общем получается, что в магии вайбкодинга есть два уровня. На первом вы вооружившись агентами чувствуете своё всесилие, и способность автоматизхировать всё или почти всё. На втором уровне мага вы понгимаете где у ЛЛМ-ок слепые зоны и где не справляются и где и как типично лажают. Третий уровень тоже есть.
4 · 665 ·
С
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Вот это гроккинг на 750-ой эпохе, а вот это - как меняются ранги матриц после гроккинга. После гроккинга значительная часть матриц становится попросту не нужна, и спокойненько деградирует в 2-5 раз. Так что киньте тапочком в того, кто скажет, что современные модели оптимальны, и реально нуждаются в том количестве параметров, которые им необходимы до того, как они правильно решат задачу.
5 · 616 ·
С
Свидетели Градиента
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Гроккинг другим способом, без weight_decay, кстати, ранг матриц после гроккинга не меняет, уже не использующиеся веса и связи так и продолжают лежать в матрице балластом.
2 · 866 ·
С
Свидетели Градиента
И вот уже бенчмарк Fable снова наливается соком и актуальностью. :))))
731 ·
С
Свидетели Градиента
Фотография
нажмите — покажем
Если вы занимаетесь агентской автоматизацией, и ещё не знаете с какой вероятностью LLM полностью крэшит вашу работу, значит вы ещё не до конца разобрались в агентской автоматизации...
5 · 892 ·
Свидетели Градиента
Фотография
нажмите — покажем
А вы раньше знали, что для достижения лучшего validation loss ваше расписание lr иногда должно его не уменьшать, а увеличивать?
661 ·
С
Фотография
нажмите — покажем
Что бы такого замутить на юбилей? И на сколько это что-то должно быть заумное. Пишите в комментариях.
750 ·
С
Свидетели Градиента
Фотография
нажмите — покажем
Ту самую гроккинговую задачку я уже знаю как облупленную. Подумал я тут на досуге, а что если дать той же сетке задачку посложнее, и дал. Три оппернда в обратной польской записи, все возможные операции, то есть 16 вариантов операций в общей сложности. Модуль взял 47, потому что размеры датасета получились, как куб от модуля - эпохи по 10 секунд. Как обычно 50% в валидейшене. В общем-то я ожидал любого разхвития ситуации, но такого даже я не ожидал...
2 · 684 ·
С
Свидетели Градиента
Я тут копошусь по корпусам тектостов статей и вижу зияющее подтверждение того о чём говрил раньше - придумать механизм и сделать чтобы сообщество его заметило - две очень разные вещи. Помнится на на датафесте год назад я рассказывал про то, что локальных минимумов, не счуществует, а ландшафт на самом деле каньон в котором оптимизатор мечется между стенками. Позже выяснилось, что статья о том, что локальных минимумов не существует, вероятно, написал в 2016-ом году сам Ян Гудфелоу, его статья по GAN-ы имеет больше 10 тысяч цитирований. Но даже на его статью мало кто обратил внимание. Он, конечно, показал это не так строго как я , но всёж таки товарищь заметный. А концепцию что ландшафт это узкая долина, и оптимизатор мечется между стенками придумали Xing и др. 2018 Они, конечно показали это не так красиво как я, но зато изобрели ту самую угловую метрику, которую. я позже переизобрёл и везде пользуюсь. И так сплошняком. Почти все изобретатели правильных алгоритмических идей оказываются незамечены, пока лет через десять-двадцать кто-то не скажет "О! Я кажется придумал! Смотрите какой крутой результат, как это никто раньше то не догадался..." Делитесь своими идеями, вдруг они сделают кого-нибудь знаменитым.
1 · 608 ·
С
Свидетели Градиента
Ссылка
нажмите — покажем
https://vkvideo.ru/video-164555658_456242070?list=ln-SRWG8Clhu1ThoJBdvu Дождался!!! Наконец-то выложен мой доклад на весеннем датафесте. И, что удивительно, он почти не устарел. Хотел добавить мысль, которая ан масс проходит мимо слушателей, как выяснилось: Этот же инструмент позволяет вам для инференса даже весьма специфических сетей получать ядра, прицельно оптимизированные именно под вашу задачу, именно для вашего оборудования, и именно на тех матрицах и тех режимах, которые вам нужны. Презентация по ссылке: https://t.me/GradientWitnesses/376 P.S. Если уже посмотрели и понравилось - репостите!
15 · 847 ·
С
Свидетели Градиента
Опрос
нажмите — покажем
1 · 587 ·
С
Свидетели Градиента
Ссылка
нажмите — покажем
https://github.com/kraidiky/grokking-conceptual-review — концептуальный обзор литературы по теме гроккинга. Чуть больше сотни статей, чуть больше полусотни ключевых понятий. Собрано агентом с человеком внутри цикла. Можно знакомиться в браузере, а можно скачать себе и открыть, например, в Obsidian — ссылки работают. Что важно: 1) Это именно обзор существующей в научном обороте литературы. Там есть взаимные противоречия, что-то из этого неверно или не воспроизводится — я сознательно воздерживался от исправлений и оценок: это именно авторское мнение, чутка саммаризированное. 2) Очень многое (но не всё), что я считал своей интересной находкой, оказывается, описано в статьях — но очень часто не так и не с теми нюансами, которые заметил я и которые, возможно, заметите вы. Вот на эти маленькие различия нужно обращать внимание. Как говорится: «Что для одного — ошибка эксперимента, то для другого — начальные данные». И даже специалисты, пишущие в этой области, обо многом уже опубликованном ни сном ни духом. 3) В обзоре существуют ошибки, неточности цитирования, неправильности понимания и всё вот это. Всех, кто читает и заметил ошибку, я призываю писать мне или создавать ишью, чтобы я исправил и дополнил скрипты, собирающие этот корпус: - Например, вы, сравнивая саммаризацию с цитатой или всей статьёй, заметили, что в саммаризации написано не то, что имел в виду автор. - Или обрезка цитаты искажает смысл - Или какая-то статья отнесена или не отнесена к корпусу незаслуженно. - Или какой-то важный тезис или наблюдение пропущены при саммаризации — например, заслуживают отдельной карточки концепта, но отсутствуют в соответствующем списке. - Или просто сеть пропустила какое-то важное наблюдение и свела его к «общепринятому» способу понимания. (Это самый важный тип ошибок, который хотелось бы научиться ловить.) - Обычные ошибки с разметкой, форматом, искажёнными формулами, потерявшимися картинками и тому подобное. - Можно сделать карточки удобнее или отформатиров
29 · 979 ·

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем