ChatCrawlerпоиск по публичному Telegram Открыть приложение
M

Machine learning chat

снимок за сентябрь 2025
сентябрь 2025 ×
30 сентября 2025
Machine learning chat
Ddd
M
Видео
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
⚡️ LoRA почти так же хороша, как полный fine-tuning, но в разы дешевле Thinking Machines выпустили новое исследование, которое смотрит на LoRA под другим углом. Главная идея исследования: LoRA может обучаться почти как полный fine-tuning, но при этом быть проще, дешевле и предсказуемее. Они доказали это экспериментально: взяли одинаковую модель, прогнали обучение двумя способами: полным fine-tuning и LoRA - и сравнили кривые потерь (loss vs steps). Процесс: - Дали чёткий рецепт, а не случайные гипотезы. - Показали, что процесс можно повторять с одинаковым результатом. - Выяснили, что если адаптеру не хватает памяти, модель не ломается, а просто замедляется. Результат показал, что при правильных настройках LoRA движется по той же траектории, что и FullFT. То есть качество модели и динамика обучения совпадают, пока у адаптера хватает параметров. Когда лимит достигается, у LoRA кривая не «обрывается», а просто идёт дальше медленнее. Именно за счёт этого LoRA демонстрирует предсказуемое и воспроизводимое поведение, а не случайные провалы, которые часто происходят при подборе гиперпараметров «на глаз». ✔️ Правила от команды Thinking Machines 1. Ставить LoRA на все слои, а не только на attention. 2. Использовать ~10× больший learning rate, чем обычно. 3. Не раздувать batch size - иначе падает стабильность. ✔️ Что в итоге: - Кривые обучения LoRA почти совпадают с full fine-tuning. - Даже в упоре в лимит адаптера модель ведёт себя плавно. - Вычислений требуется на треть меньше, чем у FullFT. LoRA может стать инструментом для надёжного и дешёвого пост-трейнинга. Для Thinking Machines это шаг к миссии: они уверены, что непредсказуемость моделей - это не фича, а баг, который можно исправить. Если убрать случайность и сделать выходы стабильными - ИИ станет безопасным даже для критически важных процессов. 📌 Подробнее @ai_machinelearning_big_data #LoRA #FineTuning #AI #MachineLearning #DeepLearning #LLM
46.2K ·
E
Всем привет! Может кто-нибудь дать советы с чего начать заниматься олимпиадами по ИИ
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
🔥 Zai_org выпускает GLM 4.6! Новая версия в линейке GLM получила улучшения сразу во всех ключевых направлениях: - программирование и работа с кодом - обработка длинных контекстов - улучшенное рассуждение и поиск - генерация текста и написание статей - агентные кейсы и применение в приложениях RELEASE: http://z.ai/blog/glm-4.6 MODEL 🔜 http://huggingface.co/zai-org/GLM-4.6 Docs: https://docs.z.ai/guides/llm/glm-4.6
4.7K ·
I
Фотография
нажмите — покажем
🚀 Мощные мультимодальные модели LLaVA-OneVision-1.5 LLaVA-OneVision-1.5 — это открытая платформа для обучения мультимодальных моделей, демонстрирующая выдающиеся результаты при низких затратах. Модели обучаются на высококачественных данных и обеспечивают превосходную эффективность. 🚀 Основные моменты: - Полностью открытый исходный код и данные для обучения - Высокое качество и разнообразие обучающих данных - Эффективная структура для экономного обучения - Поддержка современных технологий, таких как MoE и FP8 - Оптимизированный код для масштабируемости 📌 GitHub: https://github.com/EvolvingLMMs-Lab/LLaVA-OneVision-1.5 #python
4.4K ·
S
Фотография
нажмите — покажем
Как выбрать IT-инфраструктуру для ML и как внедрить MLOps? Реальные бизнес-кейсы Присоединяйтесь к Selectel Tech Day 8 октября, чтобы узнать о лучших практиках масштабирования ML-проектов и актуальных трендах инфраструктурного ML. На отдельном ML-треке обсудят: 🔺Как превратить экспериментальные модели в стабильные продакшн-системы. 🔺Как оценить эффективность внедрения ML-решений. 🔺Какая инфраструктура закроет все потребности ML-проектов. Вас ждет насыщенная программа: содержательные доклады, экспертная дискуссия и воркшоп. Участие бесплатное, нужно только зарегистрироваться → Реклама. АО "Селектел". erid:2W5zFGWQBHr
I
Фотография
нажмите — покажем
🔥 Refly — это открытая AI-платформа для создания контента с интуитивным интерфейсом на основе свободного полотна! 🌟 Она поддерживает многопоточные диалоги, интеграцию с базами знаний, контекстную память, интеллектуальный поиск и WYSIWYG-редактор. Refly помогает легко превращать идеи в готовый контент, поддерживает облачное и локальное развертывание через Docker. 🔐 Лицензия: Apache-2.0 🖥 Github @data_analysis_ml
5.2K ·
E
У кого-нибудь есть материал по изучению сетей и ллмкам? Для собеса надо
Открыть в Telegram Каталог площадок Искать в ChatCrawler

Слепок открытой публичной ленты из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог