Веб-версияОткрыть в Telegram

Пост🧠 ИИ лучше улучшает агентов, когда развивает несколько специализаций

4 октября 2026
M
Machine learning Interview
Фотография
нажмите — покажем
🧠 ИИ лучше улучшает агентов, когда развивает несколько специализаций Исследователи предложили новый подход к оптимизации harness: кода вокруг LLM, который управляет инструментами, поиском информации и проверкой ответов. Обычно ИИ переписывает эту обвязку и оценивает версии на одном наборе задач. Но полезная специализация может потеряться, если проигрывает по общему баллу. Авторы разделили поиск на две ветки: • Каждая сохраняет задачи, с которыми справляется лучше другой. • Ведёт собственные заметки об удачных изменениях. • Развивает свою стратегию решения. В математике одна ветка сосредоточилась на проверке ответов, другая на построении полных решений. Затем роутер выбирает подходящую обвязку для каждой новой задачи. 📈 На олимпиадной математике с Gemini 3 Flash точность выросла с 46% до 62%. Это +16 процентных пунктов. Подход превзошёл исходный метод во всех четырёх проверенных сочетаниях моделей и бенчмарков, хотя расход токенов был выше. Практическая идея: при автоматической настройке агентов стоит сохранять несколько сильных специализаций и подбирать их под задачу. 📄 Исследование: https://arxiv.org/abs/2609.37834
46 · 1.6K ·

Рядом в ленте

MMachine learning InterviewMIT с помощью AI разработал более термостабильную формулу для mRNA-вакцин. Новая формула сохраняла стабильность: - до 1 года при комнатной температуре - до 2 меMMachine learning Interview🔥 ChatGPT PRO на русском: открытый курс от первого промпта до агентов и Codex На GitHub появился бесплатный практический курс по ChatGPT, целиком на русском. Он
это сообщение
MMachine learning InterviewApache Kafka курс 2026: бесплатный курс по Kafka с нуля до профи на русском Kafka обучение без воды: каждый модуль состоит из понятной теории, схем, команд, котMMachine learning InterviewHugging Face исследовали multi-harness RL: обучение с подкреплением сразу через Claude Code, Codex, OpenCode и Mini-SWE-Agent. Для этого объединили три проекта:
MMachine learning InterviewMachine learning Interview@machinelearning_interview · канал · Технологии
30 330подписчиков3 026средний охват поста
Лента площадки Открыть в Telegram

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем