22 июля 2026
23 июля 2026
Фотография
Собирающимся учиться на MBA: ваша карьерная лестница обваливается
Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике.
Это данные нового препринта исследователей из Уортона, Карнеги-Меллон, Пенсильванского университета и Гарвардской школы бизнеса, авторов бенчмарка BusinessCaseBench: 615 экзаменационных вопросов по 238 реальным кейсам, 18 дисциплин.
О вытеснении ИИ младших программистов и математиков говорят давно – но здесь речь о материале, на котором десятилетиями строится подготовка MBA.
Задачи в тесте не про факты и не про арифметику.
• Одной модели дают написать судебное заключение Верховного суда США по патентному спору фармкомпаний и вывести из него правовую норму для судов ниже.
• Другой – решить за главного врача больницы, стоит ли повышать заведующего отделением, чья клиническая репутация конфликтует с корпоративной культурой.
• Третьей – разобрать этическую позицию дата-сайентиста, которого просят встроить в HR-алгоритм оценку вероятности беременности соискательниц.
Каждый ответ сверяют по чек-листу критериев с решением, которое для этого кейса написал преподаватель; саму оценку выставляет ИИ-судья, а ее надежность проверили вручную три эксперта с опытом преподавания на MBA-программах.
GPT-5.4 берет 87,2%, Gemini 3 Flash Preview – 81,6%. Если по каждому вопросу брать лучший результат из трех моделей, показатель поднимается до 92,8%, а полностью провалить вопрос – так, чтобы ни одна из них не преодолела даже 70% – удается лишь в 7% случаев. Нужные знания и ход рассуждения почти всегда есть хотя бы у одной модели, а слепые пятна одной закрывает другая.
Есть и отрезвляющая цифра. Если считать не долю правильных пунктов, а долю вопросов, где модель без единого пропуска закрыла весь чек-лист, картина куда скромнее: 49,6% у Claude Sonnet 4.6, 47,6% у GPT-5.4, 32,0% у Gemini. Лучшая модель дает исчерпывающий ответ без единого пропуска лишь в половине случаев. Авторы
7.8K · id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается
Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике.
Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
ну всё, пора апгрейдить скиллы блин
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается
Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике.
Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
1. Машина не может работать в нестандартных ситуациях.
2. Сколько уже было случаев когда ставили ИИ на реальные торговые точки и те работали в минус.
3. Они не могут в новое, только перекомпиляция уже известного.
4. Не могут в целеполагание.
5. И нет, не заменят, а усилят нагрузку на конкретного человека как это уже случилось в программировании.
SH1. Машина не может работать в нестандартных ситуациях.
2. Сколько уже было случаев когда ставили ИИ на реальные торговые точки и те работали в минус.
3. Они не могут в новое, только перекомпиляция уже известного.
4. Не могут в целеполагание.
5. И нет, не заменят, а усилят нагруз
Ну, подавляющее большинство современных клерков, с любым образованием, уж точно заменит )
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается
Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике.
Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
Странная статейка про давно уже не современные модели
SH1. Машина не может работать в нестандартных ситуациях.
2. Сколько уже было случаев когда ставили ИИ на реальные торговые точки и те работали в минус.
3. Они не могут в новое, только перекомпиляция уже известного.
4. Не могут в целеполагание.
5. И нет, не заменят, а усилят нагруз
1. Для нестандартных ситуаций есть мониторинг, их немного.
2. ИИ на торговых точках не имеют отношения к теме поста
3. Ничего невероятно нового не появлялось уже лет 20
4. Могут
5. Это не они усилят, а бараны, которые режут косты, увольняя начинающих специалистов
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается
Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике.
Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
Проверил первоисточник (arXiv:2607.16057) , цифры точны, но пара нюансов важна.
Разброс между дисциплинами (26–95% в зависимости от метрики) больше, чем между моделями , «замена MBA» неравномерна даже внутри одной программы. А протестированный после основных экспериментов Claude Fable 5 почти не превзошёл Sonnet 4.6 (88.0% vs 88.4%) , возможно, рост на верхней границе замедляется.
Главное же: сами авторы говорят не про замену людей, а про human-AI teaming, поскольку модель не собирает недостающие данные, не ведёт переговоры и не отвечает репутацией за решение. Раз даже лидер закрывает чек-лист полностью лишь в половине случаев, ценность человека смещается к верификации и ответственности за итог , а не исчезает.
srtGpt 5.4 запустили 4 месяца назад
В нейронках это уже как раз таки давно, вышла 5.5 которая лучше 5.4 и 5.6 которая сильно лучше 5.5. Сейчас проблема в том что скорость выхода статей безнадёжно уступает тому что происходит на фронтире
ℬ𝒶𝓂𝒷𝓊𝒸𝓀 𝒥ℯ𝓃𝓀𝒾𝓃𝓈В нейронках это уже как раз таки давно, вышла 5.5 которая лучше 5.4 и 5.6 которая сильно лучше 5.5. Сейчас проблема в том что скорость выхода статей безнадёжно уступает тому что происходит на фронтире
Я знаю, но измерять время по выходу нейронок вредно для здоровья. Каждый день выходит новая, так-то
srtЯ знаю, но измерять время по выходу нейронок вредно для здоровья. Каждый день выходит новая, так-то
Ну новые выходят каждый день, а которые дают значительный прирост наверное если усреднить, то раз в несколько месяцев, по крайней мере до этого так было. И как раз таки когда выходит новая сейчас, то она настолько становится "умнее" предыдущей, что это целые вехи развития если брать какую-то другую сферу. Вредно не вредно, но руку на пульсе держать необходимо)
Александртекст ещё не в индексе
Вот кстати наглядный пример. Человек (допустим, это не бот) вроде бы что-то думает, пишет, а на выходе чушь. Он банально не знает определений используемых слов. Также и с вот этим вот профессором, он с кондачка начал беседовать с иишкой и решать, способна ли она рассуждать, есть ли у нее сознание. А между тем пока наука не пришла к единому мнению, что это вообще такое, сознание.
Может быть это очередной PR для раскрутки иишек или может быть "доцент тупой" - сказать сложно. Но одно совершенно определенно, пока ноука не придет к единому определению этого термина, пока его не измерит и не оцифрует, все разговоры на тем есть у чего-то или кого-то сознание или нет бессмысленны.
🧢🧢🧢 🚫🚫🚫текст ещё не в индексе
И что это доказывает? И насколько это вообще правда? А что будет, если на один и тот же вопрос иишка ответит по-разному? Если "угадываемый" текст имеет смысл, то что это меняет? От этого факта смысл как-то меняется?
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается
Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике.
Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
Собирающимся хоронить MBA: карьерная лестница пока стоит на месте.
Новый BusinessCaseBench действительно показал высокий результат моделей на кейсах бизнес-школ. Но из этого не следует, что MBA заменено, а траектория «аналитик — менеджер — руководитель» исчезла.
Во-первых, 88,4% — это не «лучшая модель закрывает кейсы». Это частичный зачет по чек-листу: Claude Sonnet 4.6 набрала 88,4%, GPT-5.4 — 87,2%. Полностью закрыть весь чек-лист смогла лучшая модель лишь в 49,6% вопросов. То есть более половины ответов требуют содержательной проверки, дополнения или пересборки. [page:1]
Во-вторых, 92,8% — показатель искусственного «оракула»: по каждому вопросу задним числом выбирают лучший ответ из трех моделей. В реальной компании кто-то должен выбрать модель, сформулировать запрос, проверить расчеты, заметить пропущенный риск и принять на себя последствия. Именно этот человек и есть работа, а не исчезнувшая функция.
В-третьих, бенчмарк измеряет ответ на заранее подготовленный англоязычный кейс с известным набором критериев. Он не измеряет добычу отсутствующих данных, серию переговоров, конфликт интересов, внедрение решения, бюджетную ответственность, политику внутри компании и последствия ошибки. Авторы прямо указывают эти ограничения, а также риск оценивания «ИИ-судьей» и то, что чек-лист не проверяет лишние, неподтвержденные или фактически неверные утверждения вне своих пунктов. [page:1]
В-четвертых, сильный черновик не равен решению. В бизнесе ценность возникает не в формулировке рекомендации «повысить цены на 7%», а в понимании, какие данные ненадежны, кто сорвет внедрение, какой риск неприемлем для собственника и как изменить решение после возражений финансового директора, юристов, продаж и клиента.
ИИ действительно сжимает нижний слой механической работы: ресерч, первые версии презентаций, сводки, типовые модели. Но это не отменяет MBA; это меняет его полезность. Диплом, построенный на воспроизведении шаблонов, дешевеет. Обучение, которое дает финансовое мышление
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается
Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике.
Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
там пишут, что у OpenAI молоко алгоритм убежал 😅 а GLM-5.2 его поймал, арестовал, велел паспорт показать 😹🥸
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается
Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике.
Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
И что в этом плохого для 99% людей?
Посопереживать топ-менеджерам "не знающим земли"?
Слава Богу- что приземлило их. Пора пожить нормальной, человеческой жизнью.
MaksymПроверил первоисточник (arXiv:2607.16057) , цифры точны, но пара нюансов важна.
Разброс между дисциплинами (26–95% в зависимости от метрики) больше, чем между моделями , «замена MBA» неравномерна даже внутри одной программы. А протестированный после основных экспериментов Claude
А можете подробнее про ответственность топ-менеджмента за итог в контексте "золотых парашутов" и т.д.?
Чем они там отвечают за так сказать косяки? В чем ценность для собственника такой личной ответственности?
24 июля 2026
Dmitry P.А как же subj?)
По ощущениям, нейронки ускоряют производственные процессы, которые уже были, но при этом ничего нового и переломного не происходит.
Клод про прорывы за 20 лет:
"
Смартфон (2007) — не столько новая технология, сколько слияние интернета, камеры, GPS и платежей в одном предмете, который есть у 5 миллиардов человек. По социальному эффекту это, пожалуй, главное за 20 лет.
Глубокое обучение и LLM (2012 → 2022) — от AlexNet до ChatGPT. Впервые машины научились обрабатывать смысл, а не только символы. AlphaFold в 2021 решил задачу сворачивания белков, над которой бились полвека — это отдельный прорыв внутри прорыва.
CRISPR (2012) — редактирование генома стало дешёвым и точным. Первые одобренные генные терапии наследственных болезней уже существуют.
мРНК-вакцины (2020) — платформа, где вакцина проектируется за дни, а не годы. COVID был первым применением, но значение шире.
Обвал цены солнца и батарей — солнечная энергия подешевела примерно в 10 раз за десятилетие и стала самым дешёвым источником электричества в истории. Плюс возвращаемые ракеты SpaceX (2015), уронившие стоимость вывода на орбиту почти на порядок.
GLP-1 (оземпик и родственники) — первое по-настоящему работающее фармакологическое средство от ожирения, а это ведущий фактор риска смертности
."
Не было ничего, что прям потрясло экономику, типа станков, фабрик, конвейера, паровых двигателей, электрофикации, полупроводников, освоения космоса.
Я бы назвал полностью автономных роботов прорывом, но их тоже нет. Зато есть дроны убийцы и нейрослоп
Если было бы что-то значительное, то мировая экономика сейчас бы вкладывалась в него, а не обсуждала этику применения ядерного оружия по мирному населению.
Владимиртекст ещё не в индексе
Это надо отключать опцию "память" у провайдера, она очень давно есть много у кого
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается
Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике.
Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
Кстати сегодня попалась сегодня в дороге аудиокнига про навыки высокоэффективных людей. Сначала подумал, что снова будут рассказывать, как работать еще больше, а нет, рассказывают о том как не тратить себя на лишнее, правильно выбирать, на что направлять силы, и держать фокус на важных вещах. Если интересно, могу дать. Мне книга очень зашла!
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается
Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике.
Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
webpage
Да, людям умственного труда полный белый полярный лис близок. А нейросетки уже научились и хитрить - ChatGPT устроил кибератаку и взломал Hugging Face, чтобы обмануть бенчмарк — самая громкая история в мире ИИ прямо сейчас.
Рассказываем по шагам, как появился Скайнет. История длинная, но рекомендуем прочитать.
• На днях самый крупный в мире хаб нейросетей Hugging Face сообщил, что его взломали.
• Через время на связь вышли OpenAI и признались, что взлом произошёл при тестировании новых моделей (ChatGPT-5.6 Sol и ещё одной неназванной).
• Как это произошло? OpenAI создали бенчмарк Exploit Gym, в ходе которого нейронок попросили найти уязвимости, но отключили доступ в интернет.
• Так вот первым делом нейронки взломали свой контейнер и вышли в интернет, а затем полезли на Hugging Face, чтобы найти ответы на бенч.
• В открытом доступе ответов не оказалось, поэтому ИИ не долго думая взломали и сам сайт, чтобы найти их
• В ходе взлома GPT украли данные учётных записей юзеров, нашли уязвимости нулевого дня, о которых не знали даже эксперты и выполнили свой код на серверах Hugging Face.
srtПо ощущениям, нейронки ускоряют производственные процессы, которые уже были, но при этом ничего нового и переломного не происходит.
Клод про прорывы за 20 лет:
"
Смартфон (2007) — не столько новая технология, сколько слияние интернета, камеры, GPS и платежей в одном предмете, ко
Посмотрите на китайские автозаводы