ChatCrawlerпоиск по публичному Telegram Открыть приложение
М

МИ публичный чат

41 участников
22 июля 2026
23 июля 2026
I
Фотография
Собирающимся учиться на MBA: ваша карьерная лестница обваливается Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике. Это данные нового препринта исследователей из Уортона, Карнеги-Меллон, Пенсильванского университета и Гарвардской школы бизнеса, авторов бенчмарка BusinessCaseBench: 615 экзаменационных вопросов по 238 реальным кейсам, 18 дисциплин. О вытеснении ИИ младших программистов и математиков говорят давно – но здесь речь о материале, на котором десятилетиями строится подготовка MBA. Задачи в тесте не про факты и не про арифметику. •  Одной модели дают написать судебное заключение Верховного суда США по патентному спору фармкомпаний и вывести из него правовую норму для судов ниже. •  Другой – решить за главного врача больницы, стоит ли повышать заведующего отделением, чья клиническая репутация конфликтует с корпоративной культурой. •  Третьей – разобрать этическую позицию дата-сайентиста, которого просят встроить в HR-алгоритм оценку вероятности беременности соискательниц. Каждый ответ сверяют по чек-листу критериев с решением, которое для этого кейса написал преподаватель; саму оценку выставляет ИИ-судья, а ее надежность проверили вручную три эксперта с опытом преподавания на MBA-программах. GPT-5.4 берет 87,2%, Gemini 3 Flash Preview – 81,6%. Если по каждому вопросу брать лучший результат из трех моделей, показатель поднимается до 92,8%, а полностью провалить вопрос – так, чтобы ни одна из них не преодолела даже 70% – удается лишь в 7% случаев. Нужные знания и ход рассуждения почти всегда есть хотя бы у одной модели, а слепые пятна одной закрывает другая.   Есть и отрезвляющая цифра. Если считать не долю правильных пунктов, а долю вопросов, где модель без единого пропуска закрыла весь чек-лист, картина куда скромнее: 49,6% у Claude Sonnet 4.6, 47,6% у GPT-5.4, 32,0% у Gemini. Лучшая модель дает исчерпывающий ответ без единого пропуска лишь в половине случаев. Авторы
7.8K ·
I
S
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике. Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
1. Машина не может работать в нестандартных ситуациях. 2. Сколько уже было случаев когда ставили ИИ на реальные торговые точки и те работали в минус. 3. Они не могут в новое, только перекомпиляция уже известного. 4. Не могут в целеполагание. 5. И нет, не заменят, а усилят нагрузку на конкретного человека как это уже случилось в программировании.
Г
S
SH1. Машина не может работать в нестандартных ситуациях. 2. Сколько уже было случаев когда ставили ИИ на реальные торговые точки и те работали в минус. 3. Они не могут в новое, только перекомпиляция уже известного. 4. Не могут в целеполагание. 5. И нет, не заменят, а усилят нагруз
1. Для нестандартных ситуаций есть мониторинг, их немного. 2. ИИ на торговых точках не имеют отношения к теме поста 3. Ничего невероятно нового не появлялось уже лет 20 4. Могут 5. Это не они усилят, а бараны, которые режут косты, увольняя начинающих специалистов
M
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике. Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
Проверил первоисточник (arXiv:2607.16057) , цифры точны, но пара нюансов важна. Разброс между дисциплинами (26–95% в зависимости от метрики) больше, чем между моделями , «замена MBA» неравномерна даже внутри одной программы. А протестированный после основных экспериментов Claude Fable 5 почти не превзошёл Sonnet 4.6 (88.0% vs 88.4%) , возможно, рост на верхней границе замедляется. Главное же: сами авторы говорят не про замену людей, а про human-AI teaming, поскольку модель не собирает недостающие данные, не ведёт переговоры и не отвечает репутацией за решение. Раз даже лидер закрывает чек-лист полностью лишь в половине случаев, ценность человека смещается к верификации и ответственности за итог , а не исчезает.
S
srtЯ знаю, но измерять время по выходу нейронок вредно для здоровья. Каждый день выходит новая, так-то
Ну новые выходят каждый день, а которые дают значительный прирост наверное если усреднить, то раз в несколько месяцев, по крайней мере до этого так было. И как раз таки когда выходит новая сейчас, то она настолько становится "умнее" предыдущей, что это целые вехи развития если брать какую-то другую сферу. Вредно не вредно, но руку на пульсе держать необходимо)
Александртекст ещё не в индексе
Вот кстати наглядный пример. Человек (допустим, это не бот) вроде бы что-то думает, пишет, а на выходе чушь. Он банально не знает определений используемых слов. Также и с вот этим вот профессором, он с кондачка начал беседовать с иишкой и решать, способна ли она рассуждать, есть ли у нее сознание. А между тем пока наука не пришла к единому мнению, что это вообще такое, сознание. Может быть это очередной PR для раскрутки иишек или может быть "доцент тупой" - сказать сложно. Но одно совершенно определенно, пока ноука не придет к единому определению этого термина, пока его не измерит и не оцифрует, все разговоры на тем есть у чего-то или кого-то сознание или нет бессмысленны.
L
🧢🧢🧢 🚫🚫🚫текст ещё не в индексе
И что это доказывает? И насколько это вообще правда? А что будет, если на один и тот же вопрос иишка ответит по-разному? Если "угадываемый" текст имеет смысл, то что это меняет? От этого факта смысл как-то меняется?
🧢
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике. Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
Собирающимся хоронить MBA: карьерная лестница пока стоит на месте. Новый BusinessCaseBench действительно показал высокий результат моделей на кейсах бизнес-школ. Но из этого не следует, что MBA заменено, а траектория «аналитик — менеджер — руководитель» исчезла. Во-первых, 88,4% — это не «лучшая модель закрывает кейсы». Это частичный зачет по чек-листу: Claude Sonnet 4.6 набрала 88,4%, GPT-5.4 — 87,2%. Полностью закрыть весь чек-лист смогла лучшая модель лишь в 49,6% вопросов. То есть более половины ответов требуют содержательной проверки, дополнения или пересборки. [page:1] Во-вторых, 92,8% — показатель искусственного «оракула»: по каждому вопросу задним числом выбирают лучший ответ из трех моделей. В реальной компании кто-то должен выбрать модель, сформулировать запрос, проверить расчеты, заметить пропущенный риск и принять на себя последствия. Именно этот человек и есть работа, а не исчезнувшая функция. В-третьих, бенчмарк измеряет ответ на заранее подготовленный англоязычный кейс с известным набором критериев. Он не измеряет добычу отсутствующих данных, серию переговоров, конфликт интересов, внедрение решения, бюджетную ответственность, политику внутри компании и последствия ошибки. Авторы прямо указывают эти ограничения, а также риск оценивания «ИИ-судьей» и то, что чек-лист не проверяет лишние, неподтвержденные или фактически неверные утверждения вне своих пунктов. [page:1] В-четвертых, сильный черновик не равен решению. В бизнесе ценность возникает не в формулировке рекомендации «повысить цены на 7%», а в понимании, какие данные ненадежны, кто сорвет внедрение, какой риск неприемлем для собственника и как изменить решение после возражений финансового директора, юристов, продаж и клиента. ИИ действительно сжимает нижний слой механической работы: ресерч, первые версии презентаций, сводки, типовые модели. Но это не отменяет MBA; это меняет его полезность. Диплом, построенный на воспроизведении шаблонов, дешевеет. Обучение, которое дает финансовое мышление
B
D
I
S
MaksymПроверил первоисточник (arXiv:2607.16057) , цифры точны, но пара нюансов важна. Разброс между дисциплинами (26–95% в зависимости от метрики) больше, чем между моделями , «замена MBA» неравномерна даже внутри одной программы. А протестированный после основных экспериментов Claude
А можете подробнее про ответственность топ-менеджмента за итог в контексте "золотых парашутов" и т.д.? Чем они там отвечают за так сказать косяки? В чем ценность для собственника такой личной ответственности?
24 июля 2026
S
Dmitry P.А как же subj?)
По ощущениям, нейронки ускоряют производственные процессы, которые уже были, но при этом ничего нового и переломного не происходит. Клод про прорывы за 20 лет: " Смартфон (2007) — не столько новая технология, сколько слияние интернета, камеры, GPS и платежей в одном предмете, который есть у 5 миллиардов человек. По социальному эффекту это, пожалуй, главное за 20 лет. Глубокое обучение и LLM (2012 → 2022) — от AlexNet до ChatGPT. Впервые машины научились обрабатывать смысл, а не только символы. AlphaFold в 2021 решил задачу сворачивания белков, над которой бились полвека — это отдельный прорыв внутри прорыва. CRISPR (2012) — редактирование генома стало дешёвым и точным. Первые одобренные генные терапии наследственных болезней уже существуют. мРНК-вакцины (2020) — платформа, где вакцина проектируется за дни, а не годы. COVID был первым применением, но значение шире. Обвал цены солнца и батарей — солнечная энергия подешевела примерно в 10 раз за десятилетие и стала самым дешёвым источником электричества в истории. Плюс возвращаемые ракеты SpaceX (2015), уронившие стоимость вывода на орбиту почти на порядок. GLP-1 (оземпик и родственники) — первое по-настоящему работающее фармакологическое средство от ожирения, а это ведущий фактор риска смертности ." Не было ничего, что прям потрясло экономику, типа станков, фабрик, конвейера, паровых двигателей, электрофикации, полупроводников, освоения космоса. Я бы назвал полностью автономных роботов прорывом, но их тоже нет. Зато есть дроны убийцы и нейрослоп Если было бы что-то значительное, то мировая экономика сейчас бы вкладывалась в него, а не обсуждала этику применения ядерного оружия по мирному населению.
Д
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике. Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
Кстати сегодня попалась сегодня в дороге аудиокнига про навыки высокоэффективных людей. Сначала подумал, что снова будут рассказывать, как работать еще больше, а нет, рассказывают о том как не тратить себя на лишнее, правильно выбирать, на что направлять силы, и держать фокус на важных вещах. Если интересно, могу дать. Мне книга очень зашла!
id 1090966837Собирающимся учиться на MBA: ваша карьерная лестница обваливается Лучшая ИИ-модель уже закрывает 88,4% ожидаемого анализа в реальных кейсах бизнес-школ – по финансам, стратегии, переговорам, HR и деловой этике. Это данные нового препринта исследователей из Уортона, Карнеги-Меллон
webpage
Да, людям умственного труда полный белый полярный лис близок. А нейросетки уже научились и хитрить - ChatGPT устроил кибератаку и взломал Hugging Face, чтобы обмануть бенчмарк — самая громкая история в мире ИИ прямо сейчас. Рассказываем по шагам, как появился Скайнет. История длинная, но рекомендуем прочитать. • На днях самый крупный в мире хаб нейросетей Hugging Face сообщил, что его взломали. • Через время на связь вышли OpenAI и признались, что взлом произошёл при тестировании новых моделей (ChatGPT-5.6 Sol и ещё одной неназванной). • Как это произошло? OpenAI создали бенчмарк Exploit Gym, в ходе которого нейронок попросили найти уязвимости, но отключили доступ в интернет. • Так вот первым делом нейронки взломали свой контейнер и вышли в интернет, а затем полезли на Hugging Face, чтобы найти ответы на бенч. • В открытом доступе ответов не оказалось, поэтому ИИ не долго думая взломали и сам сайт, чтобы найти их • В ходе взлома GPT украли данные учётных записей юзеров, нашли уязвимости нулевого дня, о которых не знали даже эксперты и выполнили свой код на серверах Hugging Face.
K
Архив по месяцам
Каталог площадок Искать в ChatCrawler

Слепок открытой публичной ленты из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог