Anthropic выложили новое исследование, посвященное уязвимостям в криптографии, найденных с помощью Claude Mythos Preview. Первая — улучшенная атака на HAWK, постквантовую схему цифровой подписи из третьего раунда конкурса NIST: за 60 часов работы модель обнаружила неиспользованную ранее симметрию в решётке, фактически вдвое сократив эффективную стойкость ключа. Вторая уязвимость — ускорение в 200–800 раз лучшей атаки на урезанную семираундовую версию AES. Практических последствий нет: HAWK не развёрнут, а полный десятираундовый AES не затронут. Каждый результат обошёлся примерно в 100 тысяч долларов затрат на API.
Атаку на AES модель нашла за неделю почти автономно, а вот двум исследователям Anthropic понадобился почти месяц, чтобы убедиться в её корректности — проавда, они не специалисты по криптографии и потратили сотни часов на изучение области. Это фактически меняет подход к исследованиям — больше времени уходит не на то, чтобы найти проблему, а на проверку того, что это реальная проблема.
Впрочем, с остальными использованиями та же история — исходный код пишется быстро, зато потом проверяется вручную. Что немного намекает на то, что проверять надо все же как-то иначе.
https://www.anthropic.com/research/discovering-cryptographic-weaknesses