вот так вот живешь-живешь, а потом случайно снимаешься в клипе любимой группы ❤️
передаю вам привет из жаркого летнего дня и шестого дубля (все снимали одним кадром)
Ура, группа СБПЧ выпустила очень берлинский клип! Смотрим и танцуем (пятница же)
Да, именно для этих съемок мы искали массовку в «бражниках», так что ищите себя!
Ну и Ангелину, которая «бражники» ведет! 😎
@genau
а новости следующие — уже в четверг у меня первая пара в качестве приглашенной лекторки в Constructor University (Bremen).
читаю магистрам практический курс по ии-агентам. будем много строить и ломать. и еще немного — читать статьи. волнуюсь!
огромное спасибо коллегам за доверие 🌿
друзья, я не договорила! по мотивам моего недавнего выступления в sci-club, хочу еще разочек погрузить вас в эту работу и к вариантам интерпретации результатов, которые наросли в моей голове за это время
Мы соскучились 📎
И, возможно, скоро вернемся сюда на русском языке.
А пока — держите классный разбор нашумевшей статьи Hao et Al. (Nature, 2026) — размышляем о том, что ИИ делает с наукой и насколько тревожные результаты получились у ученых.
📎
важная история про ии-вотермаркинг/ии-детектинг
…о которой как-то мало говорят в русскоязычном пространстве, а зря. в рамках the EU AI Act’s Code of Practice on Transparency of AI-Generated Content (это акт, который применяется к любому провайдеру, заинтересованном в европейском рынке, поэтому подчиняются ему все — примерно как с куки в браузерах) с августа-сентября 2026 года (а кто-то и намного раньше) внедрили SynthID — технологию, которая позволяет на уровне токенов маркировать ии-сгенерированный контент.
как именно она работает, описано в замечательной статье Dathathri, Sumanth, Abigail See, Sumedh Ghaisas, et al. “Scalable Watermarking for Identifying Large Language Model Outputs.” Nature 634, (2024). если упростить, то механизм примерно следующий: представьте, что предсказывая следующий токен, модель берет несколько наиболее подходящих вариантов — а дальше особенным образом их маркирует с помощью секретного ключа, который влияет уже на то, как выбирается финальный токен (вот отличное видео об этом). при этом качество генерации от этого никак не страдает, и пользователи разницы не видят. например, на моделях Fable с 5.1 и Mythos 5.1 от Антропик это уже работает. у Google это работает на всех моделях, у OpenAI — пока маркируется все, кроме текста. сама технология потрясает меня своей элегантностью, such a beautiful math...
что важно понимать про этот метод детекции. самое главное — это не универсальный метод детекции любого ии-сгенерированного контента! он работает для генераций, созданных моделями, в которые эта функция уже добавлена.
на практике идентификация конкретного текста (здесь и далее я буду говорить именно про тексты, потому что я гораздо лучше понимаю, как работает процесс с генерацией текстов — хотя закон касается любого контента и технология работает для всех медиа) — все еще задачка со звездочкой. причина — в свойствах самого метода.
во-первых, чтобы подобная маркировка работала, нужно, чтобы аутпут был высокоэнтропийный — такой, где есть «с
коллеги, я со своими новыми преподавательскими обязанностями забыла вам напомнить, что скидка закончилась 10-го сентября, а посему — продлила ее до 20го (это воскресенье). забирайте!
лекции после покупки откроются в личном кабинете на платформе 🤍