Сможет ли 🆗 придумать то, чего ещё не существует?
На сессии Люк Бессон и представители креативных индустрий обсудят, где проходит граница между комбинацией известного и настоящим творческим скачком.
➡️ Присоединяйтесь к трансляции в нашем канале и на сайте
ПРАКТИКА И ТОЛЬКО ПРАКТИКА 🤩
16 октября состоится открытый инженерный день ГигаКонф, посвящённый практическим вопросам ИИ-разработки.
В программе четыре направления
🟣 ИИ-инструменты. Архитектура, метрики, ограничения и реальные кейсы внедрения
🟣 Модели и инфраструктура. Производительность, железо и оптимизация моделей
🟣 AI-native-организация. Изменение процессов и ролей в командах при агентизации
🟣 Harness. Предсказуемая и управляемая работа ИИ, спецификации, контекст, policies, workflow
🤩 Откроют день Кирилл Меньшов, Андрей Белевцев и Рафаел Тонаканян. А потом инженеры, разработчики и руководители из Сбера и других компаний поделятся практическим опытом в докладах и кейсах.
Также вас ждут выставка ИИ-продуктов, демо, интерактивы и AI PDLC на практике.
🤩 16 октября, офис Сбера, г. Москва, пр-т Кутузовский, 32к1
🤩 Вход по предварительной регистрации
Зарегистрироваться 🤩
✔️ Подписывайтесь на Sber AI в МАКС
Агент сказал, что всё сделал. Верим? 🤩
Чтобы понять, действительно ли ИИ справился с поручением, команды AGI NLP и Computer Operator представили WebPageBench — открытый бенчмарк для оценки работы веб-агентов на 152 повседневных задачах.
Агенты выполняют их на шести русскоязычных моках сайтов 🤩
🟣 Покупают товары
🟣 Бронируют отели
🟣 Ищут билеты
🟣 Работают с файлами и корзиной
Так можно отделить ошибки в понимании задания от проблем с конкретной реализацией интерфейса. Большинство существующих бенчмарков использует англоязычные интерфейсы, тогда как WebPageBench работает с русскоязычными 🔥
Все действия агента сайт записывает в лог событий. По нему система определяет, была ли задача выполнена успешно.
Ждать отмашки от самого агента или использовать LLM-судью не нужно 🤩
WebPageBench также проверяет, как агент справляется с разными реализациями одного и того же элемента интерфейса, например календаря, счётчика или выпадающего списка.
В публичном лидерборде уже 24 связки моделей и обвязок. Проект находится в открытом доступе, его можно запустить локально и добавить собственную модель или обвязку.
Код и инструкции — на GitHub
✔️ Подписывайтесь на Sber AI в МАКС
ВАМ LLM ИЛИ ЧТО-НИБУДЬ ПОМОЩНЕЕ? 🔫
Команда ML-инженера Sber AI Артёма Снегирева выпустила FRIDA-Decisions — быстрый энкодер, который берёт на себя простые решения, пока LLM занимается сложными. Энкодер может использоваться для роутинга, guardrails, классификации и отбора документов для RAG.
Вот всё, что нужно знать о FRIDA:
🤩 примерно в 10 раз быстрее API по независимым замерам — 28–34 мс на запрос на RTX 5060 Ti
🤩 просит всего 1,8 ГБ видеопамяти
🤩 запускается на CPU через int8 ONNX
🤩 новая задача не требует дообучения — достаточно передать новые варианты в JSON
Модель не прогоняет текст заново для каждого варианта, а читает его один раз, поэтому разбирает каталог из 243 интентов за 0,44 вместо 4,65 секунды. На бенчмарке razvilka из 735 задач на русском FRIDA-Decisions набрала 0,893 — почти на уровне коммерческого API TypeSafe Jev (0,897).
Веса, код и демодоступны открыты по лицензии MIT:
🤖 Демо
🤖 Модель
🤖 Бенчмарк
🤖 Код
🤖 Примеры
✔️ Подписывайтесь на Sber AI в МАКС
ГЕНЕРИРУЙТЕ ВИДЕО СО ЗВУКОМ БЕСПЛАТНО 🔥
Сбер представил новую линейку моделей Kandinsky 6.0 Video. Это первая российская нейросеть с синхронной генерацией видео и звука: речь с lip-sync, музыка и звуки окружения.
Предыдущая версия Kandinsky больше полугода держала первое место среди открытых text-to-video моделей на arena.ai, сравнявшись по качеству с Veo 3. Новая Pro-версия уже на уровне Veo 3.1 Audio. Среди открытых моделей её опережает только MiniMax H3, а с LTX 2.5 она идёт вровень.
😎
🤩 Video Pro на 29 млрд параметров
Флагманская модель создаёт пятисекундные ролики и работает с текстом и изображением. ИИ умеет генерировать видео в форматах 16:9, 9:16 и 1:1, а модель видео-апскейла увеличивает разрешение до Full HD
🤩 Video Lite на 3 млрд параметров
Компактная версия с той же архитектурой, адаптирована для запуска на потребительских видеокартах NVIDIA: от RTX 5060 Ti до 5090
Веса моделей доступны на Hugging Face, код — на GitHub 🤩
Опубликован подробный технический отчёт с описанием архитектуры, данных, процесса обучения и результатов тестирования 🤩
Kandinsky 6.0 Video поддерживает запуск в Diffusers, ComfyUI, FastVideo, SGLang и vLLM-omni. Модель можно попробовать бесплатно в ГигаЧате в разделе генерации видео.
✔️ Подписывайтесь на Sber AI в МАКС