Видео
нажмите — покажем
нажмите — покажем
😸Филимон с новостями из мира музыки.
Lyria 3 от Google научилась понимать музыку, а не просто имитировать шум .
🧠 Теперь это не просто «симуляция звука», а понимание музыкальной теории. Если LLM предсказывают следующее слово, то Lyria научилась предсказывать следующую гармоническую долю.
⚙️ Что изменилось под капотом?
Технически Lyria 3 ушла от работы со спектрограммами (картинками звука) к более глубокой архитектуре:
🔹 MLAD (Multimodal Latent Audio Diffusion) - модель сначала строит математический «скелет» песни (темп, тональность, аккорды) и только потом «раскрашивает» его инструментами. Это дает кристально чистый звук 48 кГц / 24 бит.
🔹 Neural Pitch Mapping - отдельная нейросеть имитирует работу гортани: добавляет микро-вдохи, естественное дрожание нот и живые паузы.
🔹Stems (Мультитреки) - модель обучалась на изолированных дорожках, поэтому она понимает физику каждого инструмента отдельно.
🛡 Юридический слой и SynthID
Главная проблема ИИ-музыки - авторство. Google встроил SynthID: это невидимый водяной знак прямо в аудиоволне. Он выживает даже после записи на диктофон и подтверждает, что трек создан легально на базе каталога YouTube Music.
🎯 Почему это важно для айтишников?
Аудио-стек наконец-то готов к продакшену. Lyria 3 полностью интегрирована в Gemini API, а значит - никаких сторонних костылей.
Разработчикам уже доступны в Google AI Studio и Vertex AI:
🔹 lyria-3-pro-preview - для генерации полноценных композиций.
🔹 lyria-3-clip-preview - для создания быстрых лупов и эффектов (до 30 сек).
🎧 Как это звучит?
В качестве примера - трек «Степной Порыв», созданный с помощью Lyria 3.
😸Филимон убегает дописывать свой первый ИИ-альбом.
1 · 70 ·