Перейти к содержанию
Публикация AiManual

Lyria 3.5 в Google Flow Music: что нового в музыкальной генерации

Lyria 3.5 в Google Flow Music делает акцент на вокале, управлении BPM и структурой трека. Разбираем заявленные возможности, ограничения, доступ и коммерческое и

Коротко

Что будет в материале

  1. 01

    Что нового в Lyria 3.5

  2. 02

    Что важно знать перед использованием

  3. 03

    Как работает Lyria 3.5: архитектура и обучение

  4. 04

    Практическое применение: сценарии и ограничения

Коротко: Lyria 3.5 в Google Flow Music сфокусирована на трёх задачах: более выразительном AI-вокале, удержании структуры композиции и управлении темпом. Для пользователя это означает больше контроля при создании песен и фоновой музыки, но не полную замену музыкального продакшена: доступность, тарифы, лицензия, русский язык и фактические лимиты требуют отдельной проверки.

Что нового в Lyria 3.5

  • Вокал. Google заявляет о более естественной дикции, вибрато и поддержке эмоциональных стилей, включая vocal_emotion.
  • Структура. В промпте можно задавать секции [intro], [verse], [chorus], [bridge] и [outro].
  • Темп. Доступно управление через параметр tempo и BPM, однако точность удержания зависит от жанра, сложности аранжировки и конкретной генерации.
  • Длительность. В материалах о сервисе упоминается генерация треков продолжительностью до 5 минут. Это значение стоит воспринимать как заявленный лимит, который может зависеть от тарифа и региона.
  • Доступ. Flow Music работает как облачный веб-сервис. Для пользователей из регионов, где сервис недоступен, потребуется проверить актуальные условия доступа и ограничения VPN.

Главное обновление Lyria 3.5 не в одной отдельной функции, а в попытке дать пользователю более предсказуемый контроль над результатом. При этом точные показатели качества, скорости и стабильности нельзя считать универсальным бенчмарком без опубликованной методики и независимых тестов.

Вокал и эмоциональная выразительность

Ранние версии Lyria критиковали за типичные проблемы AI-вокала: роботизированную подачу, плавающую дикцию и неестественные переходы между слогами. Для Lyria 3.5 заявлена обновлённая система синтеза голоса, обученная на данных с разметкой эмоциональной окраски. Публичной технической документации, которая позволяла бы независимо подтвердить детали обучения, недостаточно.

Что заявлено и что имеет практический смысл:

  • Вибрато и динамика. Модель должна лучше управлять амплитудной и частотной модуляцией голоса. На медленных композициях это может дать более контролируемое вибрато, а в быстрых партиях — более разборчивую артикуляцию.
  • Эмоциональные пресеты. Упоминаются 12 базовых эмоциональных стилей: от «тёплой ностальгии» до «агрессивной подачи». Промпт vocal_emotion: melancholic, breathy задаёт одну манеру исполнения, а vocal_emotion: powerful, belting — другую. Конкретный результат всё равно зависит от жанра и текста.
  • Многоязычность. Заявлена поддержка английского, испанского, японского и корейского языков. Русский язык находится в статусе экспериментальной поддержки: базовая дикция может работать, но интонационные паттерны иногда ломаются на длинных фразах.

Для сравнения: в Suno Composer v3, который мы разбирали ранее, вокал может лучше подходить для прямолинейных поп-композиций, тогда как Lyria 3.5 делает акцент на управлении эмоциональной подачей. Udio интересен тембральным разнообразием, но стабильность результата сильнее зависит от точности промпта. Это практическое сравнение по сценарию использования, а не универсальный рейтинг качества.

Контроль структуры и длительности

Одна из главных проблем генерации AI-музыки — потеря структуры на длинных треках. Модели «забывают» начало композиции, припевы теряют повторяемость, а аутро может обрываться случайным образом. Lyria 3.5 пытается уменьшить эту проблему за счёт управления темпом и структурных тегов.

Управление темпом (BPM). В описании параметра tempo упоминается диапазон от 60 до 200 BPM с шагом в 1 единицу. Тезис о стабильном отклонении не более ±2 BPM и среднее значение 1.3 BPM относятся к заявленным или ранним наблюдениям, а не к общедоступному независимому тесту. На практике темп может меняться из-за жанра, переходов и плотности аранжировки.

Структурные теги. Промпт поддерживает разметку секций: [intro], [verse], [chorus], [bridge], [outro]. Их полезно рассматривать как указания модели, а не как гарантированные жёсткие границы. Пример рабочего промпта:

[intro: 8 bars, ambient pad, slow fade in]
[verse: 16 bars, piano + soft drums, male vocal, emotional: nostalgic]
[chorus: 8 bars, full band, powerful vocal, emotional: anthemic]
[verse: 16 bars, add strings]
[chorus: 8 bars, modulation +1 key]
[outro: 4 bars, fade out, solo piano]

Максимальная длительность генерации в доступных описаниях указывается как 5 минут. Утверждения о сохранении мотивов в 92% случаев и сравнении с 67% для предыдущей версии требуют опубликованной методики, поэтому их нельзя использовать как универсальный показатель качества.

Что важно знать перед использованием

  • Доступность по регионам. Условия работы Flow Music могут зависеть от страны, аккаунта и текущей политики Google. Вопрос доступа из РФ и Беларуси нужно проверять перед оплатой; использование VPN не отменяет правила сервиса.
  • Тарифы и лимиты. Количество генераций, максимальная длина, качество аудио и API-доступ могут различаться по тарифам. Указанные в статье значения следует сверять с актуальной страницей сервиса.
  • Лицензия. Коммерческое использование определяется Terms of Service и выбранным тарифом. Наличие платной подписки само по себе не является универсальной юридической гарантией.
  • Русский язык. Для русскоязычного вокала нужно закладывать дополнительный отбор генераций и возможную постобработку.
  • Облачная обработка. Lyria 3.5 не запускается локально на пользовательском ПК: генерация выполняется на стороне сервиса.

Как работает Lyria 3.5: архитектура и обучение

Google не публикует детальную архитектурную документацию Lyria 3.5. Информация собирается из материалов DeepMind, патентных заявок и комментариев разработчиков, поэтому часть технических выводов остаётся интерпретацией, а не подтверждённой спецификацией. Точные цифры по размеру модели и датасетам не раскрыты.

В доступных описаниях упоминаются следующие детали:

  • Тип архитектуры: гибридная система на базе трансформера с диффузионным декодером аудио. Предполагается, что трансформер обрабатывает текст промпта и формирует символическое представление музыки, а диффузионный модуль преобразует его в аудио.
  • Контекстное окно: сообщается о расширении до 8192 токенов, что должно помогать удерживать структурные зависимости на длинной композиции. Точное соответствие токенов временной длительности не подтверждено публичной спецификацией.
  • Датасет: Google заявляет об использовании лицензионно чистых данных, собственных записей и публично доступных композиций с истекшим сроком авторских прав. Точный состав и объём не раскрыты.
  • Инференс: в ранних описаниях фигурирует скорость 8–12 секунд на минуту аудио на TPU v5. Это заявленный показатель для конкретной конфигурации, а не гарантированная скорость для каждого пользователя.

Сравнение конкурентов по архитектуре также нужно воспринимать осторожно: внутренние детали Suno и Udio раскрыты не полностью. Поэтому корректнее сравнивать не предполагаемую архитектуру, а доступные пользователю контроль, скорость, длину результата и качество в конкретных сценариях.

Практическое применение: сценарии и ограничения

Lyria 3.5 может быть полезна в четырёх основных сценариях, но формулировки о «подтверждённых тестами» результатах стоит относить к заявленным материалам и ранним наблюдениям, если нет открытой методики проверки.

Фоновая музыка для контента. Модель подходит для инструментальных композиций с заданным настроением и понятной структурой. Это применимо к видео на YouTube, подкастам и презентациям. Промпт genre: lo-fi, mood: focused, no drums, no vocals задаёт нужное направление, но не гарантирует результат без постобработки.

Прототипирование треков. Музыкант задаёт структуру, темп и настроение, а затем использует генерацию как черновик. Это не замена студийной работе, а инструмент для преодоления «страха чистого листа».

Генерация идей для аранжировок. Lyria 3.5 может предложить неожиданные гармонические ходы и ритмические паттерны. Процент нестандартных модуляций и пользовательские оценки из ранних материалов не стоит переносить на все запросы: результат зависит от выборки промптов и критериев оценки.

Образовательные цели. Сгенерированные композиции можно использовать для анализа структуры и гармонии. Модель не заменяет музыкальную теорию, но даёт материал для практических упражнений.

Ограничения, которые нужно учитывать:

  • Жанровая специализация: модель заявлена как особенно подходящая для поп, электронной и ambient-музыки. Джазовая импровизация и классические формы могут требовать больше ручной доработки.
  • Максимальная длительность до 5 минут, если этот лимит подтверждается текущим тарифом. Для концептуальных альбомов и длинных саундтреков потребуется склейка нескольких генераций.
  • Авторские права: даже при заявленном использовании лицензионно чистых данных финальный трек может случайно совпасть с существующим произведением. Google не даёт универсальных юридических гарантий.

Сравнение с Suno и Udio

ПараметрLyria 3.5Suno Composer v3Udio
Основной сценарийСтруктурированный трек и эмоциональный вокалБыстрый черновик и поп-вокалТембральное разнообразие и длинные композиции
ВокалЗаявлены 12 эмоциональных стилей и 4 языкаАкцент на чистом поп-вокалеАкцент на разнообразии тембров
Структурный контрольТеги секций и управление BPMБазовая разметкаРасширенные элементы управления
Максимальная длинаДо 5 минут по заявленным условиямЗависит от текущей версии и тарифаЗависит от текущей версии и тарифа
Скорость генерацииЗаявлены 8–12 сек/мин для TPU v5В ранних сравнениях указывалась более высокая скоростьВ ранних сравнениях указывалась более низкая скорость
ЛицензияЗависит от тарифа и Terms of ServiceЗависит от тарифа и условий сервисаЗависит от тарифа и условий сервиса

Таблица показывает направление выбора, а не постоянный рейтинг: сервисы обновляются, а доступные лимиты и функции зависят от тарифа. Нужна быстрая идея с поп-вокалом — логично начать с Suno. Важны длинный результат и тембральное разнообразие — стоит посмотреть на Udio. Нужны структурные теги, BPM и управление эмоциональной подачей — Lyria 3.5 выглядит более подходящим вариантом. Подробный разбор Suno Composer v3 с тестами на 24 промптах доступен в отдельной статье.

Доступ к Google Flow Music и Lyria 3.5

Flow Music с Lyria 3.5 доступен через веб-интерфейс по адресу flowmusic.google.com. В описаниях сервиса упоминалась работа в 47 странах, включая США, Великобританию, Японию и большинство стран Евросоюза. Это число и список регионов нужно сверять с актуальными условиями Google. Россия и Беларусь указывались среди недоступных регионов; VPN с IP-адресом поддерживаемой страны не гарантирует доступ и не отменяет Terms of Service.

Тарифная сетка на июль 2026, приведённая в исходных материалах, выглядит так:

  • Free: заявлены 10 генераций в день, длина до 2 минут, качество 44.1 кГц и некоммерческая лицензия.
  • Creator ($12/мес): заявлены 100 генераций в день, длина до 5 минут, качество 48 кГц и коммерческая лицензия.
  • Pro ($30/мес): заявлены 500 генераций в день, API-доступ и пакетная генерация до 10 треков одновременно.

Эти цены и лимиты могут меняться, поэтому перед оплатой их необходимо проверить в интерфейсе Flow Music. API в исходном описании связывается с Google Cloud Console и отдельным биллингом; ставка $0.04 за минуту аудио и документация на developers.google.com/flow-music также требуют актуальной проверки.

Авторские права и коммерческое использование

Политику Google в отношении контента, созданного в Flow Music, определяют актуальные Terms of Service. В исходных материалах упоминалась редакция от 15 июля 2026, но юридические условия могут обновляться.

  • Права и разрешения на коммерческое использование могут зависеть от выбранного тарифа и условий аккаунта.
  • Free описывался как некоммерческий тир: личное использование допускается, а монетизация ограничивается условиями сервиса.
  • Google может оставлять за собой неисключительную лицензию на использование сгенерированного контента для улучшения модели. Возможность отказаться от этого режима нужно проверять в настройках аккаунта.
  • Даже заявление о лицензионно чистых данных не является юридической защитой от любых претензий третьих лиц. Аналогичные ограничения встречаются у Suno и Udio.

Перед коммерческим использованием проверьте лицензию конкретного тарифа, сохраните актуальную редакцию Terms of Service и отдельно оцените совпадения с существующими произведениями. Процент риска, включая приведённую ранее оценку менее 0.3%, нельзя считать надёжной универсальной метрикой без открытого исследования.

Перед публикацией на Spotify, Deezer или Apple Music проверьте правила соответствующей платформы: требования к AI-контенту и маркировке могут меняться. Наличие сгенерированного трека не гарантирует автоматическое прохождение модерации.

FAQ

Доступна ли Lyria 3.5 из РФ?

В исходных материалах Россия и Беларусь указаны как недоступные регионы. Актуальный статус зависит от политики Google и конкретного аккаунта. VPN с IP-адресом другой страны не гарантирует работу сервиса и может конфликтовать с его правилами.

Можно ли использовать треки Lyria 3.5 коммерчески?

Это зависит от тарифа и действующих Terms of Service. Перед публикацией или монетизацией проверьте условия лицензии, ограничения для Free и требования площадки, на которой будет размещён трек.

Какую максимальную длину трека поддерживает Lyria 3.5?

В описаниях упоминается длина до 5 минут. Фактический лимит может зависеть от тарифа, региона и текущей версии Flow Music.

Работает ли русский язык?

Русский язык описывается как экспериментально поддерживаемый. Базовая дикция возможна, но длинные фразы и интонация могут потребовать нескольких генераций и ручной обработки.

Можно ли задать BPM и структуру?

Да, в материалах упоминается параметр tempo и структурные теги [intro], [verse], [chorus], [bridge] и [outro]. Это управляющие указания, а не гарантия точного исполнения каждой секции.

Google продолжает расширять AI-линейку: задержка Gemini 3.5 Pro и ставка на Flash-модели, ограничения Gemma в сложных задачах и обновление Google Vids с AI-аватарами показывают интерес компании к специализированным сценариям. Flow Music с Lyria 3.5 занимает в этой стратегии нишу музыкальной генерации, но оценивать её место среди Suno и Udio стоит по конкретной задаче, доступным функциям и условиям лицензии.

Подписаться на канал