Коротко: Lyria 3.5 в Google Flow Music сфокусирована на трёх задачах: более выразительном AI-вокале, удержании структуры композиции и управлении темпом. Для пользователя это означает больше контроля при создании песен и фоновой музыки, но не полную замену музыкального продакшена: доступность, тарифы, лицензия, русский язык и фактические лимиты требуют отдельной проверки.
Что нового в Lyria 3.5
- Вокал. Google заявляет о более естественной дикции, вибрато и поддержке эмоциональных стилей, включая
vocal_emotion. - Структура. В промпте можно задавать секции
[intro],[verse],[chorus],[bridge]и[outro]. - Темп. Доступно управление через параметр
tempoи BPM, однако точность удержания зависит от жанра, сложности аранжировки и конкретной генерации. - Длительность. В материалах о сервисе упоминается генерация треков продолжительностью до 5 минут. Это значение стоит воспринимать как заявленный лимит, который может зависеть от тарифа и региона.
- Доступ. Flow Music работает как облачный веб-сервис. Для пользователей из регионов, где сервис недоступен, потребуется проверить актуальные условия доступа и ограничения VPN.
Главное обновление Lyria 3.5 не в одной отдельной функции, а в попытке дать пользователю более предсказуемый контроль над результатом. При этом точные показатели качества, скорости и стабильности нельзя считать универсальным бенчмарком без опубликованной методики и независимых тестов.
Вокал и эмоциональная выразительность
Ранние версии Lyria критиковали за типичные проблемы AI-вокала: роботизированную подачу, плавающую дикцию и неестественные переходы между слогами. Для Lyria 3.5 заявлена обновлённая система синтеза голоса, обученная на данных с разметкой эмоциональной окраски. Публичной технической документации, которая позволяла бы независимо подтвердить детали обучения, недостаточно.
Что заявлено и что имеет практический смысл:
- Вибрато и динамика. Модель должна лучше управлять амплитудной и частотной модуляцией голоса. На медленных композициях это может дать более контролируемое вибрато, а в быстрых партиях — более разборчивую артикуляцию.
- Эмоциональные пресеты. Упоминаются 12 базовых эмоциональных стилей: от «тёплой ностальгии» до «агрессивной подачи». Промпт
vocal_emotion: melancholic, breathyзадаёт одну манеру исполнения, аvocal_emotion: powerful, belting— другую. Конкретный результат всё равно зависит от жанра и текста. - Многоязычность. Заявлена поддержка английского, испанского, японского и корейского языков. Русский язык находится в статусе экспериментальной поддержки: базовая дикция может работать, но интонационные паттерны иногда ломаются на длинных фразах.
Для сравнения: в Suno Composer v3, который мы разбирали ранее, вокал может лучше подходить для прямолинейных поп-композиций, тогда как Lyria 3.5 делает акцент на управлении эмоциональной подачей. Udio интересен тембральным разнообразием, но стабильность результата сильнее зависит от точности промпта. Это практическое сравнение по сценарию использования, а не универсальный рейтинг качества.
Контроль структуры и длительности
Одна из главных проблем генерации AI-музыки — потеря структуры на длинных треках. Модели «забывают» начало композиции, припевы теряют повторяемость, а аутро может обрываться случайным образом. Lyria 3.5 пытается уменьшить эту проблему за счёт управления темпом и структурных тегов.
Управление темпом (BPM). В описании параметра tempo упоминается диапазон от 60 до 200 BPM с шагом в 1 единицу. Тезис о стабильном отклонении не более ±2 BPM и среднее значение 1.3 BPM относятся к заявленным или ранним наблюдениям, а не к общедоступному независимому тесту. На практике темп может меняться из-за жанра, переходов и плотности аранжировки.
Структурные теги. Промпт поддерживает разметку секций: [intro], [verse], [chorus], [bridge], [outro]. Их полезно рассматривать как указания модели, а не как гарантированные жёсткие границы. Пример рабочего промпта:
[intro: 8 bars, ambient pad, slow fade in] [verse: 16 bars, piano + soft drums, male vocal, emotional: nostalgic] [chorus: 8 bars, full band, powerful vocal, emotional: anthemic] [verse: 16 bars, add strings] [chorus: 8 bars, modulation +1 key] [outro: 4 bars, fade out, solo piano]
Максимальная длительность генерации в доступных описаниях указывается как 5 минут. Утверждения о сохранении мотивов в 92% случаев и сравнении с 67% для предыдущей версии требуют опубликованной методики, поэтому их нельзя использовать как универсальный показатель качества.
Что важно знать перед использованием
- Доступность по регионам. Условия работы Flow Music могут зависеть от страны, аккаунта и текущей политики Google. Вопрос доступа из РФ и Беларуси нужно проверять перед оплатой; использование VPN не отменяет правила сервиса.
- Тарифы и лимиты. Количество генераций, максимальная длина, качество аудио и API-доступ могут различаться по тарифам. Указанные в статье значения следует сверять с актуальной страницей сервиса.
- Лицензия. Коммерческое использование определяется Terms of Service и выбранным тарифом. Наличие платной подписки само по себе не является универсальной юридической гарантией.
- Русский язык. Для русскоязычного вокала нужно закладывать дополнительный отбор генераций и возможную постобработку.
- Облачная обработка. Lyria 3.5 не запускается локально на пользовательском ПК: генерация выполняется на стороне сервиса.
Как работает Lyria 3.5: архитектура и обучение
Google не публикует детальную архитектурную документацию Lyria 3.5. Информация собирается из материалов DeepMind, патентных заявок и комментариев разработчиков, поэтому часть технических выводов остаётся интерпретацией, а не подтверждённой спецификацией. Точные цифры по размеру модели и датасетам не раскрыты.
В доступных описаниях упоминаются следующие детали:
- Тип архитектуры: гибридная система на базе трансформера с диффузионным декодером аудио. Предполагается, что трансформер обрабатывает текст промпта и формирует символическое представление музыки, а диффузионный модуль преобразует его в аудио.
- Контекстное окно: сообщается о расширении до 8192 токенов, что должно помогать удерживать структурные зависимости на длинной композиции. Точное соответствие токенов временной длительности не подтверждено публичной спецификацией.
- Датасет: Google заявляет об использовании лицензионно чистых данных, собственных записей и публично доступных композиций с истекшим сроком авторских прав. Точный состав и объём не раскрыты.
- Инференс: в ранних описаниях фигурирует скорость 8–12 секунд на минуту аудио на TPU v5. Это заявленный показатель для конкретной конфигурации, а не гарантированная скорость для каждого пользователя.
Сравнение конкурентов по архитектуре также нужно воспринимать осторожно: внутренние детали Suno и Udio раскрыты не полностью. Поэтому корректнее сравнивать не предполагаемую архитектуру, а доступные пользователю контроль, скорость, длину результата и качество в конкретных сценариях.
Практическое применение: сценарии и ограничения
Lyria 3.5 может быть полезна в четырёх основных сценариях, но формулировки о «подтверждённых тестами» результатах стоит относить к заявленным материалам и ранним наблюдениям, если нет открытой методики проверки.
Фоновая музыка для контента. Модель подходит для инструментальных композиций с заданным настроением и понятной структурой. Это применимо к видео на YouTube, подкастам и презентациям. Промпт genre: lo-fi, mood: focused, no drums, no vocals задаёт нужное направление, но не гарантирует результат без постобработки.
Прототипирование треков. Музыкант задаёт структуру, темп и настроение, а затем использует генерацию как черновик. Это не замена студийной работе, а инструмент для преодоления «страха чистого листа».
Генерация идей для аранжировок. Lyria 3.5 может предложить неожиданные гармонические ходы и ритмические паттерны. Процент нестандартных модуляций и пользовательские оценки из ранних материалов не стоит переносить на все запросы: результат зависит от выборки промптов и критериев оценки.
Образовательные цели. Сгенерированные композиции можно использовать для анализа структуры и гармонии. Модель не заменяет музыкальную теорию, но даёт материал для практических упражнений.
Ограничения, которые нужно учитывать:
- Жанровая специализация: модель заявлена как особенно подходящая для поп, электронной и ambient-музыки. Джазовая импровизация и классические формы могут требовать больше ручной доработки.
- Максимальная длительность до 5 минут, если этот лимит подтверждается текущим тарифом. Для концептуальных альбомов и длинных саундтреков потребуется склейка нескольких генераций.
- Авторские права: даже при заявленном использовании лицензионно чистых данных финальный трек может случайно совпасть с существующим произведением. Google не даёт универсальных юридических гарантий.
Сравнение с Suno и Udio
| Параметр | Lyria 3.5 | Suno Composer v3 | Udio |
|---|---|---|---|
| Основной сценарий | Структурированный трек и эмоциональный вокал | Быстрый черновик и поп-вокал | Тембральное разнообразие и длинные композиции |
| Вокал | Заявлены 12 эмоциональных стилей и 4 языка | Акцент на чистом поп-вокале | Акцент на разнообразии тембров |
| Структурный контроль | Теги секций и управление BPM | Базовая разметка | Расширенные элементы управления |
| Максимальная длина | До 5 минут по заявленным условиям | Зависит от текущей версии и тарифа | Зависит от текущей версии и тарифа |
| Скорость генерации | Заявлены 8–12 сек/мин для TPU v5 | В ранних сравнениях указывалась более высокая скорость | В ранних сравнениях указывалась более низкая скорость |
| Лицензия | Зависит от тарифа и Terms of Service | Зависит от тарифа и условий сервиса | Зависит от тарифа и условий сервиса |
Таблица показывает направление выбора, а не постоянный рейтинг: сервисы обновляются, а доступные лимиты и функции зависят от тарифа. Нужна быстрая идея с поп-вокалом — логично начать с Suno. Важны длинный результат и тембральное разнообразие — стоит посмотреть на Udio. Нужны структурные теги, BPM и управление эмоциональной подачей — Lyria 3.5 выглядит более подходящим вариантом. Подробный разбор Suno Composer v3 с тестами на 24 промптах доступен в отдельной статье.
Доступ к Google Flow Music и Lyria 3.5
Flow Music с Lyria 3.5 доступен через веб-интерфейс по адресу flowmusic.google.com. В описаниях сервиса упоминалась работа в 47 странах, включая США, Великобританию, Японию и большинство стран Евросоюза. Это число и список регионов нужно сверять с актуальными условиями Google. Россия и Беларусь указывались среди недоступных регионов; VPN с IP-адресом поддерживаемой страны не гарантирует доступ и не отменяет Terms of Service.
Тарифная сетка на июль 2026, приведённая в исходных материалах, выглядит так:
- Free: заявлены 10 генераций в день, длина до 2 минут, качество 44.1 кГц и некоммерческая лицензия.
- Creator ($12/мес): заявлены 100 генераций в день, длина до 5 минут, качество 48 кГц и коммерческая лицензия.
- Pro ($30/мес): заявлены 500 генераций в день, API-доступ и пакетная генерация до 10 треков одновременно.
Эти цены и лимиты могут меняться, поэтому перед оплатой их необходимо проверить в интерфейсе Flow Music. API в исходном описании связывается с Google Cloud Console и отдельным биллингом; ставка $0.04 за минуту аудио и документация на developers.google.com/flow-music также требуют актуальной проверки.
Авторские права и коммерческое использование
Политику Google в отношении контента, созданного в Flow Music, определяют актуальные Terms of Service. В исходных материалах упоминалась редакция от 15 июля 2026, но юридические условия могут обновляться.
- Права и разрешения на коммерческое использование могут зависеть от выбранного тарифа и условий аккаунта.
- Free описывался как некоммерческий тир: личное использование допускается, а монетизация ограничивается условиями сервиса.
- Google может оставлять за собой неисключительную лицензию на использование сгенерированного контента для улучшения модели. Возможность отказаться от этого режима нужно проверять в настройках аккаунта.
- Даже заявление о лицензионно чистых данных не является юридической защитой от любых претензий третьих лиц. Аналогичные ограничения встречаются у Suno и Udio.
Перед коммерческим использованием проверьте лицензию конкретного тарифа, сохраните актуальную редакцию Terms of Service и отдельно оцените совпадения с существующими произведениями. Процент риска, включая приведённую ранее оценку менее 0.3%, нельзя считать надёжной универсальной метрикой без открытого исследования.
Перед публикацией на Spotify, Deezer или Apple Music проверьте правила соответствующей платформы: требования к AI-контенту и маркировке могут меняться. Наличие сгенерированного трека не гарантирует автоматическое прохождение модерации.
FAQ
Доступна ли Lyria 3.5 из РФ?
В исходных материалах Россия и Беларусь указаны как недоступные регионы. Актуальный статус зависит от политики Google и конкретного аккаунта. VPN с IP-адресом другой страны не гарантирует работу сервиса и может конфликтовать с его правилами.
Можно ли использовать треки Lyria 3.5 коммерчески?
Это зависит от тарифа и действующих Terms of Service. Перед публикацией или монетизацией проверьте условия лицензии, ограничения для Free и требования площадки, на которой будет размещён трек.
Какую максимальную длину трека поддерживает Lyria 3.5?
В описаниях упоминается длина до 5 минут. Фактический лимит может зависеть от тарифа, региона и текущей версии Flow Music.
Работает ли русский язык?
Русский язык описывается как экспериментально поддерживаемый. Базовая дикция возможна, но длинные фразы и интонация могут потребовать нескольких генераций и ручной обработки.
Можно ли задать BPM и структуру?
Да, в материалах упоминается параметр tempo и структурные теги [intro], [verse], [chorus], [bridge] и [outro]. Это управляющие указания, а не гарантия точного исполнения каждой секции.
Google продолжает расширять AI-линейку: задержка Gemini 3.5 Pro и ставка на Flash-модели, ограничения Gemma в сложных задачах и обновление Google Vids с AI-аватарами показывают интерес компании к специализированным сценариям. Flow Music с Lyria 3.5 занимает в этой стратегии нишу музыкальной генерации, но оценивать её место среди Suno и Udio стоит по конкретной задаче, доступным функциям и условиям лицензии.