Влияние искусственного интеллекта на нашу повседневную жизнь продолжает расти, и Google, похоже, полон решимости позволить ему диктовать ритм того, что мы слушаем. Компания готовит новую функцию, которая позволит её ассистенту Gemini создавать музыку по текстовым командам прямо из мобильного приложения.
Этот шаг соответствует стратегии Google по превращению Gemini в креативный центр, способный генерировать изображения, текст и теперь уже аудио без использования внешних инструментов. Хотя официального объявления пока нет, технические детали программного обеспечения ясно показывают, что компания очень серьезно относится к музыке, созданной с помощью ИИ.
Новый музыкальный инструмент в Gemini
Согласно анализу приложения Gemini для Android , одна из его последних версий содержит прямые ссылки на внутреннюю утилиту, связанную с созданием звука. Среди строк кода упоминается инструмент, обозначенный как MUSIC_GENERATION_AS_TOOL , что предполагает наличие функции, специально предназначенной для генерации музыки с использованием искусственного интеллекта, интегрированного в самого голосового помощника.
Это открытие было сделано в результате дизассемблирования APK-файла Gemini версии 17.2.51.sa.arm64 на Android , где эта новая возможность была обнаружена на этапе подготовки. Тот факт, что функция уже присутствует в коде, хотя и скрыта от пользователей, указывает на то, что разработка находится на относительно продвинутой стадии, хотя она еще не готова к общему использованию.
Между тем, появились признаки того, что Gemini добавит специальную категорию музыки в раздел «Мои материалы» . Эта область, предназначенная для группировки всего, что создано с помощью ИИ — например, текста или изображений — также будет включать музыкальные треки, что упростит сохранение, организацию и воспроизведение звуковых произведений, не выходя из приложения.
До сих пор музыкальные эксперименты Google ограничивались в основном определенными областями, такими как некоторые функции приложения «Рекордер» на телефоне Pixel или проекты по созданию видео, например, Veo. Теперь же создание аудио станет встроенной функцией Gemini , наравне с написанием текста или созданием изображений с использованием модели, известной внутри компании как Nano Banana.
Роль Lyria и предыдущий опыт Google в области музыки на основе искусственного интеллекта.
Google не начинает с нуля в этой области. У компании уже есть Lyria, модель искусственного интеллекта, специализирующаяся на музыке , которая доступна через API Gemini и использовалась в различных экспериментах. Lyria предназначена для создания инструментальных композиций и отслеживания развития музыки в реальном времени , что хорошо согласуется с будущей творческой функцией для конечных пользователей.
По утечкам информации, эта новая функция Gemini будет работать на базе Lyria , внедряя в приложение для Android технологию, которая до сих пор была доступна только разработчикам или в закрытом режиме тестирования. Это позволит любому пользователю, не имеющему знаний в области создания музыки, генерировать песни, мелодии или фоновые звуки с помощью простого описания на естественном языке.
В экосистеме Google Lyria уже используется в сочетании с другими инструментами, такими как Veo, модель генерации видео , для создания звуковых дорожек, адаптированных к клипам, сгенерированным ИИ. Благодаря интеграции в Gemini, эта возможность будет доступна одним щелчком мыши на мобильных устройствах, без необходимости доступа к отдельным платформам или техническим API.
Ключевым моментом этого подхода является доступность : хотя для полноценного использования API Gemini требуются определенные знания и ресурсы, встроенная функция с пошаговым интерфейсом и простыми текстовыми командами делает создание музыки доступным для гораздо более широкой аудитории . От создателей контента в социальных сетях до пользователей, которым просто нужна композиция для практики или учебы, потенциальный спектр применения значителен.

Как может работать процесс создания музыки в созвездии Близнецов?
Хотя окончательный интерфейс еще не представлен, найденные отсылки и принцип работы других функций Gemini позволяют нам представить довольно понятную схему. Скорее всего, пользователю придется вводить запрос с описанием желаемого типа музыки , аналогично тому, как запрашиваются изображения: например, «мягкая электронная композиция для концентрации», «эпический саундтрек для трейлера» или «рок-песня в стиле 80-х для тренировки».
Исходя из этого описания, Gemini объединит свои возможности понимания языка с базовой музыкальной моделью, генерируя аудиокомпозиции, адаптированные к запрошенному стилю, интенсивности или продолжительности . Цель Google состоит в том, чтобы предложить такой же простой в использовании интерфейс, как и генерация изображений, не требующий технических знаний в области микширования, инструментов или теории музыки.
Обнаруженные текстовые строки указывают на возможные ограничения в использовании в зависимости от типа учетной записи . Возможно, создание музыки изначально будет доступно только платным пользователям , например, подписчикам расширенных тарифных планов Gemini или премиум-сервисов Google AI, хотя компания это пока не подтвердила.
Также весьма вероятно, что будут применяться фильтры для предотвращения прямого копирования защищенных авторским правом песен или голосов конкретных исполнителей . Музыкальная индустрия в Европе и остальном мире особенно чувствительна к несанкционированному клонированию стилей и тембров, и как правила ЕС, так и давление со стороны отрасли вынуждают крупных поставщиков ИИ действовать с осторожностью.
Если Google удастся упростить систему, соблюдая при этом эти ограничения, Gemini может стать распространенным инструментом для создателей мобильного контента , от ютуберов и тиктокеров до небольших подкаст-проектов или корпоративных видеороликов, которым нужна быстрая и легально используемая фоновая музыка.
Доступность, статус разработки и вопросы, требующие решения.
Одно из главных нововведений этой инициативы заключается в том, что Google впервые сделает создание музыки доступным для любого пользователя приложения Gemini , без необходимости использования специального оборудования, такого как новейшие телефоны Pixel или экспериментальные платформы. Музыка станет еще одним элементом мультимедийного предложения ассистента, наряду с текстом и изображениями.
Однако следы в APK-файле ясно показывают, что эта функция всё ещё находится в разработке . На данный момент точный способ её отображения в интерфейсе неизвестен, как и количество параметров настройки (длительность трека, инструменты, изменение темпа, звуковые слои и т. д.).
На данный момент официальная дата релиза также неизвестна . Утечки, подобные той, что опубликовал Android Authority, предполагают, что анонс может состояться в ближайшие несколько недель или месяцев, но это во многом зависит от внутреннего тестирования и решения Google деликатных технических и юридических вопросов, связанных с музыкой, генерируемой искусственным интеллектом.
Ещё один важный вопрос заключается в том, будет ли эта функция внедряться одновременно на всех рынках или же приоритет будет отдан конкретным регионам, таким как США или Европейский союз . В случае Европы, недавние правила регулирования ИИ и интеллектуальной собственности могут повлиять как на сроки, так и на доступные в каждой стране функции.
Наконец, до сих пор неясно, будет ли инструмент предлагаться с ограниченным бесплатным режимом и расширенными платными опциями , или же он будет напрямую связан с подписками, такими как Gemini Advanced или Google One с ИИ. Эти решения могут сыграть ключевую роль в определении того, станет ли создание музыки с помощью ИИ доступным для широкой публики или останется в руках небольшого сегмента активных пользователей.

Конкуренция в этом секторе и потенциальное влияние на пользователей в Европе и Испании.
Решение ускорить разработку этой функции принято на фоне жесткой конкуренции между ведущими моделями ИИ . Пока Google работает над расширением творческих возможностей Gemini, OpenAI готовит новые функции для ChatGPT, которые также охватывают такие области, как обработка файлов, программирование и генерация мультимедийного контента.
Для пользователей в Европе и Испании интеграция музыки, созданной с помощью ИИ, в Gemini может стать прямой альтернативой сторонним сервисам , уже позволяющим создавать собственные треки, с преимуществом интеграции в собственную экосистему Google. Возможность сохранять созданные треки в разделе «Мои материалы», синхронизировать их с учетной записью и получать к ним доступ с разных устройств упростит их повторное использование в личных или профессиональных проектах.
В то же время, внедрение в Европе будет зависеть от соблюдения правил ЕС , в частности, в отношении прозрачности данных для обучения, уважения авторских прав и защиты прав художников и правообладателей. Ожидается, что Google придется предоставить четкую информацию о том, как создаются эти треки и какие ограничения применяются к их использованию.
Если компания найдет правильный баланс между инновациями и правовыми гарантиями, не будет ничего удивительного в том, что вскоре испаноязычные создатели контента начнут использовать музыку, сгенерированную Gemini, в подкастах, коротких видеороликах или образовательных материалах, подобно тому, как инструменты искусственного интеллекта уже используются сегодня для создания субтитров, озвучивания или редактирования изображений.
В конечном итоге складывается ситуация, когда создание музыки перестанет быть исключительной прерогативой тех, кто владеет инструментами или программным обеспечением для продюсирования , и станет доступной непосредственно с мобильных устройств. Gemini со своим грядущим инструментом для генерации музыки стремится стать еще одним элементом этих изменений, при условии, что Google сможет органично интегрировать его в свое приложение, сделать его понятным для обычного пользователя и адаптировать к правилам игры, установленным музыкальной индустрией и европейскими нормами.

