La presència de la intel·ligència artificial en el dia a dia no deixa de créixer, i Google sembla decidida que també marqui el ritme del que escoltem. La companyia està preparant una nova funció amb què el seu assistent Gemini podrà compondre música a partir d'indicacions de text, directament des de l'app per a mòbils.
Aquest moviment encaixa amb l'estratègia de Google de convertir Gemini en un centre creatiu capaç de generar imatges, text i ara àudio sense necessitat de ferramentes externes. Tot i que de moment no hi ha anunci oficial, les pistes tècniques trobades al programari deixen força clar que l'empresa va molt seriosament amb la música generada per IA.
Una nova eina musical dins de Gemini
Segons l'anàlisi de la aplicació de Gemini per Android, en una de les seves darreres versions s'han localitzat referències directes a una utilitat interna vinculada a la creació sonora. Entre les línies de codi apareix esmentada una eina identificada com MUSIC_GENERATION_AS_TOOL, el que apunta a una funció dedicada específicament a la generació de música mitjançant IA integrada al propi assistent.
Aquesta troballa procedeix de l'especejament de l'APK de la versió 17.2.51.sa.arm64 de Gemini a Android, on s'ha detectat aquesta nova capacitat en fase de preparació. Que la funció figuri ja al codi, encara que oculta els usuaris, indica que el desenvolupament està relativament avançat, si bé encara no està llesta per activar-se de forma general.
En paral·lel, s'han trobat senyals que Gemini n'incorporarà una categoria específica de música a la secció “My Stuff” (Les meves coses). Aquesta àrea, pensada per agrupar tot allò que genera la IA —com textos o imatges—, passaria així a incloure també les pistes musicals, facilitant guardar, organitzar i reproduir les creacions sonores sense sortir de lapp.
Fins ara, l'experimentació musical de Google s'havia deixat veure sobretot en contextos més limitats, com algunes funcions de la app de Gravadora dels mòbils Pixel o en projectes vinculats a la generació de vídeo amb Veo. La diferència ara és que la creació dàudio es convertiria en una capacitat nativa més dins de Gemini, al mateix nivell que la redacció de textos o la generació d'imatges amb el model conegut internament com a Nano Banana.
El paper de Lyria i l'experiència prèvia de Google en música per IA
Google no parteix de zero en aquest terreny. La companyia ja compta amb Lyria, un model d'IA especialitzat en música que està disponible a través de l'API de Gemini i que s'ha fet servir en diferents experiments. Lyria està pensat per compondre peces instrumentals i controlar l'evolució de la música en temps real, el que encaixa bé amb una futura funció creativa per a usuaris finals.
Les filtracions apunten que aquesta nova característica de Gemini estaria impulsada precisament per Lyria, portant a l'app per a Android una tecnologia que, fins ara, es movia més en entorns de desenvolupadors o proves tancades. Això obriria la porta que qualsevol persona, sense coneixements de producció musical, pogués generar cançons, melodies o fons sonors amb una simple descripció en llenguatge natural.
Dins l'ecosistema de Google, Lyria ja s'ha utilitzat en combinació amb altres eines com ara Veig, el model de generació de vídeo, per crear bandes sonores adaptades a clips generats per IA. Amb la integració a Gemini, aquesta capacitat passaria a estar a un clic de distància al mòbil, sense necessitat d'accedir a plataformes separades o API tècniques.
La clau daquest enfocament és la accessibilitat: mentre que l'API de Gemini exigeix certs coneixements i recursos per treure'n partit, una funció integrada a l'app, amb una interfície guiada i ordres de text senzills, deixa la creació musical a l'abast d'un públic molt més ampli. Des creadors de contingut a xarxes socials fins i tot usuaris que simplement vulguin una pista per entrenar o estudiar, el ventall dús potencial és considerable.

Com podria funcionar la generació de música a Gemini
Tot i que encara no s'ha revelat la interfície definitiva, les referències trobades i la manera de treballar d'altres funcions de Gemini permeten imaginar un esquema força clar. El més probable és que lusuari hagi de escriure un prompt descrivint el tipus de música que vol obtenir, de manera similar a com es demanen imatges: per exemple, “tema electrònic suau per concentrar-se”, “banda sonora èpica per a un tràiler” o “cançó de rock amb aire vuitanta per entrenar”.
A partir d'aquesta descripció, Gemini combinaria les capacitats de comprensió del llenguatge amb el model musical subjacent, generant peces d'àudio adaptades a l'estil, la intensitat o la durada sol·licitada. La intenció de Google seria oferir una experiència tan directa com la de la generació d'imatges, en què no calen coneixements tècnics de mescla, instruments o teoria musical.
A les cadenes de text descobertes es deixa entreveure que podrien existir restriccions d'ús segons el tipus de compte. No es descarta que la creació de música quedi inicialment limitada a usuaris de pagament, com els que estiguin subscrits a plans avançats de Gemini oa serveis premium de Google AI, encara que això no està confirmat per la companyia.
També és molt probable que s'apliquin filtres per evitar la imitació directa de cançons protegides o veus d'artistes concrets. El sector musical a Europa ia la resta del món és especialment sensible amb la clonació d'estils i timbres sense permís, i tant la normativa comunitària com la pressió de la indústria obliguen els grans proveïdors d'IA a moure's amb cautela.
Si Google aconsegueix que el sistema resulti senzill i, alhora, respecti aquestes limitacions, Gemini podria convertir-se en una eina habitual per als que creen contingut des del mòbil, des de youtubers i tiktokers fins a petits projectes de podcast o vídeos corporatius que necessiten música de fons ràpida i legalment utilitzable.
Accessibilitat, estat del desenvolupament i dubtes per resoldre
Una de les grans novetats d'aquesta iniciativa és que, per primer cop, Google situaria la generació musical a l'abast de qualsevol usuari de la seva app Gemini, sense dependre de maquinari específic com els Pixel més recents ni de plataformes experimentals. La música passaria a ser una altra peça més a la proposta multimèdia de l'assistent, juntament amb text i imatge.
Tot i això, els rastres a l'APK deixen clar que la funció segueix en fase de desenvolupament. Per ara no es coneix la forma exacta en què es mostrarà a la interfície, ni quantes opcions de personalització inclourà (durada de la pista, instruments, canvis de ritme, capes de so, etc.).
Tampoc no n'hi ha de moment data oficial de llançament. Filtracions com la publicada per Android Authority apunten que l'anunci podria arribar les properes setmanes o mesos, però això depèn en gran mesura de les proves internes i que Google resolgui aspectes tècnics i legals delicats al voltant de la música generada per IA.
Una altra incògnita important és si la funció es desplegarà alhora a tots els mercats o si es prioritzaran regions concretes com els Estats Units o la Unió Europea. En el cas europeu, la normativa recent sobre IA i les regles de propietat intel·lectual podrien influir tant en el calendari com en les característiques disponibles a cada país.
Finalment, encara no és clar si l'eina s'oferirà amb un mode gratuït limitat i opcions avançades de pagament, o si quedarà directament associada a subscripcions com Gemini Advanced o Google One amb IA. Aquestes decisions poden resultar clau perquè la creació musical per IA arribi al gran públic o quedi en mans d'un segment més reduït d'usuaris intensius.

Competència al sector i possible impacte en usuaris d'Europa i Espanya
La decisió d'accelerar el desenvolupament d'aquesta característica arriba en un context de competència molt intensa entre grans models d'IA. Mentre Google treballa per ampliar l'abast creatiu de Gemini, OpenAI prepara noves funcions per a ChatGPT que també toquen àmbits com el treball amb fitxers, la programació o la generació de contingut multimèdia.
Per a usuaris d'Europa i d'Espanya, la integració de música per IA a Gemini podria suposar una alternativa directa a serveis de tercers que ja permeten crear pistes personalitzades, amb l'avantatge d'estar integrats al mateix ecosistema de Google. La possibilitat de guardar creacions a My Stuff, sincronitzar-les amb el compte i accedir des de diferents dispositius les faria més fàcils de reutilitzar en projectes personals o professionals.
Alhora, el desplegament en territori europeu estarà condicionat pel compliment del marc regulador comunitari, especialment pel que fa a transparència en les dades d'entrenament, respecte als drets d'autor i garanties per a artistes i titulars d'obres. És previsible que Google hagi d'oferir informació clara sobre com es generen aquestes pistes i quins límits s'apliquen al vostre ús.
Si la companyia encerta amb l'equilibri entre innovació i garanties legals, no seria estrany que aviat vegem a creadors de contingut en espanyol incorporant música generada per Gemini a podcast, vídeos curts o material educatiu, de la mateixa manera que avui ja s'utilitzen eines de IA per subtitular, locutar o editar imatges.
El que es perfila, en definitiva, és un escenari on la creació musical deixarà de ser terreny exclusiu dels que dominen instruments o programari de producció, per esdevenir una opció accessible des del propi mòbil. Gemini, amb la seva futura eina de generació de música, apunta a ser una peça més d'aquest canvi, sempre que Google aconsegueixi encaixar-la bé a la seva app, fer-la comprensible per a l'usuari mitjà i ajustar-la a les regles de joc que marquen la indústria musical i les lleis europees.

