Přítomnost umělá inteligence v každodenním životě Neustále roste a zdá se, že Google je odhodlán nechat ho diktovat rytmus toho, co posloucháme. Společnost připravuje novou funkci, která umožní jeho asistentovi Gemini skládat hudbu podle textových pokynůpřímo z mobilní aplikace.
Tento krok je v souladu se strategií společnosti Google, jejímž cílem je proměnit Gemini v… kreativní centrum schopné generovat obrázky, text a nyní i zvuk bez nutnosti externích nástrojů. Ačkoli zatím neexistuje žádné oficiální oznámení, technické indicie nalezené v softwaru jasně ukazují, že společnost to s hudbou generovanou umělou inteligencí myslí velmi vážně.
Nový hudební nástroj v Gemini
Podle analýzy Aplikace Gemini pro AndroidV jedné z jeho nejnovějších verzí byly nalezeny přímé odkazy na interní utilitu související s tvorbou zvuku. Mezi řádky kódu je zmíněn nástroj označený jako [název nástroje chybí]. GENERACE_HUDBY_JAKO_NÁSTROJcož ukazuje na funkci speciálně určenou pro Generování hudby s umělou inteligencí integrovaný do samotného asistenta.
Toto zjištění pochází z demontáže APK verze Gemini 17.2.51.sa.arm64 na Androidukde byla tato nová schopnost detekována ve fázi přípravy. Skutečnost, že funkce je již v kódu přítomna, i když je před uživateli skryta, naznačuje, že vývoj je relativně pokročilý, ačkoli ještě není připraven k obecné aktivaci.
Souběžně se objevily známky toho, že Blíženci budou zahrnovat konkrétní hudební kategorii v sekci „Moje věci“Tato oblast, navržená pro seskupení všeho, co generuje umělá inteligence – například textu nebo obrázků – by tedy zahrnovala i hudební stopy, což by usnadnilo… ukládat, organizovat a přehrávat zvukové výtvory aniž byste opustili aplikaci.
Hudební experimenty společnosti Google byly doposud pozorovány hlavně v omezenějších kontextech, jako například u některých funkcí Aplikace pro mobilní nahrávání Pixel nebo v projektech souvisejících s generováním videa s Veo. Rozdíl je nyní v tom, že tvorba zvuku by se stala více přirozených schopností v rámci Gemini, na stejné úrovni jako psaní textů nebo generování obrázků s modelem interně známým jako Nano Banana.
Lyriina role a předchozí zkušenosti společnosti Google s hudbou poháněnou umělou inteligencí
Google v této oblasti nezačíná od nuly. Společnost už to má za sebou. Lyria, model umělé inteligence specializující se na hudbu který je k dispozici prostřednictvím rozhraní Gemini API a byl použit v různých experimentech. Lyria je navržena tak, aby skládat instrumentální skladby a ovládat vývoj hudby v reálném časecož se dobře hodí k budoucí kreativní funkci pro koncové uživatele.
Úniky naznačují, že tato nová funkce Gemini by měla být poháněno přesně LyriíTo přináší do aplikace pro Android technologii, která byla doposud většinou omezena na vývojářské prostředí nebo uzavřené testování. To by otevřelo dveře komukoli bez znalostí hudební produkce k vytváření... písně, melodie nebo zvuky na pozadí s jednoduchým popisem v přirozeném jazyce.
V ekosystému Google se Lyria již používá v kombinaci s dalšími nástroji, jako například Vidím model generování videavytvářet soundtracky přizpůsobené klipům generovaným umělou inteligencí. Díky integraci do Gemini by tato funkce byla na mobilních zařízeních k dispozici jen na jedno kliknutí, bez nutnosti přístupu k samostatným platformám nebo technickým API.
Klíčem k tomuto přístupu je přístupnostI když Gemini API vyžaduje určité znalosti a zdroje k jeho využití, funkce v aplikaci s řízeným rozhraním a jednoduchými textovými příkazy ponechává hudební tvorba je přístupná mnohem širšímu publiku. Od tvůrci obsahu na sociálních sítích Od uživatelů, kteří chtějí dráhu pouze k tréninku nebo studiu, je škála potenciálních využití značná.

Jak by mohla fungovat generování hudby v Gemini?
Ačkoli finální rozhraní ještě nebylo odhaleno, nalezené reference a způsob fungování dalších funkcí Gemini nám umožňují představit si poměrně jasné schéma. Uživatel bude s největší pravděpodobností muset Napište námět popisující žánr hudby které chcete získat, podobným způsobem, jako se požadují obrázky: například „jemné elektronické téma k zamyšlení“, „epický soundtrack k traileru“ nebo „rocková píseň ve stylu osmdesátých let k cvičení“.
Na základě tohoto popisu by Gemini zkombinoval své schopnosti porozumění jazyku se základním hudebním modelem a vytvořil tak zvukové skladby přizpůsobené požadovanému stylu, intenzitě nebo délce trváníZáměrem Googlu by bylo nabídnout zážitek stejně přímočarý jako generování obrázků, který by nevyžadoval žádné technické znalosti mixování, nástrojů ani hudební teorie.
Objevené textové řetězce naznačují, že by mohly existovat Omezení použití na základě typu účtuJe možné, že tvorba hudby bude zpočátku omezena na platících uživatelů, například ti, kteří mají předplacené pokročilé tarify Gemini nebo prémiové služby Google AI, ačkoli to společnost nepotvrdila.
Je také velmi pravděpodobné, že budou uplatněny Filtry, které zabraňují přímému napodobování skladeb chráněných autorskými právy nebo hlasů konkrétních interpretůHudební průmysl v Evropě a zbytku světa je obzvláště citlivý na klonování stylů a barev bez povolení a jak regulace EU, tak tlak v tomto odvětví nutí hlavní poskytovatele umělé inteligence k opatrnosti.
Pokud se Googlu podaří systém zjednodušit a zároveň respektovat tato omezení, mohl by se Gemini stát… Běžný nástroj pro ty, kteří vytvářejí obsah ze svého mobilního zařízení.Od youtuberů a tiktokerů až po malé podcastové projekty nebo firemní videa, která potřebují rychlou a legálně použitelnou hudbu na pozadí.
Přístupnost, stav vývoje a otázky k vyřešení
Jednou z hlavních novinek této iniciativy je, že Google poprvé umístí Tvorba hudby na dosah každého uživatele aplikace Geminibez spoléhání se na specifický hardware, jako jsou nejnovější telefony Pixel nebo experimentální platformy. Hudba by se stala dalším prvkem multimediální nabídky asistenta, vedle textu a obrázků.
Stopy v APK však jasně ukazují, že Funkce je stále ve vývojiProzatím není známo, jak přesně se bude v rozhraní zobrazovat, ani kolik možností přizpůsobení bude obsahovat (délka skladby, nástroje, změny tempa, zvukové vrstvy atd.).
Momentálně také žádný není. oficiální datum vydáníÚniky informací, jako je ten zveřejněný organizací Android Authority, naznačují, že oznámení by mohlo přijít v příštích několika týdnech nebo měsících, ale to do značné míry závisí na interním testování a řešení citlivých technických a právních otázek týkajících se hudby generované umělou inteligencí ze strany Googlu.
Další důležitou otázkou je, zda bude funkce zavedena současně na všech trzích, nebo zda bude upřednostňována. konkrétní regiony, jako jsou Spojené státy nebo Evropská unieV evropském případě by nedávná nařízení týkající se umělé inteligence a duševního vlastnictví mohla ovlivnit jak časový harmonogram, tak i funkce dostupné v jednotlivých zemích.
A konečně, stále není jasné, zda bude nástroj nabízen s Omezený bezplatný režim a pokročilé placené možnostinebo zda bude přímo propojena s předplatným, jako je Gemini Advanced nebo Google One s umělou inteligencí. Tato rozhodnutí by mohla být klíčová pro určení, zda se tvorba hudby s využitím umělé inteligence dostane k široké veřejnosti, nebo zůstane v rukou menšího segmentu intenzivních uživatelů.

Konkurence v odvětví a potenciální dopad na uživatele v Evropě a Španělsku
Rozhodnutí urychlit vývoj této funkce přichází v kontextu intenzivní konkurence mezi hlavními modely umělé inteligenceZatímco Google pracuje na rozšíření kreativního záběru Gemini, OpenAI připravuje pro ChatGPT nové funkce, které se dotýkají i oblastí, jako je práce se soubory, programování a generování multimediálního obsahu.
Pro uživatele v Evropě a Španělsku by integrace hudby s umělou inteligencí do Gemini mohla představovat přímá alternativa ke službám třetích stran Tyto nástroje již umožňují vytvářet vlastní skladby s další výhodou integrace do ekosystému Google. Možnost ukládat výtvory do složky „Moje věci“, synchronizovat je s účtem a přistupovat k nim z různých zařízení by usnadnila jejich opětovné použití v osobních nebo profesionálních projektech.
Zároveň bude nasazení na evropském území podmíněno dodržování regulačního rámce Společenstvízejména pokud jde o transparentnost tréninkových dat, dodržování autorských práv a záruky pro umělce a držitele autorských práv. Očekává se, že Google bude muset poskytnout jasné informace o tom, jak jsou tyto stopy generovány a jaká omezení se na jejich použití vztahují.
Pokud se společnosti podaří najít správnou rovnováhu mezi inovací a právními zárukami, nebylo by překvapením, kdyby se brzy objevila. Tvůrci obsahu hovořícího španělsky začlenění hudby generované Gemini do podcastů, krátkých videí nebo vzdělávacích materiálů, stejným způsobem, jakým se nástroje umělé inteligence již dnes používají k titulkování, vyprávění nebo úpravě obrázků.
Nakonec se objevuje scénář, ve kterém Hudební tvorba už nebude výhradní doménou těch, kteří ovládají hudební nástroje nebo produkční softwarestát se dostupnou možností přímo z vašeho mobilního telefonu. Gemini se svým připravovaným nástrojem pro generování hudby si klade za cíl být dalším prvkem této změny, za předpokladu, že se Googlu podaří jej bezproblémově integrovat do své aplikace, učinit jej srozumitelným pro běžného uživatele a přizpůsobit ho pravidlům hry stanoveným hudebním průmyslem a evropskými zákony.

