Google membawa Lyria 3.5 ke dalam aplikasi Gemini dan Gemini API pada 4 September. Bagi pengguna biasa, ini merupakan kemas kini yang sangat intuitif: nyatakan gaya muzik yang diinginkan, pilih sama ada dengan vokal atau muzik tanpa vokal, kemudian tentukan sama ada ingin mencipta muzik pendek atau komposisi panjang yang lebih lengkap, dan sistem akan menghasilkan hasil akhir. Bagi pembangun dan pencipta, perubahan ini lebih spesifik—model yang sama kini juga telah dimasukkan ke dalam Google AI Studio, Google Vids, dan Flow Music, bermakna muzik AI bukan lagi sekadar fungsi percubaan di dalam laman web, tetapi semakin menyatu dengan alur kerja sedia ada seperti penghasilan video, kandungan jenama, dan pembangunan aplikasi.
Yang paling menarik dalam pengumuman ini bukanlah “lagi-lagi ada model muzik baru”, tetapi Google mula menjadikan penghasilan muzik sebagai kemampuan produk yang boleh diserahkan. Pihak rasmi merangkumkan peningkatan utama sebagai suara yang lebih ekspresif, aransemen yang lebih kaya, dan kualiti bunyi yang lebih tinggi, disertai pilihan gaya dan templat. Sebelum ini, banyak alat penghasilan muzik mampu menghasilkan melodi dengan cepat, tetapi sering menunjukkan tanda mesin dalam struktur lengkap, kualiti suara, dan perkembangan bahagian. Lyria 3.5 jelas menargetkan “satu kilometer terakhir”: membolehkan pengguna mengurangkan percubaan prompt dan mendapatkan bahan yang boleh digunakan terus dalam video, loceng, atau kandungan jenama.
Dari mainan inspirasi ke alat penghasil kandungan
Penghasilan muzik benar-benar memasuki alur kerja bukan melalui satu kali kesan menakjubkan, tetapi melalui kestabilan, kawalan, dan penghematan masa. Pasukan video pendek memerlukan peralihan antara pelbagai versi panjang, pelanggan jenama prihatin sama ada gaya adalah konsisten, dan pembangun pula prihatin sama ada antaramuka stabil dan boleh disematkan ke dalam produk. Lyria 3.5 menyediakan aplikasi dan API Gemini, yang secara tepat menangani kedua-dua penciptaan peribadi dan penghasilan berskala besar. Pengguna peribadi boleh bermula dengan pantas menggunakan templat, manakala pembangun boleh menyambungkan kemampuan ini ke dalam produk suntingan, pemasaran, atau hiburan interaktif mereka sendiri.
Google juga menyenaraikan "lagu pendek atau lebih panjang" sebagai kemampuan yang berasingan. Ini kelihatan biasa, tetapi sebenarnya menyentuh salah satu bahagian paling sukar dalam penghasilan muzik: apabila panjang lagu bertambah, model tidak hanya perlu mengekalkan timbre, tetapi juga mengendalikan bait, refren, jambatan, dan perubahan suasana, sambil mengelakkan perulangan mekanikal. Pengumuman tersebut tidak mengungkapkan panjang maksimum seragam, perbezaan wilayah, atau semua parameter teknikal, oleh itu pernyataan yang lebih tepat ialah pengguna mendapat pilihan panjang yang lebih fleksibel, bukan kemampuan untuk menghasilkan album penuh tanpa had.
Berbanding dengan penghasilan teks dan gambar, muzik mempunyai satu lagi batasan penggunaan. Adakah melodi tersebut terlalu serupa dengan karya sedia ada, adakah suara manusia boleh menipu pendengar supaya menganggapnya sebagai penyanyi sebenar, dan adakah projek komersial boleh digunakan mengikut syarat platform yang berkenaan—semua ini adalah soal yang perlu diuruskan sendiri oleh pencipta. Pengumuman terkini Google berfokus pada kemampuan produk dan tidak “menyelesaikan” semua isu kompleks ini sekaligus. Oleh itu, pasukan masih perlu mengekalkan rekod petunjuk, versi yang dihasilkan, dan pengubahsuaian manual sebelum penghantaran rasmi, serta semak semula melodi, lirik, dan keserupaan suara yang berisiko tinggi.
Bagi industri kandungan, produk semacam ini mungkin pertama kali mengubah keperluan harian yang sebelumnya tidak mampu membeli muzik tersuai, bukan kreativiti artis terkemuka. Tajuk podcast, video kedai, latar belakang kursus, halaman aktiviti permainan, dan iklan media sosial memerlukan muzik dalam jumlah besar, dengan tempoh masa ketat, dan bajet terhad. Dahulunya, mereka sering bergantung pada perpustakaan muzik generik; kini, pencipta boleh menghasilkan versi yang lebih sesuai berdasarkan gambar dan ritma tertentu. Nilainya tidak semestinya datang dari “lebih baik daripada komposer profesional”, tetapi dari memberikan setiap kandungan suara yang lebih hampir kepada tersuai.
Pertarungan sebenar berada dalam pengagihan dan pentadbiran hak cipta
Lebih penting bahawa Lyria 3.5 dimasukkan ke dalam Gemini, bukan hanya dikekalkan sebagai produk laboratorium berasingan. Gemini mempunyai akses pengguna yang sedia ada, sambungan Google Vids untuk video pejabat, perkhidmatan AI Studio untuk pembangun, dan Flow Music yang ditujukan kepada pencipta yang lebih profesional. Kemampuan model ini disebarkan melalui saluran-saluran ini, membolehkan pengguna memanggil penghasilan muzik dalam tugas asal mereka tanpa perlu memahami nama model terlebih dahulu. Persaingan dalam produk AI oleh itu berpindah dari “siapa contoh yang paling menarik” kepada “siapa yang boleh menghantar paling pantas dalam konteks yang tepat”.
Namun, semakin luas penyebarannya, semakin besar tekanan tata kelola. Muzik adalah jenis kandungan yang mempunyai hubungan kuasa yang sangat kompleks, di mana lirik, muzik, rakaman, imej suara, dan gaya pentas mungkin mewakili hak yang berbeza. Pengguna perniagaan tidak boleh mengekalkan “platform membenarkan penghasilan” sebagai “boleh digunakan untuk sebarang tujuan komersial”. Pendekatan yang selamat ialah membaca syarat perkhidmatan yang berkaitan dengan kawasan dan akaun semasa, kemudian menjalankan semakan manual terhadap output akhir; apabila melibatkan artis terkenal, lagu sedia ada, atau jenama pelanggan, perlu menggunakan piawaian dalaman yang lebih ketat.
Dari perspektif industri, Lyria 3.5 membawa kemampuan muzik kepada pengguna dan pembangun Gemini di seluruh dunia, yang akan meningkatkan bekalan muzik generatif, tetapi tidak bermakna nilai muzik tradisional menjadi sama rata. Sebaliknya, apabila muzik asas menjadi murah, karya yang benar-benar berbeza, ekspresi watak yang boleh dipercayai, dan rantai lesen yang jelas mungkin menjadi lebih berharga. Model sesuai untuk tugas draf, varian, dan muzik berisiko rendah, manakala manusia lebih sesuai untuk menentukan mengapa karya itu wujud, apa yang perlu diungkapkan, dan kapan harus menghentikan penghasilan.
Oleh itu, pembaharuan ini boleh dilihat sebagai langkah Google untuk memperkenalkan produk media generatif: model sudah tidak lagi puas dengan demonstrasi teknikal selama beberapa saat, tetapi mulai mengambil tugas konten yang boleh dipasang, boleh digunakan semula, dan boleh diserahkan. Samada ia akan menjadi alat biasa untuk pencipta bergantung pada konsistensi, kos, mekanisme semakan, dan maklum balas pengguna dalam projek sebenar. Pihak rasmi mengesahkan bahawa Lyria 3.5 telah memasuki produk dan antaramuka berkaitan; yang akan diterima pasaran akhirnya ialah berapa banyak masa yang dijimatkan dan berapa banyak kerja semula yang dikurangkan dalam alur kerja sebenar.
