AI-сервіс для генерації музики Suno запустив функцію Speech, яка створює мовленнєві доріжки на основі сценарію або текстового опису. Новинка доступна у публічній бета-версії на вебплатформі та в мобільних застосунках Suno. Ключова особливість — можливість одночасно генерувати озвучку та фоновий музичний супровід в одному аудіотреку, без потреби зводити їх вручну в сторонніх редакторах.
За словами chief product officer Suno Джека Броуді, компанія розширює свою візію за межі музики. «Музика завжди буде в основі Suno і того, що ми створюємо. Водночас наше бачення завжди охоплювало й інші форми людського самовираження», — заявив він під час анонсу. За його словами, Speech — це перша аудіомодель, яка генерує голос і музику разом.
За даними джерел, функція орієнтована насамперед на такі формати, як поезія, медитації та казки на ніч. Тобто йдеться не про створення повноцінних подкастів чи рекламних роликів у промислових масштабах, а радше про нішеві аудіоформати, де потрібен заспокійливий голос із ненав'язливим музичним тлом. Водночас компанія не розкриває, на яких даних навчала модель Speech і як саме забезпечує якість та безпеку генерації.
Для українського ринку ця новина має кілька практичних вимірів. По-перше, локальні продакшн-студії, агенції та незалежні креатори отримують ще один інструмент для швидкого створення аудіоконтенту — від озвучки промо-роликів до атмосферних вставок у відео. По-друге, це підсилює конкуренцію на ринку AI-аудіо, де вже присутні як глобальні гравці, так і локальні команди, що працюють з українською мовою. По-третє, постає питання якості генерації саме українською: Suno поки не повідомляла про підтримку конкретних мов, а від цього залежить, чи зможуть українські команди використовувати Speech у реальних проєктах, а не лише в експериментах.
Варто зазначити, що Suno вже давно викликає дискусії щодо авторських прав та етики навчання AI-моделей на музичних творах. Розширення в бік мовлення додає ще один шар складності: синтезований голос може імітувати стиль, інтонації та подачу, що в перспективі ускладнює верифікацію аудіо. Для українських медіа та брендів це означає потребу в чіткій політиці маркування AI-згенерованого аудіо, особливо в рекламі та новинах.
Поки що Speech перебуває в бета-режимі, тож компанії варто тестувати її обережно: перевіряти якість вимови, відповідність тону бренду та юридичну чистоту використання. Але навіть на цьому етапі очевидно, що інструменти на кшталт Suno Speech поступово розмивають межу між музикою, озвучкою та контентом, який раніше вимагав окремої команди звукорежисерів і дикторів.