A Voice-Swap is beszáll az AI-hangok iparági szabványosításába
Írta: Ostroml
Új szereplővel bővült a zeneipar egyik legfontosabb adatcsere-szabványait fejlesztő közössége: a londoni Voice-Swap teljes jogú tagként csatlakozott a DDEX-hez. A vállalat szerint ezzel az első kifejezetten AI-hangtechnológiára szakosodott cég lett, amely közvetlenül részt vesz a szervezet szabványalkotási munkájában.
A DDEX olyan nemzetközi szabványokat fejleszt, amelyekkel a kiadók, zeneműkiadók, jogkezelők, digitális szolgáltatók és technológiai cégek egységes módon cserélhetnek zenei és jogkezelési adatokat. A Voice-Swap most azt szeretné elérni, hogy az AI-hangmodellekhez kapcsolódó jogosultságok ugyanilyen géppel olvasható és továbbadható formában jelenjenek meg.
A vállalat öt kiemelt területet nevezett meg: a hangmodellhez kapcsolódó személyazonosságot, a hozzájárulás és engedélyezés metaadatait, a felhasználás céljához kötött jogosultságokat, az eredet követhetőségét és a jogi jelentéseket. A gyakorlatban ez azt jelentené, hogy egy AI-hanggal készült produkció esetében egyértelműen megállapítható legyen, kinek a hangját reprezentálja a modell, melyik modellt használták, ki engedélyezte annak alkalmazását, és mire terjed ki az engedély.
Michael Pelczynski, a Voice-Swap stratégiai és társadalmi hatásokért felelős vezetője szerint erre azért van egyre nagyobb szükség, mert az AI-hang már nem pusztán kísérleti technológia. Egyre inkább bekerül a professzionális produkciós és kereskedelmi folyamatokba, miközben az ezekhez tartozó engedélyeknek a teljes digitális ellátási lánc számára értelmezhetőnek kell maradniuk.
A kulcskérdés ezzel fokozatosan elmozdul attól, hogy felismerhető-e egy tartalomról, hogy mesterséges intelligencia vett részt az elkészítésében. A Voice-Swap érvelése szerint önmagában az AI-használat feltüntetése nem bizonyítja, hogy az adott ember hangjának felhasználására valóban volt engedély, ahogy azt sem, hogy az engedély még érvényes, illetve az adott felhasználás belefér-e annak eredeti kereteibe.
Mark Isherwood, a DDEX titkárságának vezetője szerint a Voice-Swap éppen ezen a területen hozhat új nézőpontot a szabványalkotásba. A cél nem egyetlen vállalat saját rendszerének létrehozása, hanem olyan interoperábilis adatstruktúrák kidolgozása, amelyeket a zeneipar különböző szereplői ugyanúgy képesek értelmezni és továbbítani.
A csatlakozás illeszkedik a Voice-Swap 2026-os terjeszkedéséhez. A cég márciusban bekerült a Szellemi Tulajdon Világszervezetének Technical Exchange Network kezdeményezésébe, áprilisban elindította a szövegből beszédet készítő Voiceover_Studio platformot, augusztusban pedig bemutatta az instant hangklónozási funkcióját. A szolgáltatás emellett engedélyezett előadói hangmodelleket is kínál különböző kreatív felhasználásokhoz.
A DDEX-tagság azonban kevésbé magáról a hanggenerálásról, sokkal inkább az azt körülvevő infrastruktúráról szól. Ahogy az AI-hangok megjelennek zenékben, reklámokban és más kereskedelmi produkciókban, az engedélyeknek a fájlokkal és a kapcsolódó metaadatokkal együtt kell tudniuk végighaladni a digitális láncon. Egy külön szerződésben vagy elszigetelt adatbázisban tárolt hozzájárulás nagy léptékben már nehezen kezelhető.
A Voice-Swap belépése ezért egy nagyobb zeneipari problémára világít rá: az AI-val készült tartalmak megjelölése csak az első lépés. A következő feladat annak szabványos rögzítése lehet, hogy ki adott engedélyt, pontosan mire, milyen feltételekkel, és az adott felhasználás megfelel-e ezeknek a feltételeknek. Ha ez iparági szinten működő metaadattá válik, az AI-hangok jogkezelése is közelebb kerülhet a hagyományos digitális zenei infrastruktúrához.
HOZZÁSZÓLÁSOK
A hozzászóláshoz be kell jelentkezned.
LoginOLVASD EL EZEKET IS: