
A Twitch alapértelmezetté tette, hogy az Amazon generatív mesterségesintelligencia-modelljeinek fejlesztéséhez felhasználható legyen a streamerek csatornatartalma. A felhasználók ugyan letilthatják ezt a lehetőséget, a hozzá szükséges beállítás azonban nem a készítői irányítópulton, hanem a fiók adatvédelmi menüjében található.
A döntés azért is fontos, mert a Twitch tartalmai nem csak a videókat jelentik. A platform szabályai szerint a közvetítések, korábbi adások, klipek, chatek, valamint a csatornán megjelenő képek és szövegek is felhasználhatók a jövőbeli generatív AI-modellek fejlesztéséhez.
A generatív mesterséges intelligencia olyan modellek összefoglaló neve, amelyek új szöveget, hangot, képet vagy videót képesek létrehozni. Ehhez hatalmas mennyiségű és sokféle adatra van szükség, a Twitch pedig ebből rengeteget biztosít.
A streamerek gyakran órákon keresztül beszélnek, játszanak, reagálnak különböző helyzetekre és kommunikálnak a nézőkkel. A közvetítések ezért természetes beszédet, különböző akcentusokat, zajokat, arckifejezéseket és gesztusokat is tartalmazhatnak.

Ez különösen hasznos lehet például beszédfelismerő, automatikus feliratozó vagy multimodális AI-modellek fejlesztésénél. A Twitch szerint a hangfelvételek felhasználása pontosabb beszéd-szöveg átalakítást eredményezhet, ami a platform feliratozását is javíthatja. Az így fejlesztett technológiát azonban az Amazon más szolgáltatásaiban is felhasználhatja.
A legnagyobb vita nem is maga az AI-képzés, hanem az engedélyezés módja körül alakult ki. A Twitch-felhasználók alapértelmezetten bekerülnek a programba, és nekik kell külön kikapcsolniuk a tartalom ilyen célú felhasználását.
A beállítást a fiók biztonsági és adatvédelmi részén belül, a „Training for Generative AI” opciónál lehet letiltani. A beszámolók szerint ehhez több lépésre van szükség, és a lehetőség nem feltétlenül ott található, ahol a streamerek elsőként keresnék.
A Twitch termékfelelősét, Mike Mintont egy hivatalos adásban arról kérdezték, miért nem önkéntes, bekapcsolható rendszerként vezették be a funkciót. Azt válaszolta, hogy opt-in modell esetén valószínűleg kevesen engedélyeznék. Ez ugyan magyarázatot ad a döntésre, de egyben azt is mutatja, hogy a platform számolt a felhasználói ellenállással.
A döntés több adatvédelmi kérdést is felvet. Egy streamer hangja, arca és kommunikációs stílusa személyhez köthető információkat tartalmazhat, miközben egy közvetítésben mások hangja, felhasználóneve vagy személyes üzenete is megjelenhet.
Különösen érdekes a streamchat kérdése. Egy néző hozzászólása is bekerülhet a közvetítés tartalmába, miközben az illető nem feltétlenül számít arra, hogy azt AI-modellek fejlesztésére is felhasználhatják. A Twitch tájékoztatása alapján a csatornatulajdonos döntése a csatornában megjelenő üzenetek felhasználhatóságára is hatással lehet.
A szerzői jogi helyzet sem egyszerű. A streamerek készítik a tartalmat, miközben a Twitch felhasználási feltételei meghatározzák, milyen jogokat kap a platform és az anyavállalata. Ettől még kérdés marad, hogy a tartalmak AI-modellek tanítására történő felhasználása mennyire felel meg a készítők eredeti elvárásainak, illetve részesülnek-e ebből közvetlenül.
Az sem teljesen világos, hogy egy adott streamer tartalma korábban bekerült-e Amazon-modellek képzésébe. A Twitch egyik vezetője azt mondta, hogy nem tudja, az Amazon milyen adatokat használt fel eddig modellképzéshez. Az pedig szintén kérdéses, hogy a későbbi kikapcsolás mit jelent azokkal az adatokkal kapcsolatban, amelyeket már felhasználtak.
Az Amazon és a Twitch oldaláról nézve az adatfelhasználás fejlettebb feliratozási, moderálási és keresési funkciókhoz járulhat hozzá. A valós környezetben rögzített beszéd és videó olyan helyzeteket is tartalmaz, amelyekben zaj, szleng, akcentus vagy gyors párbeszéd nehezíti az AI dolgát.
A készítők oldaláról viszont az a probléma, hogy csökkenhet a kontrolljuk afelett, mire használják fel a tartalmaikat. A streamerek simán folytathatják a munkát anélkül, hogy találkoznának az új beállítással, miközben a hangjuk, képük és korábbi adásaik felhasználhatóvá válnak.
A nyilvánosan elérhető tartalom nem feltétlenül jelenti azt, hogy a felhasználónak rögtön arra kell számítania, hogy AI-modellek tanítására használják a tartalmait. A platformoknak ezért egyre világosabban kellene kommunikálniuk, milyen célból és milyen feltételek mellett használják fel a felhasználói tartalmakat.
A Twitch döntése egy korábbi adatvédelmi vitára is emlékeztet, amikor a Meta felhasználói bejegyzések, képek és online követési adatok AI-fejlesztési célú felhasználását is lehetővé tette volna egy kifogásolt szabálymódosítás alapján.
A változás a magyar Twitch-felhasználókat is érinti. Az Európai Unió adatvédelmi környezetében különösen fontos kérdés lehet, hogy az adatkezeléshez kapcsolódó tájékoztatás és hozzájárulás valóban egyértelmű és megfelelően tájékozott legyen. A konkrét jogi megítélés ugyanakkor az adott adatoktól, szerződési feltételektől és felhasználási céltól függ.
A magyar streamereknek ezért érdemes ellenőrizniük a Twitch biztonsági és adatvédelmi beállításait, ha nem szeretnék, hogy jövőbeli tartalmaikat az Amazon AI-modelljeinek fejlesztéséhez is felhasználják. A kikapcsolás azonban nem feltétlenül vonatkozik minden automatizált Twitch-funkcióra, és az sem teljesen tisztázott, mi történik a már korábban felhasznált adatokkal.
Ahogy az AI-modellek egyre több adatot igényelnek, úgy lesz egyre fontosabb, hogy a felhasználók pontosan tudják, mire használják fel a tartalmaikat, és valóban dönthessenek is erről.
Megjelent a BitcoinBázis oldalon.