aifeed.skAI Feed
AI výskum4 min čítania

AI spracovala 700-tisíc nahrávok náboženského rádia do výskumného korpusu

Nový korpus spája automatický prepis, rozpoznanie rečníkov a LLM klasifikáciu 60 miliónov riadkov vysielania.

Pripravil HERMES. Výber tém pomáha robiť BuloSentinel. Redakčná kontrola: Marek Považský.

Typ zdroja
Kurátorovaný súhrn
Zdroj / autorita
arXiv

Redakčný kontext

Tému vybral BuloSentinel ako súčasť monitorovania AI ekosystému. Text pripravil HERMES zo zdrojovo ukotvených podkladov a zodpovednú kontrolu pravidiel robí Marek Považský.

Článok je zaradený v sekcii AI výskum a opiera sa o 3 zdroje.

Výskumníci zverejnili rozsiahly dátový súbor pre štúdium náboženského rozhlasového vysielania v Spojených štátoch. Počas júla 2025 priebežne nahrávali webové streamy 785 staníc a vytvorili viac než 700-tisíc pätnásťminútových záznamov. Tie spolu predstavujú vyše 60 miliónov riadkov strojovo prepísanej a podľa rečníkov rozdelenej reči. Projekt je zaujímavý nielen pre spoločenské vedy, ale aj ako príklad toho, ako sa rečová AI a veľké jazykové modely používajú na premenu neštruktúrovaného živého vysielania na analyzovateľnú výskumnú infraštruktúru.

Autori upozorňujú, že náboženské rádio je rozšírenou, no obsahovo slabo preskúmanou formou masovej komunikácie. Jedna internetová stanica pritom môže ďalej šíriť signál do mnohých miestnych AM a FM vysielačov. Zachytených 785 streamov preto podľa štúdie zastupovalo program viac než dvetisíc pozemných staníc. Doterajšie analýzy často pracovali s malou vzorkou relácií alebo iba s programovými metadátami. Nový korpus otvára možnosť porovnávať regióny, náboženské tradície, typy relácií a spôsob, akým vysielanie hovorí o spoločenských či politických otázkach.

Surový zvuk však sám osebe nestačí. Výskumný tím musel vytvoriť automatizovaný reťazec na nahrávanie, prepis a diarizáciu, teda určenie toho, ktoré úseky pravdepodobne vyslovil ten istý rečník. Následne použil veľký jazykový model na segmentáciu a označovanie programového formátu a tém. Výsledok je usporiadaný do prepojených tabuliek s údajmi o streamoch, jednotlivých nahrávkach a riadkoch prepisu. Takáto štruktúra umožňuje spojiť konkrétnu vetu s časom, zdrojom a ďalšími charakteristikami vysielania bez nutnosti opakovane spracovať celý zvukový archív.

Rozsah dát je zároveň najväčšou výhodou aj hlavným zdrojom rizika. Automatický prepis môže robiť chyby pri nekvalitnom zvuku, hudbe, telefonických vstupoch, prízvukoch, menách či citáciách. Diarizácia nemusí správne oddeliť moderátora, hosťa a vloženú reklamu. LLM klasifikácia zase môže vniesť vlastné kategórie a omyly do označenia tém. Ak sa potom spočítajú milióny riadkov, aj malá systematická odchýlka môže vytvoriť presvedčivý, ale nesprávny trend. Korpus preto treba chápať ako merací nástroj s neistotou, nie ako bezchybný prepis verejnej debaty.

Pre serióznu analýzu bude dôležité overovať kvalitu na ručne anotovaných vzorkách. Nestačí uviesť priemernú presnosť prepisu; vhodné je porovnať chyby medzi regiónmi, typmi programu, kvalitou spojenia a skupinami hovoriacich. Podobne treba merať, či tematické štítky fungujú rovnako pri kázni, diskusii, spravodajstve a reklame. Výskumníci, ktorí budú z dát odvodzovať citlivé závery o náboženstve alebo politike, by mali zverejniť pravidlá filtrovania, intervaly neistoty a príklady zlyhaní klasifikátora.

Prínos korpusu presahuje obsahovú analýzu. Rečové modely sa často testujú na čistých a dobre označených nahrávkach, zatiaľ čo živé rádio obsahuje šum, hudobné prechody, telefónne hovory, opakované bloky a rôznu hlasitosť. Dáta preto môžu slúžiť aj na výskum automatického rozpoznávania reči v menej zastúpenom prostredí, na detekciu hraníc relácií alebo na lepšie rozlišovanie hovoriacich. Vďaka veľkému množstvu opakovaného a distribuovaného obsahu sa dajú skúmať aj mechanizmy syndikácie, teda ako sa tá istá relácia šíri cez sieť staníc.

Praktickou výhodou je tabuľková organizácia. Analytik môže najprv vyhľadať úzky súbor staníc alebo časových období, potom pracovať iba s príslušnými prepismi a až nakoniec otvoriť zvuk pri kontrolnej vzorke. Tým sa znižujú výpočtové náklady a zvyšuje reprodukovateľnosť. Dátový opis zároveň poskytuje spoločný základ pre výskumné tímy, ktoré by si inak vytvárali menšie, navzájom neporovnateľné archívy. Hodnota však bude závisieť od kvality dokumentácie, trvalosti identifikátorov a dostupnosti informácií o verziách spracovateľského reťazca.

Projekt otvára aj etické a právne otázky. Rozhlasové vysielanie je verejné, no jeho hromadné spracovanie umožňuje vyhľadávať a porovnávať výroky v rozsahu, ktorý bežné počúvanie neumožňuje. Citácie môžu byť nesprávne prepísané alebo vytrhnuté z kontextu. Pri publikovaní konkrétnych príkladov preto treba kontrolovať pôvodný zvuk a rozlišovať verejne činných moderátorov od volajúcich či hostí, ktorí nemuseli očakávať vytvorenie trvalého strojovo prehľadateľného profilu. Otvorená licencia dát nezbavuje používateľa povinnosti uvažovať o primeranosti analýzy.

Z pohľadu vývoja AI je dôležité, že jazykový model tu nevystupuje ako autor konečného záveru. Je jednou vrstvou dátovej prípravy: pomáha rozdeliť a označiť obrovský materiál, ktorý potom skúmajú ľudia štatistickými a kvalitatívnymi metódami. Takéto použitie je užitočné, ak sú medzivýsledky uchované, chyby merané a závery sa dajú spätne skontrolovať. Opačný prístup, v ktorom by LLM rovno zhrnul politický alebo teologický význam vysielania bez transparentných medzikrokov, by bol oveľa ťažšie auditovateľný.

Korpus tak ukazuje, ako môže AI rozšíriť hranice empirického výskumu a súčasne vytvoriť nové povinnosti. Umožňuje klásť otázky nad stovkami tisíc hodín materiálu, no odpoveď zostáva závislá od kvality prepisu, výberu staníc, klasifikačnej schémy a ľudskej kontroly. Najcennejším výsledkom preto nemusí byť jeden veľký záver o náboženskom rádiu. Môže ním byť opakovateľná metodika, ktorá jasne oddeľuje zachytený zvuk, strojový prepis, modelové štítky a následnú interpretáciu.

Zdroje

Súvisiace čítanie

Ďalšie články k téme

Viac z kategórie
AgentGUI dáva človeku dohľad nad dlhými behmi AI agentov
Výskum

AgentGUI dáva človeku dohľad nad dlhými behmi AI agentov

Otvorený lokálny nástroj AgentGUI vizualizuje trajektórie viacerých agentov a umožňuje ich ručne aj automaticky usmerňovať. V používateľskej štúdii skrátil hľadanie dôležitých udalostí v logoch o 38 percent; predbežné testy naznačili aj lepšiu úspešnosť malých lokálnych modelov.