Üks Redditi Artificial kogukonnas tutvustatud uus rakendus ühendab ajaloo, taskuhäälingu ja vestlusliku tehisintellekti. Kasutaja sisestab teema, ajaloolise sündmuse või isiku ning rakendus koostab selle põhjal taskuhäälingu, kus lugu esitavad üks või kaks virtuaalset saatejuhti.

Rakenduse looja sõnul kulub episoodi valmimiseks umbes minut. Tema kirjelduses on rõhk sellel, et tegemist ei ole ainult tekstist kõneks muundamisega: süsteem uurib teemat enne stsenaariumi kirjutamist, lisab saate juurde teemaga seotud illustratsioonid ning võimaldab kuulajal esitust küsimustega katkestada.

Kuulaja saab saatejuhte katkestada

Rakenduse üks keskseid funktsioone on võimalus esitada saate ajal täpsustavaid küsimusi. Kui kuulaja soovib mõnda nime, kuupäeva või sündmust lähemalt mõista, saab ta loo autori kirjelduse järgi vahele jätta ning virtuaalsed saatejuhid vastavad küsimusele enne põhiteema juurde naasmist.

Rakendus jätab autori sõnul meelde ka varasemalt kuulatud teemad. See võimaldab saatejuhtidel hiljem varasematele episoodidele viidata ja siduda uusi lugusid kasutaja varasema huviga. Episoodi lõpus võib kuulaja soovi korral teha teadmiste kontrollimiseks lühikese viktoriini.

Allikatele pööratakse tähelepanu

Rakenduse looja väitel ei kirjutata stsenaariumi kohe kasutaja sisendi põhjal, vaid sellele eelneb veebiotsing. Süsteem kontrollib tema sõnul võtmekuupäevi, nimesid ja arve erinevate allikate abil ning lisab episoodile viited, mille kaudu saab kuulaja teemaga iseseisvalt edasi tutvuda.

Erilist tähelepanu pööratakse olukordadele, kus ajalooallikad omavahel ei kattu. Autori kirjelduse järgi peaksid saatejuhid sellistest erinevustest kuulajale rääkima, mitte esitama üht tõlgendust vaikimisi ainsa tõena. See on oluline eristus võrreldes süsteemiga, mis võib anda enesekindla vastuse ka siis, kui teema kohta leidub vastuolulist infot. Samas põhineb see kirjeldus rakenduse looja väidetel ning allikate kvaliteeti ja vastuste täpsust tuleb kasutamisel eraldi hinnata.

Erinevate mudelite kombineerimine

Arendaja sõnul ei kasuta rakendus kõigi ülesannete jaoks üht ja sama keelemudelit. Ta katsetas eri tööde puhul GPT, Claude’i ja Gemini mudeleid ning valis tema hinnangul sobivaima lahenduse uurimistöö, plaani, stsenaariumi, illustratsioonide, häälte ja viktoriini jaoks.

Postituse autori sõnul olid mudelite erinevused suuremad, kui ta alguses ootas. Mõni mudel sobis tema hinnangul paremini dialoogi kirjutamiseks, teine planeerimiseks, lisaks varieerusid kasutuskulud. Rakendus toetab praegu kuut keelt ning arendaja otsib kasutajatelt tagasisidet, et otsustada, kas projekti edasi arendada.

Miks see on oluline?

Selline lahendus näitab, kuidas AI-rakendused liiguvad ühepoolse sisu genereerimise juurest interaktiivsema kasutuskogemuse poole. Hariduses, sisuloomes ja teadmiste omandamisel võib vestluslik formaat muuta pika teema uurimise paindlikumaks. Samal ajal jäävad keskseks küsimused allikate läbipaistvuse, faktikontrolli ja selle kohta, kui täpselt suudab süsteem keerulisi ajaloolisi vaidlusi edasi anda.

Mida edasi jälgida?

Jälgida tasub rakenduse kasutajate tagasisidet, allikate kontrollitavust, eri keelte kvaliteeti ning seda, kui hästi toimivad katkestused ja varasemate kuulamiste põhjal kohanduv sisu.

Algallikas: Reddit Artificial