Már egy hangoskönyv szereplőjével is beszélgethetünk a generatív mesterséges intelligencia segítségével

Valós időben beszélgethetnek egy történet szereplőjével az Audible új interaktív hangoskönyves rendszerének felhasználói. A generatív mesterséges intelligencia elsőként Bram Stoker Drakula című művének világában kelti életre Renfield karakterét, aki szerepet és célt ad a hallgatónak, majd szabadon megfogalmazott válaszaira reagál.

Az Amazon tulajdonában lévő Audible október 1-jén három új kísérleti funkciót jelentett be: a Character Guide, az Interactive Story és a Visual Explorer rendszert. A fejlesztéseket nem egyszerre és nem a teljes katalógusban vezetik be, hanem korlátozott béta formájában az Egyesült Államokban és az Egyesült Királyságban. A Character Guide már a Drakula új Audible Original változatánál segít követni, éppen melyik szereplő beszél, és spoilermentes információt ad az adott karakterről.

A generatív mesterséges intelligencia szempontjából az Interactive Story a legérdekesebb újdonság. Ebben a hallgató nem előre elkészített válaszlehetőségek közül választ, hanem saját szavaival válaszolhat a történet egyik szereplőjének. A Drakulához készült első élményben Renfield kezdeményezi a beszélgetést: szerepet, célt és tétet ad a felhasználónak, majd annak szabadon megfogalmazott válaszára reagál valós időben. Ez már sokkal inkább generált párbeszéd, mint hagyományos elágazó interaktív történet.

Az Audible szerint ugyanakkor a történet alapjait továbbra is emberek határozzák meg. A készítők rögzítik a nyitójeleneteket, a fontos fordulópontokat és a karakter személyiségét, a termék kialakításának pedig az a célja, hogy a generált reakciók a mű eredeti világán belül maradjanak. A következő Interactive Story november 5-én az Exoplanet című Audible Original világában érkezik Benjamin Percy közreműködésével. Ez fontos különbség ahhoz képest, mintha egy általános chatbot korlátlanul improvizálna egy ismert karakter nevében.

Olvasd el: A generált világ már emlékszik arra is, mit tettünk benne korábban

Mi lesz a történetmesélés határa, ha a közönség már nemcsak követheti a szereplőket, hanem saját mondataival beléphet a történetükbe?

A fejlesztés azért érdekes, mert a generatív mesterséges intelligencia itt nem új könyvet vagy önálló hangfelvételt próbál készíteni. Ehelyett egy már létező narratíva köré épít interaktív réteget, amely minden beszélgetésnél másképpen alakulhat. Ezzel a hallgató szerepe is megváltozik: a passzív befogadó részben résztvevővé válik, miközben az eredeti mű és az emberi alkotók által meghatározott keretek továbbra is megmaradnak.

A rendszer lehetőségeit egyelőre nem érdemes túlértékelni. A funkció csak néhány kiválasztott alkotásnál jelenik meg, korlátozott földrajzi bétában, és még nem tudható, mennyire következetesen őrzi meg egy karakter személyiségét hosszabb vagy váratlan beszélgetéseknél. Az sem látszik még, hogy a hallgatók tartósan szeretnének-e beszélgetni a szereplőkkel, vagy az újdonság inkább egyszer kipróbált extra marad. Az Audible ezért jelenleg ügyfél- és alkotói visszajelzések alapján fejleszti tovább a rendszert.

Az Interactive Story mégis egy új irányt mutat a generatív tartalomkészítésben. Eddig elsősorban azt láttuk, hogy a mesterséges intelligencia képet, videót, zenét vagy szöveget készít a felhasználónak. Az Audible most azt próbálja meg, hogy maga a történet váljon reagáló felületté. Ha ez szélesebb körben működőképessé válik, a jövő hangoskönyveinek és más narratív tartalmainak egy része már nem teljesen ugyanúgy zajlik majd minden hallgatónál.

Olvasd el ezt is: A telefonra költöztette generatív videós eszközeit az Adobe

Források: Audible, TechCrunch, 9to5Mac

CS.SZ.

MI - KKV

Valós időben beszélgethetnek egy történet szereplőjével az Audible új interaktív hangoskönyves rendszerének felhasználói. A generatív mesterséges intelligencia elsőként Bram Stoker Drakula című …

Kereskedelmi szolgáltatásként is elindította az e& UAE felső 6 GHz-es, 256 adó-vevő egységes Giga-MIMO mobilhálózatát az Egyesült Arab Emírségekben. A szolgáltató legfeljebb …

Újabb funkciókkal bővült a GoDaddy WordPressbe épített Airo mesterséges intelligencia rendszere. A szeptemberi fejlesztések elsősorban a meglévő weboldalak újratervezését, az arculati stílusok …

Virtuális ruhapróbával bővítette vásárlási funkcióit az OpenAI: a ChatGPT már a felhasználó saját fotójára generálhatja rá a kiválasztott ruhát vagy kiegészítőt. Az …

Gemini 4 Argon néven mutatta be új csúcsmodelljét a Google, amelyet kifejezetten hosszú, összetett munkafolyamatokra, programozásra, szakmai kutatásra és kibervédelemre fejlesztett. A …