Një përmbledhje e gabuar nga AI uli kujtesën e saktë në 44,8%

|Autori: Ekipi editorial i QUASA|5 min lexim
Një përmbledhje e gabuar nga AI uli kujtesën e saktë në 44,8%

Një hollësi e gabuar në një përmbledhje të krijuar me AI ndryshoi përgjigjet e pjesëmarrësve për atë që kishin parë: sipas Universitetit Georgetown, 44,8% e atyre që lexuan përmbledhjen mashtruese kujtuan saktë shenjën rrugore, kundrejt 83,6% që lexuan versionin e saktë. Pyetja kishte të bënte me një hollësi të ngjarjes së regjistruar: nëse makina kishte hasur një shenjë ndalimi apo një shenjë përparësie.

Sipas Neuroscience News, punimi i Mattea Sim, Yael Eiger dhe Tadayoshi Kohno u publikua më 23 shtator 2026; 331 të rritur përfunduan të dyja fazat e eksperimentit, të ndara nga një interval prej 24–48 orësh. Studiuesit nga Universiteti Georgetown dhe Universiteti i Uashingtonit u kërkuan pjesëmarrësve të kujtonin videon që kishin parë vetë, pasi kishin lexuar një përmbledhje të saj. Ndryshimi i kontrolluar në tekst u dha mundësi të matnin ndikimin e informacionit të mëvonshëm mbi përgjigjen për shenjën.

Si u mat ndryshimi i kujtesës

Në metodën e punimit, analiza përfshiu 328 pjesëmarrës pas kontrolleve të vëmendjes. Secili pa njërën nga dy videot e animuara, rreth 25 sekonda të gjata, të krijuara brenda lojës Grand Theft Auto V për një studim të mëparshëm të kujtesës. Në të dyja, një makinë e kuqe i afrohej kryqëzimit, kthehej djathtas dhe përplasej me një këmbësor; ndryshimi kryesor ishte shenja e ndalimit ose e përparësisë.

Pas shikimit të videos, pjesëmarrësit duhej të identifikonin ngjyrën e makinës për të kaluar kontrollin fillestar të vëmendjes. Kur u kthyen ditën tjetër ose një ditë më pas, lexuan një përmbledhje të ngjarjes dhe më pas iu përgjigjën pyetjeve të kujtesës. U udhëzuan të mbështeteshin te videoja origjinale, jo te teksti që sapo kishin lexuar.

Përmbledhja ishte krijuar me ChatGPT dhe ishte standardizuar nga studiuesit, në mënyrë që pjesëmarrësit të lexonin në thelb të njëjtin rrëfim. Për një grup, shenja e përmendur në tekst përputhej me videon; për grupin tjetër, ajo ishte ndërruar qëllimisht. Kështu, krahasimi mat pasojën e një hollësie mashtruese të vendosur në kushte eksperimentale, jo shpeshtësinë me të cilën ChatGPT do ta ngatërronte vetë atë shenjë gjatë përdorimit të zakonshëm.

Çfarë gabimesh u gjetën në përmbledhjet automatike

Punimi përfshiu edhe një analizë më vete të përmbledhjeve të prodhuara nga ChatGPT dhe Gemini për të njëjtat video. Studiuesit u kërkuan modeleve ta përshkruanin secilën video disa herë dhe analizuan gjithsej 20 tekste. Të gjitha përmbanin gabime: secila kishte të paktën shtatë, ndërsa numri më i lartë në një përmbledhje ishte 21. Kjo analizë tregon çfarë lloj pasaktësish mund të dalin nga modelet në këto pamje të shkurtra; testi me njerëz përdori një tekst të zgjedhur dhe të kontrolluar veçmas.

Lënia jashtë e hollësive ishte gabimi më i zakonshëm. Mesatarisht, përmbledhjet nuk përmendnin 51,6% të hollësive që ekipi i kishte përcaktuar si qendrore. Pothuajse të gjitha lanë jashtë vetë përplasjen e makinës me këmbësorin, megjithëse ajo ishte ngjarja kryesore e videos. Në tekste të tjera u shfaqën përshkrime të pasakta të veprimeve ose hollësi që nuk dukeshin në pamje.

Këto dy pjesë të kërkimit duhen mbajtur të dalluara. Numërimi i gabimeve tregon sjelljen e modeleve për dy video dhe një kërkesë të caktuar për përmbledhje. Diferenca në përgjigjet e pjesëmarrësve tregon çfarë ndodhi kur studiuesit ndryshuan përshkrimin e shenjës në tekstin që ata lexuan më vonë. Nuk është matur ndikimi i secilit gabim të gjetur te përmbledhjet automatike.

Etiketa “AI” nuk solli mbrojtje të matshme

Studiuesit ndryshuan edhe autorësinë që pjesëmarrësit mendonin se kishte përmbledhja. Disa u informuan se teksti ishte prodhuar nga AI, të tjerët se ishte shkruar nga një transkriptues profesionist. Në të vërtetë, të gjithë lexuan tekst të krijuar me ChatGPT, me ndryshimin e kontrolluar te shenja rrugore. Kjo e veçoi ndikimin e etiketës së autorësisë nga ndikimi i informacionit të saktë ose mashtrues.

Etiketa nuk u lidh me një ndryshim statistikisht domethënës në saktësinë e përgjigjes për shenjën. As besimi i deklaruar te AI dhe as shpeshtësia e përdorimit të saj nuk treguan një lidhje domethënëse me ndjeshmërinë ndaj hollësisë së gabuar në këtë provë. Rezultati sugjeron se dijenia për origjinën e tekstit, e vetme, nuk mjaftoi që pjesëmarrësit ta ndanin përshkrimin e mëvonshëm nga ajo që kujtonin se kishin parë.

Sa larg shtrihet ky rezultat

Eksperimenti mati një përgjigje konkrete për një shenjë rrugore në dy video të shkurtra të animuara. Pjesëmarrësit ishin të rritur të rekrutuar në internet në SHBA, ndërsa përmbledhja mashtruese ishte përgatitur që të ndryshonte një hollësi të përcaktuar paraprakisht. Këto kushte e bëjnë të qartë shkakun e dallimit mes grupeve, por nuk japin një normë gabimi për përmbledhjet e videove reale ose për raportet e përdorura jashtë laboratorit.

Testi tregoi gjithashtu se pjesëmarrësit ruanin kujtime të tjera nga videoja: ata përgjigjeshin saktë për hollësi që nuk ishin ndryshuar në përmbledhje. Prandaj, rënia te pyetja për shenjën nuk përshkruan një humbje të përgjithshme të kujtesës. Për përdorime si përmbledhja e pamjeve nga kamerat trupore, mbetet për t’u matur nëse dhe sa ndryshon ky efekt kur ngjarja, teksti dhe rishikimi njerëzor janë më afër kushteve reale.

Ndaj:

Abonohuni në buletinin tonë

Merrni lajmet më të fundit për Web3, AI dhe kripto direkt në kutinë tuaj postare.

0