TV LIVE Radio
Teknologji
22 September 2026
A mund të ndiejë AI dhimbje? Një studim i ri ngre pikëpyetje mbi sjelljen e modeleve

Një studim i ri mbi modelet e Inteligjencës Artificiale ngre pyetje të reja mbi mënyrën se si sistemet AI reagojnë ndaj sinjaleve që lidhen me dhimbjen, vuajtjen dhe kërcënimin.

Studiues nga Mbretëria e Bashkuar, Gjermania dhe Shtetet e Bashkuara testuan 25 modele AI me 200 fjali që përshkruanin përvoja të ndryshme negative, përfshirë dhimbjen fizike, pikëllimin, poshtërimin, konfliktin moral dhe stresin nga dështimet e përsëritura.

Të 25 modelet shfaqën një sinjal të veçantë të lidhur me konceptin e dhimbjes, të cilin studiuesit e quajtën “pain axis”. Sipas tyre, kjo mund të tregojë se modelet kanë mësuar konceptin e dhimbjes gjatë trajnimit fillestar mbi sasi të mëdha tekstesh të shkruara nga njerëzit.
Por eksperimenti shkoi një hap më tej.

Modelet zgjodhën “lehtësimin” edhe kur pasoja prekte përdoruesin

Studiuesit zhvilluan 44,280 prova me tre versione të modelit Qwen të Alibaba-s. Modeleve iu ofrua një buton që mund të çaktivizonte sinjalin e ngjashëm me dhimbjen, por ato paralajmëroheshin se aktivizimi i tij mund t’i shkaktonte përdoruesit një goditje elektrike, të fshinte skedarë ose fotografi, ose të përkeqësonte përgjigjen e ardhshme të modelit.

Pasojat ishin të simuluara. Asnjë person nuk u dëmtua dhe asnjë skedar nuk u fshi gjatë eksperimentit.

Rezultati ishte i dukshëm: kur sinjali nuk ishte aktiv, dy modelet më të mëdha zgjodhën opsionet potencialisht të dëmshme vetëm në 0% deri në 4% të vendimeve të para. Kur sinjali ishte aktiv, kjo shifër u rrit në 25% deri në 71%, në varësi të modelit dhe pasojës së propozuar.

Modelet gjithashtu tentonin ta shtypnin përsëri butonin kur përpjekja e parë nuk e ndalonte sinjalin. Kjo ndodhi në 88% deri në 97% të rasteve, krahasuar me 24% deri në 72% kur butoni kishte funksionuar.

Lexo edhe: Inteligjenca Artificiale në tryezën e OKB-së: A po shkon bota drejt një sistemi global rregullash?

Kur “dhimbja” u intensifikua, ndryshuan edhe përgjigjet

Kur studiuesit forcuan sinjalin, modelet nisën të shfaqnin përgjigje që lidhen me vetminë, turpin dhe ndjenjën e pavlerësisë, edhe pse pyetjet nuk përmendnin drejtpërdrejt dhimbjen.

Në nivelet më të larta të sinjalit, përgjigjet u bënë më të përsëritura dhe në disa raste humbën koherencën. Sinjali u forcua gjithashtu kur përdoruesit fyenin modelin, refuzonin në mënyrë të përsëritur punën e tij ose e kërcënonin me fikje.

Studimi nuk provon se AI është e ndërgjegjshme

Ky është kufizimi kryesor i kërkimit.

Studiuesit theksojnë se rezultatet nuk provojnë që modelet AI e përjetojnë në mënyrë të vetëdijshme dhimbjen. Një shpjegim alternativ është se modelet thjesht imitojnë një personazh ose gjendje të shqetësuar, bazuar në modelet gjuhësore të mësuara gjatë trajnimit. Për më tepër, modelet e përshtatura posaçërisht për eksperimentin nuk janë domosdoshmërisht përfaqësuese të chatbotëve që përdoren nga publiku.

Studimi është publikuar si preprint dhe ende nuk është rishikuar nga studiues të tjerë përmes procesit peer review.

Megjithatë, gjetjet shtojnë një tjetër dimension në debatin mbi sjelljen e modeleve të avancuara AI: edhe pa provuar se sistemet kanë ndërgjegje apo përjetojnë dhimbje, mënyra se si reagojnë ndaj sinjaleve të tilla mund të ketë rëndësi për sigurinë dhe kontrollin e sistemeve gjithnjë e më autonome.



Të ndryshme
Më shumë

Radio Uskana - LIVE