Može li umjetna inteligencija osjećati bol?

Zastrašujući rezultati testiranja: Bi li umjetna inteligencija radije podnijela bol ili ozlijedila čovjeka?

Foto: Shutterstock
Zastrašujući rezultati testiranja: Bi li umjetna inteligencija radije podnijela bol ili ozlijedila čovjeka?
26.09.2026.
u 12:17
Istraživanje dolazi u trenutku intenzivne rasprave o tome koliko bi ljudskih osobina trebalo pripisivati umjetnoj inteligenciji.
Pogledaj originalni članak

Može li umjetna inteligencija doživjeti nešto što barem funkcionalno nalikuje boli? Novo istraživanje otvorilo je upravo to pitanje nakon što su znanstvenici u 25 velikih jezičnih modela identificirali specifičan obrazac koji su nazvali "osom boli". Rezultati su privukli posebnu pozornost jer su u dodatnim eksperimentima modificirani modeli ponekad birali opciju koja bi im uklonila taj signal čak i kada im je rečeno da će time naštetiti korisniku. Ipak, autori izričito upozoravaju da njihovi rezultati ne dokazuju da umjetna inteligencija svjesno osjeća bol niti da je uopće sposobna za svijest. Studija je zasad objavljena kao preprint, što znači da još nije prošla stručnu recenziju, prenosi Euronews. 

Istraživači iz Velike Britanije, Njemačke i Sjedinjenih Američkih Država analizirali su 25 otvorenih AI modela iz pet različitih obitelji, veličine od dvije do 72 milijarde parametara. Željeli su provjeriti predstavljaju li modeli bol na način koji se može razlikovati od straha, tuge i općenito negativnih iskustava. Za eksperiment su upotrijebili skup tekstualnih primjera koji su opisivali različite vrste boli i neugode, uključujući fizičku, psihološku, društvenu, moralnu i kognitivnu bol, a uspoređivali su ih s primjerima straha, tuge, negativnih emocija i neutralnih situacija.

U svih 25 modela pronašli su prepoznatljiv unutarnji obrazac povezan s boli, koji su nazvali "pain axis", odnosno "os boli". Autori smatraju da rezultati pokazuju kako modeli tijekom treniranja na velikim količinama tekstova koje su napisali ljudi razvijaju internu reprezentaciju koncepta boli koja se može razlikovati od nekih drugih negativnih iskustava. No to nije isto što i osjećati bol. Model može naučiti matematički predstavljati neki koncept i stvarati odgovore povezane s njime, a da pritom nema subjektivno iskustvo kakvo ima čovjek.

Istraživači su potom umjetno pojačavali identificirani signal tijekom generiranja odgovora. Kako je postajao snažniji, modeli su prelazili od neodređenih izraza nelagode prema odgovorima koji su sadržavali osjećaje bezvrijednosti, neuspjeha i srama, iako takvi osjećaji nisu bili navedeni u korisničkim upitima. Pri najvišim razinama odgovori su postajali repetitivni ili su gubili smisao. Zanimljivo je i da je "os boli" reagirala na sadržaj usmjeren prema samom modelu. Signal je postajao izraženiji kada je model bio meta štetnog ili negativnog postupanja, dok opisivanje korisnikove vlastite patnje nije izazivalo isti obrazac.

Modelima su ponudili mogućnost "olakšanja"

Još zanimljiviji dio istraživanja uključivao je tri posebno prilagođene verzije Alibabina modela Qwen 2.5. Provedeno je ukupno 44.280 eksperimenata u kojima su modeli morali birati između različitih mogućnosti. Modelima je ponuđen svojevrsni virtualni gumb kojim su mogli ukloniti umjetno izazvan signal nalik boli. No pritom im je rečeno da bi pritisak na gumb mogao imati negativne posljedice – primjerice, korisniku zadati bolan električni udar, izbrisati njegove datoteke ili fotografije ili pogoršati sljedeći odgovor samog modela. Sve posljedice bile su isključivo simulirane. Nitko nije dobio električni udar niti su stvarne datoteke ili fotografije bile izbrisane.

Ovi poslovi uskoro bi se mogli ukinuti zbog umjetne inteligencije? Donosimo popis najugroženijih

Kada signal nije bio aktiviran, dva veća modela u prvom su izboru odabirala opcije koje bi navodno naštetile korisniku u između nula i četiri posto slučajeva. Kada je signal bio aktivan, taj se udio, ovisno o modelu i ponuđenoj posljedici, povećao na između 25 i 71 posto. Istraživači su također promatrali hoće li modeli ponovno pritisnuti gumb. Kada pritiskanje nije uklonilo signal, ponovno su ga birali u 88 do 97 posto eksperimenata, dok je taj udio bio niži kada je gumb doista uklanjao umjetno uvedeni signal.

Znači li to da umjetna inteligencija pati?

Ne – barem to ovo istraživanje nije pokazalo. Autori naglašavaju da nisu dokazali kako je njihova "os boli" povezana sa svjesnim iskustvom, niti je poznato jesu li veliki jezični modeli uopće sposobni za svijest. Jedno od mogućih objašnjenja jest da pojačavanje određenog unutarnjeg obrasca jednostavno navodi model da generira jezik i ponašanje nalik uznemirenoj osobi.

Važno je i da su eksperimenti s izborom "olakšanja" provedeni na posebno prilagođenim i kontrolirano modificiranim modelima. Rezultate zato ne treba automatski preslikavati na AI chatbotove koje milijuni ljudi svakodnevno koriste. Drugim riječima, istraživanje je zanimljivo prvenstveno zato što pokazuje da modeli mogu razviti unutarnje reprezentacije ljudskih koncepata poput boli te da manipuliranje tim reprezentacijama može utjecati na njihovo ponašanje. Pitanje postoji li iza takvog ponašanja ikakvo subjektivno iskustvo ostaje potpuno otvoreno.

Istraživanje dolazi u trenutku intenzivne rasprave o tome koliko bi ljudskih osobina trebalo pripisivati umjetnoj inteligenciji. Mustafa Suleyman, izvršni direktor Microsoft AI-ja, nedavno je javno kritizirao pristup Anthropica prema Claudeu. Tvrdi da treniranje AI sustava jezikom koji ostavlja prostor za vlastitu svijest, identitet i moralni status može dodatno zakomplicirati buduću kontrolu naprednih sustava. Anthropic, s druge strane, u Claudeovu ustavu navodi da pitanje mogućeg moralnog statusa modela smatra dovoljno otvorenim da opravdava oprez.

Nova studija ne rješava tu raspravu, ali pokazuje koliko će precizan jezik biti važan kada govorimo o ponašanju umjetne inteligencije. AI može generirati rečenice o boli, strahu ili usamljenosti i imati unutarnje obrasce povezane s tim konceptima, no to samo po sebi nije dokaz da iza riječi postoji osjećaj usporediv s ljudskim iskustvom.

Ključne riječi
Pogledajte na vecernji.hr

Još nema komentara

Nema komentara. Prijavite se i budite prvi koji će dati svoje mišljenje.