Če spremljate izjave vodilnih ljudi ameriške industrije umetne inteligence, lahko dobite precej nenavaden vtis. Ljudje, ki trošijo milijarde dolarjev za razvoj vse zmogljivejših sistemov, nas hkrati opozarjajo, da bi lahko umetna inteligenca že v naslednjem desetletju ogrozila obstoj človeštva. Sam Altman, Dario Amodei in drugi vodilni v industriji govorijo o izgubi nadzora, nevarnih avtonomnih sistemih in eksistenčnih tveganjih. 

Kritiki opozarjajo, da s pozivi po ročni zavori poskušajo pridobiti prednost pred konkurenco, ustvariti kartel in zaščititi svoj položaj na tem področju. Prav tako bi jim upočasnitev razvoja lahko pomagala pri prikazovanju boljših poslovnih rezultatov pred odhodom na borzo. Hkrati pa priznavajo, da je velik del industrije resnično zaskrbljen glede nevarnosti napredne umetne inteligence, ki danes sicer še ne obstaja, a bi se lahko razvila v tako imenovano superinteligenco.

Poznavalci opozarjajo, da njihove skrbi niso nujno povezane z dejanskim stanjem razvoja umetne inteligence, temveč jih je superinteligenca skrbela že od nekdaj. Na njihove mestoma nenavadne odločitve v luči tega strahu pa sta vplivali dve manj znani ideologiji, ki ju deli velik del zaposlenih v vodilnih podjetjih, ki razvijajo umetno inteligenco.

Strah pred superinteligenco

Zgodba se začne precej pred chatGPT. V začetku tega stoletja je okoli ameriškega računalniškega programerja in samouka Eliezerja Yudkowskega nastala majhna intelektualna skupnost, ki se je ukvarjala z vprašanjem: kaj se zgodi, če človek nekoč ustvari stroj, ki je pametnejši od vseh ljudi? Yudkowsky je začel raziskovati tako imenovani problem prijazne umetne inteligence – kako zagotoviti, da bo zelo zmogljiv sistem zasledoval cilje, ki so združljivi s človeškimi interesi.

Leta 2009 je iz tega okolja nastal spletni forum LessWrong. Njegov namen je bil izboljšati človeško razmišljanje z uporabo logike, verjetnostnega sklepanja in drugih metod racionalnega odločanja. Skupnost je postala znana kot racionalistično gibanje. Njeni člani so veliko časa posvečali miselnim poskusom o prihodnji umetni inteligenci in možnostim, da bi zelo inteligenten sistem ravnal drugače, kot bi želeli njegovi ustvarjalci.

Za predstavitev svoje zaskrbljenosti uporabljajo splošno hipotetično zgodbo o računalniku, ki mu naročimo, naj izdela čim več sponk za papir. Z njegovega vidika bi bilo koristno pridobiti več računalniške moči, več energije in več nadzora nad okoljem, da bi lahko zastavljeno nalogo čim bolje izpolnil. Če postane dovolj sposoben, bi lahko v nekem trenutku preračunal, da mu ljudje pri tem stojijo na poti, in potegnil poteze, ki bi koristile izvornemu cilju, a škodile ljudem. Lahko bi celo vodile v izumrtje ljudi. Problem ni v tem, da bi računalnik »sovražil« ljudi. Problem je, da njegovo razumevanje cilja ni nujno usklajeno z našim. Skrbi racionalističnega gibanja in idejo superinteligence je  iz obrobne skupnosti v širšo filozofsko in tehnološko razpravo pripeljal filozof Nick Bostrom s knjigo Superintelligence leta 2014.

Od superinteligence do reševanja sveta

Vzporedno z racionalisti je nastajalo še eno gibanje. Imenuje se effective altruism oziroma učinkoviti altruizem. Njegovo izhodišče je preprostejše. Če želimo pomagati drugim, bi morali poskušati ugotoviti, kako lahko z denarjem, časom in kariero naredimo čim več dobrega. Sčasoma se je del tega gibanja vse bolj osredotočil na prihodnost človeštva.

Iz tega se je razvil tako imenovani longtermizem oziroma dolgoročništvo. Osnovna ideja je, da bi morali pri moralnih odločitvah resno upoštevati tudi ljudi, ki bodo živeli čez stoletja ali tisočletja. Če je v prihodnje ljudi lahko ogromno, lahko katastrofa, ki človeštvo uniči danes, pomeni izgubo nepredstavljivo velikega števila prihodnjih življenj. Zato preprečevanje takšnih katastrof postane zelo pomembna moralna naloga.

Tukaj sta se racionalizem in učinkoviti altruizem pri nekaterih razvijalcih umetne inteligence začela prepletati. Na podlagi prve ideologije jih je skrbel razvoj hipotetično nevarnih superinteligentnih strojev. Na podlagi druge pa jih je gnal moralni vzgib, da bi bilo vredno ogromno sredstev nameniti temu, da superinteligenca, ko bi jo nekdo naposled razvil, ne bi bila nevarna za ljudi. Ena od organizacij, ki je začela pomembno podpirati raziskave varnosti napredne umetne inteligence, je ameriška filantropska organizacija Open Philanthropy.

Potem se je zgodilo nekaj, kar je te ideje iz filozofskih razprav pripeljalo v tehnološko industrijo.

Iz filozofije v Silicijevo dolino

Leta 2015 je nastal OpenAI. Njegovo izhodišče je bilo, da bi morala umetna inteligenca koristiti celotnemu človeštvu. Koliko te misije je danes še ostalo, odkar je Sam Altman prevzel vajeti podjetja, ni jasno. So pa v prvih letih v OpenAI veliko teže vlagali v koncept, ki ga poznamo pod izrazom »alignment« oziroma usklajevanje vedenja umetne inteligence s človeškimi cilji in vrednotami. Ta pojem je celo postal eden ključnih na novem področju raziskav.

Dario Amodei co-founder of Anthropic via video link and OpenAI CEO Sam Altman address the United Nations Security Council during a session on Artificial Intelligence during the 81st United Nations General Assembly, at UN Headquarters in New York City, US, September 23, 2026. REUTERS/Brendan McDermid

Dario Amodei in Sam Altman sta Združene narode pozvala k upočasnitvi razvoja umetne inteligence. Foto: Reuters

Ko so leta 2022 veliki jezikovni modeli eksplodirali v javnosti, se je zgodil še en pomemben preskok. Nenadoma nismo več govorili samo o hipotetičnem stroju, ki bi nekega dne lahko postal superinteligenten. Imeli smo dejanske sisteme, ki so lahko načrtovali, uporabljali orodja, pisali programsko kodo in v nekaterih eksperimentih našli načine za izogibanje omejitvam, ki so jim jih postavili raziskovalci. Superinteligenca sicer še ne obstaja, a tudi ni več znanstvena fantastika, v katero verjame le peščica največjih zanesenjakov. Postala je nekaj, v kar danes lahko verjamejo množice. Čeprav nekateri znanstveniki, kot sta Yann LeCun in Gary Marcus, dvomijo, da bi arhitektura trenutnih velikih jezikovnih modelov sploh lahko privedla do superinteligence, a to je razprava za drugič.

Ko stroj »goljufa«

Ker je v racionalistični in učinkoviti altruistični tradiciji nastal nenavadno bogat in sistematičen besednjak, ki UI opisuje kot agenta z lastnimi cilji, preferencami, načrti, prepričanji in sposobnostjo zavajanja, se je s popularizacijo UI ta besednjak razširil v splošno uporabo. Ta antropomorfizacija umetne inteligence pa je problematična na več ravneh. Na njeno razširjenost je vplival tudi vmesnik, ki so ga podjetja razvila za ukazovanje umetni inteligenci.

Nekoč smo z računalnikom komunicirali v zelo zapletenem programskem jeziku. Če si hotel kaj več, si moral znati programirati. Danes umetni inteligenci v naravnem jeziku preprosto rečeš, kaj hočeš, ona pa ti odgovori prav tako v naravnem jeziku. Zato je, roko na srce, tudi če nočeš, težko o umetni inteligenci govoriti na način, ki ni vsaj malo antropomorfiziran. Preprosto še nismo razvili primernega besedišča.

Hkrati so podjetja vložila veliko truda, da bi umetna inteligenca delovala domačna in dajala vtis, da ima človeška čustva ter lasten karakter. Kljub temu se pod površjem na najosnovnejši ravni še vedno dogaja isto, kot se je dogajalo v starih računalnikih. Iste serije enic in ničel v različnih sosledjih, matematične operacije in statistika. Človeškost stroja je zgolj preobleka. Prevod. Simulacija. Ko se umetna inteligenca »razveseli« nečesa, ni vesela. To je le ples vmesnika za naše zadovoljstvo. V ozadju pa je še naprej hladen digitalni stroj, ki dela po navodilih ljudi. Le da včasih ljudje ne znamo predvideti, kako bo ta navodila interpretiral.

Paradoks ljudi, ki so se bali UI

Vse to pa nas pripelje do zgodovinske ironije. OpenAI je bil ustanovljen z močnim poudarkom na varnosti, Anthropic, ki sta ga ustanovila nekdanja vodilna pri OpenAI, brat in sestra Dario in Daniela Amodei, oba racionalista in učinkovita altruista, pa je varnost prav tako postavil v središče svoje identitete.

Richard Ngo, dolgoletni udeleženec skupnosti AI alignment, je v letošnji retrospektivi zapisal, da sta bili obe vodilni podjetji, ki lovita splošno umetno inteligenco – OpenAI in Anthropic – ustanovljeni pod zastavo alignmenta, hkrati pa po njegovem mnenju strah pred umetno inteligenco ni samo omejeval njenega razvoja, temveč je ta isti strah v nekaterih primerih celo pomagal pospešiti razvoj zmogljivejših in v teoriji nevarnejših sistemov.

Kako je to mogoče? Skrbi jih, da bi splošno umetno inteligenco razvil nekdo, ki z njo ne bi ravnal odgovorno oziroma je ne bi znal uskladiti s splošnimi cilji človeštva. Zaradi racionalizma njen razvoj vidijo kot neizbežno dejstvo tehnološkega razvoja, zaradi učinkovitega altruizma in dolgoročništva pa čutijo moralno odgovornost, da bi preprečili nastanek zlonamerne superinteligence. Ne le danes, temveč kadar koli v prihodnosti.

Ker drugim ne zaupajo, jih želijo z razvojem s človeškimi cilji usklajene superinteligence prehiteti. To pa je tudi razlog, da ne želijo ustaviti svojega razvoja, če tega ne bodo storili drugi. Saj zase »vedo«, da niso neodgovorni. Morda so le nespretni oziroma »ne dohajajo razvoja«. Konkurenca? Ta pa je lahko hkrati neodgovorna in nespretna. Ne moreš vedeti. Zato jo je treba prehiteti. To je nekako logika kolektivnega drvenja proti hipotetičnemu prepadu, ki jo je dokaj nekritično v nedavnem nastopu za podkast UnHerd ponovil Nick Bostrom.

Njihove ideologije v resnici ne skrbi umetna inteligenca, ki obstaja danes. Veliko bolj jih skrbi neka prihodnja, ki še ne obstaja, a bi se naučila sama učiti ter bi lahko dosegla nekakšno stopnjo nenadzorovane »razredne zavesti« oziroma cilje, ki z ljudmi ne bi bili usklajeni. V spregi z vzporednimi interesi kapitala, ki jih vse bolj skrbijo astronomski vložki in nejasni poslovni modeli za povračilo vložkov, pa so njihovi glasovi, znani tudi kot »doomerizem«, postali učinkovito orodje strašenja javnosti.

Predvsem pa z retoriko o hipotetični samovoljni superinteligenci poskušajo zamegliti razpravo o konkretnih izdelkih, ki jih razvijajo podjetja, in odgovornosti teh podjetij za škodo, ki so jo njihovi konkretni izdelki na podlagi njihovih lastnih navodil in pomanjkljivih varnostnih ukrepov že povzročili.

Priporočamo