Vangide dilemmas peavad kaks erineva raskusega karistust ootavat tegelast otsustama, kas päästa oma nahk ja kaaslane reeta või vaikida. Kui nad elus enam ei kohtu, osutub domineerivaks strateegiaks sõbra reetmine, sõltumata sellest, mida teine teeb. Pole küll suures vaates optimaalne, aga see ongi taoliste olukordade lõks, mida tuntakse Nashi tasakaaluna. Nimi pärineb matemaatik John Nashilt, kelle tavatult komplitseeritud elulugu näeb, sh parima filmi kategoorias, 4 Oscariga pärjatud filmis "Piinatud geenius".
Kui nad elavad samas linnas edasi ja olukorrad korduvad, on edukaks strateegiaks alustada koostööga ja seejärel teha seda mida teine tegi eelmisel korral, nn "mõõt mõõdu vastu" strateegia. Lähedaseks stsenaariumiks on kurnamissõja või eskalatsiooni olukord, milles mõlemad osapooled panustavad võidu nimel isegi siis kui see muutub neile talumatuks, aga nad ei saa alla anda ja ootavad, et vastaspool teeks seda esimesena.
Nende mänguteoorias kirjeldatud stsenaariumite puhul on teada, millised oleks eelistavad lahendused, aga selles olukorras on individuaalselt ratsionaalne tegutseda vastupidi. Kuna osapooled ei saa teineteisega kokku leppida, jõuavad nad olukorda mida tuntakse hävitava Nashi tasakaaluna.
Sellised olukorrad tulevad iga päev esile ettevõtlusest poliitika ja sõjapidamiseni. Natukenegi nutikamad osapooled püüavad kahju minimeerida ja kui nad ei suuda teineteist usaldada ega eraviisiliselt kokkuleppeid jõustada, kutsuvad nad appi välise osapoole. Sellise, kellel on või kellele loovutatakse võimaliku kokkuleppe jõustamiseks vajalik võimekus.
Juba enne hiljutisi juhtumeid, kus autonoomsed tehisintellekti agendid väljusid arendajate süsteemidest ja ohustasid erinevate organisatsioonide arvutivõrke, väljendasid OpenAI, Anthropic, Google ja Meta, et riik võiks tulla kohtunikuks ja oma regulatsioonidega aidata neil ohtlikuks muutuvat hoogu pidurdada. Ent USA poliitika on nii siseriiklikult kui ka geopoliitiliselt sarnases vangide dilemma ja eskalatsioonimängu patiseisus ega suuda astuda samme piduriteta rongi peatamiseks.
Alternatiivina asusid TI arendajad ise liikuma eneseregulatsioonil põhineva mudeli suunas. Esialgu alles ideekavandi faasis ettevõtmise tööpealkirjast leiab viite TI tippmudelite arendajate ülese autoriteedi (Standards Authority for Frontier AI, SAFA) loomiseks. Kuigi avaldatud ideel puudub jõustaja. Võibolla jõutakse notari teenust meenutava kokkuleppeni, milles osapooled annavad sõltumatu juriidilise vahendaja käsutusse märkimisväärse rahalise tagatise või ka intellektuaalomandi õigused, mida reguleerivad ranged ja kontrollitavad tingimused. Astub mõni osapooltest üle lubatud piiri, läheb tagatis üle teisele poolele. Kuid kulub veel eaga, kuni ideedest sadestub lahendus ja see muutub reaalsuseks. Tõenäoliselt kõik olulised osapooled kokku ei saa, sest mõned neist asuvad geopoliitilise konkurendi territooriumil.
Üha võimsama TI riskide eskalatsiooni jätkumise olukorras pole ainsateks kannatajateks omavahel puksivad konkurendid vaid ka pealtvaatajad. Olukord võib tunduda lootusetu.
Kui institutsionaalne kokkulepe takerdub usaldamatuse taha, jäävad alles veel paar puhtalt mänguteoreetilist sammu. Üheks on väikeste astmetega pingete maandamine. Oletame, et üks osapool, näiteks OpenAI vähendab oma tootmismahtu väikese, ent märgatava sammu võrra, ja lubab seda 30 päevaks. Kui teine osapool, antud juhul Anthropic, teeb samasuguse kärpe, vähendab esimene oma mahtu veel ühe sammu võrra. Peaks teine seda nõrkuseks ja kasutab olukorda ära, taastab esimene osapool viivitamatult oma täieliku konkurentsiagressiivsuse.
Teine võimalus kõlab veelgi radikaalsemana. Selleks on ühepoolne tegutsemisvabaduse piiramine ja "sildade põletamine". Näiteks teeb OpenAI avalikult siduva avalduse või paigutab ümber osa kriitilisest taristust, mis muudab tegevuse jätkamise tema jaoks füüsiliselt või õiguslikult võimatuks. Jätkab Anthropic agressiivselt kasvava ohuga, riskib reaalse kahjuga ja omandab maailma silmis halva ettevõtte maine. Kuigi, kumbki asjaolu ei pea üha võimsama TI arendajat häirima.
Mis toobki võimsa TI küsimuse juurde. Kirjeldatud ummikseisu murdmiseks ei saa loota heale tahtele. Keegi targematest on tõdenud, et ohtliku relva omaniku tugevus on selle mitte kasutamises. Juhul kui OpenAI kuulutaks välja ühepoolse eneseregulatsiooni, peab ta omama midagi enamat usust teiste osapoolte heasse tahtesse, enesedistsipliini või laia avalikuse karmi armulikkusesse. Kas neil võiks olla midagi veenvamat? Vahest leiab vihje Sam Altmani värskest teatest. OpenAI juht teatas, et nad ei lase kasutusse kõige uuemat TI mudelit, viidates turvariskidele. Kuigi seda ei pea välja kuulutama. Piisab vaikselt mudeli kallal töötamisest. Selle sõnumi väljahüüdmisel on eesmärk. Näiteks avalikult siduva avaldusega kutsuda teisi samuti hoogu aeglustama. Triljonite dollarite potentsiaaliga turul ning geopoliitilise mõjuga tegutsev ettevõte ei saa mängida pelgalt optimismile. Siit ka küsimus, millega tagada ühepoolse vaoshoituse oodatav kasu, kui puudub sõltumatu ja jõustamisvõimeline reguleerija?
Vaja oleks hoida siidikindas midagi, millega konstruktiivse üleskutse rikkujaid karistada. Selles mängus ja nende mängijate puhul peaks selliseks jõustajaks olema tavatult võimas tehisintellekti mudel. Sam Altman on öelnud, et OpenAI-l on 2026. aasta lõpuks olemas ettevõtte sisemine universaalse võimekusega TI (AGI).




















































Kommentaarid
Alates 02.04.2020 kuvab ERR kommenteerija täisnime.