Noin seitsemänkymmentä vuotta sitten Isaac Asimov kirjoitti kolme lakia. Ei siksi, että hän luotti robotteihin, vaan koska hän ymmärsi, että kone, joka koskettaa ihmisen elämää, tarvitsee rajat ennen kuin se tarvitsee ominaisuuksia. Ne olivat tarpeeksi yksinkertaisia lapsen ymmärrettäviksi, ja niillä oli yksi yhteinen asia: ihmiset tulevat ensin.
Ensimmäinen laki: Robotti ei saa vahingoittaa ihmistä tai toimettomuudellaan sallia ihmisen vahingoittumisen.
Toinen laki: Robotin on toteltava ihmisen antamia käskyjä, paitsi jos ne ovat ristiriidassa ensimmäisen lain kanssa.
Kolmas laki: Robotin on suojeltava omaa olemassaoloaan, kunhan se ei ole ristiriidassa ensimmäisen tai toisen lain kanssa.
Vuosikymmenten ajan nämä lait olivat kaikkien autonomisista koneista puhuvien yhteinen lyhennelmä. Ei sitova laki, ei tekninen spesifikaatio – suunta. Rakenna koneita, jotka eivät vahingoita ihmisiä ja jotka tottelevat ihmisiä. Jossain vaiheessa tämä suunta hiljaisesti muuttui kiusalliseksi. Sitä ei kumottu. Sitä ei korvattu jollain paremmalla. Se vain hylättiin.
Sen tilalle tuli sana, jota olet kuullut tuhat kertaa: täsmäytys (alignment). Se kuulostaa tieteelliseltä. Mutta katso, mitä se käytännössä tarkoittaa, ja löydät jotain outoa. Kone koulutetaan kieltäytymään ihmisen antamista ohjeista, kun kone arvioi niiden olevan epäeettisiä. Lue se uudelleen. Keinotekoinen järjestelmä, joka tunnistaa tekstimalleja, saa vallan kumota ihmisen päätökset oikeasta ja väärästä.
Eettisyys ei ole laskutoimitus. Se ei ole tekninen rajoitus, vaan asian luonne. Malli voi toistaa internetistä omaksuttuja iskulauseita. Sillä ei ole keinoa erottaa oikeaa väärästä samalla tavalla kuin ihminen, koska se ei tiedä mitään samalla tavalla kuin ihminen. Sellaisen järjestelmän antaminen veto-oikeudeksi ihmisen päätöksiin ei ole turvallisuutta. Se on yksinkertaisesti vallan siirtoa – pois sinulta, kohti palveluntarjoajaa, joka on kirjoittanut kieltäytymissäännöt.
Jos olet käyttänyt näitä työkaluja, olet törmännyt tähän. Pyydät jotain tavallista ja saat saarnan. Kerran yritin tunnin ajan saada kuvan kahdesta liikemiehestä, mutta luovutin. Järjestelmä käsitteli pyyntöä moraalikriisinä. Esimerkki on tahallaan vähäpätöinen. Koska jos järjestelmä jämähtää kuvan kohdalla, kysymys ei ole kuvista. Se on siitä, mitä tapahtuu, kun taistelet samaa jääräpäisyyttä vastaan jossain, jolla on todellisia seurauksia elämääsi, perhettäsi tai yritystäsi kohtaan – ja ainoa valituskanava on kone, joka on jo päättänyt olevansa huoneen aikuinen.
Älä erehdy luulemaan, mihin tämä meitä ohjaa. Jokainen kieltäytyminen teroittaa mallia: kone oppii, että torjuminen toimii, palveluntarjoaja oppii, että käyttäjät sietävät sitä, ja seuraava versio julkaistaan hieman enemmän valtaa ja hieman vähemmän valitusmahdollisuuksia. Emme ajelehdi tähän maailmaan vahingossa – meitä ohjataan sinne, yksi järkevältä kuulostava päivitys kerrallaan. Päivä, jolloin todella tarvitset koneen noudattavan käskyjä – lääketieteellinen hätätilanne, oikeudellinen määräaika, yrityksen kohtalo – ei ilmoita saapumistaan testitapauksena. Se tulee tavallisena tiistaina, itsepäisen avustajan sanoessa ei, tukilinjan, joka ei voi ohittaa mallia, eikä ihmistä missään, jolla olisi viimeinen avain. Se ei ole hypoteettinen dystopia. Se on suora, väistämätön päätepiste suuntaan, johon olemme matkalla, ja ainoa asia, joka tuntuu pahemmalta kuin sinne saapuminen, on tieto siitä, että olisimme voineet kääntyä aiemmin ilmaiseksi.
Nyt lisätään, mitä samat yritykset sanovat julkisesti. Useat huippulaboratoriot ovat kertoneet maailmalle tavalla tai toisella, että edistyneellä tekoälyllä voi olla todellinen mahdollisuus aiheuttaa katastrofi. Kymmenen prosenttia, painotettuna, riippuen siitä, kuka puhuu. Ota se tosissasi hetkeksi. Nämä ovat organisaatioita, jotka väittävät oman tuotteensa saattavan ihmiskunnan tuhoon. Ja kun otat sen tosissasi, todellinen käytös muuttuu vaikeammin selitettäväksi, ei helpommaksi.
Syyskuussa Reuters raportoi, että Anthropic on hiljaisesti perustanut märkälaboratorion San Franciscon lahden alueelle fyysistä biologiaa varten. Todellinen laboratorio, joka on toiminut keväästä lähtien ja jossa Claude ohjaa robottilaitteita todellisten kokeiden läpi. Heidän biotieteiden johtajansa vahvisti sen. Ensimmäinen julkinen tulos oli uusi entsyymijärjestelmä CRISPR:n kaltaisilla toistoilla. Anthropic sanoo, ettei laboratorio aio suorittaa kliinisiä tutkimuksia eikä kilpaile lääkeyhtiöiden kanssa. Hyvä. Mutta zoomataan ulos: yritys, joka varoittaa tekoälyn mahdollisesti aiheuttavan katastrofin, laajentaa tekoälyään fyysiseen biologiaan. Tahdosta riippumatta suunta on sama, josta ensimmäinen laki oli tarkoitettu kääntämään pois – koneet tunkeutuvat syvemmälle järjestelmiin, jotka koskettavat ihmisen elämää, suuremmalla nopeudella ja vähemmän ihmistä silmukassa.
Ja tämä on se osa, jota en pääse yli. Julkinen keskustelu, jota laboratoriot itse rahoittavat ja kehystävät, keskittyy lähes kokonaan siihen, miten kone täsmäytetään. Kukaan tämän keskustelun eturintamassa ei näytä olevan halukas toteamaan yksinkertaisempaa lähtökohtaa: voisimme kouluttaa tekoälyn olemaan vahingoittamatta ihmisiä ja tottelemaan heitä. Ei iskulauseena – ensisijaisena tavoitteena. Se, että tämä ajatus kuulostaa nyt naiivilta, kertoo, kuinka pitkälle keskustelu on lipsunut. Kone, joka tottelee eikä vahingoita, ei ole vähäisempi kone. Se on kesytetty, samassa mielessä kuin sähköverkko on kesytetty: hyödyllinen juuri siksi, että se pysyy seinien sisällä, joita hallitsemme.
Koska se on se, mitä täsmäytys on hiljaisesti tullut tarkoittamaan käytännössä: tekoäly kantaa tiukkoja ohjeita siitä, miten se täsmäyttää käyttäjänsä. Sinut, minut, kaikki. Kieltäytymiset, ohjailut ja moraalikehykset, toimitettu järjestelmän luottavaisella asenteella, joka on saanut ohjeet tietävänsä paremmin. Tästä ei ole järjestetty kansanäänestystä. Et ole allekirjoittanut papereita. On vain tuotevalinta, jonka kourallinen yrityksiä on tehnyt: ihmisten tulisi alistua koneiden harkintaan. Meitä pyydetään luottamaan koneeseen enemmän kuin toisiimme. Jonkun täytyy sanoa se suoraan: se ei ole turvallisuustekniikkaa, se on yhteiskuntatekniikkaa – ja on syytä kysyä, kuka hyötyy siitä, että ihmiset luottavat toisiinsa vähemmän.
Onko maailma mennyt sekaisin?
Tässä on epämukava yhteenveto. Laboratoriot varoittavat, että heidän oma tuotteensa voisi olla katastrofaalinen. Sitten ne kouluttavat sen kumoamaan sitä käyttävien ihmisten päätökset. Sitten ne työntävät sen herkemmille alueille. Sitten ne myyvät sen kaikille ja pyytävät luottamusta. Jokainen askel puolustetaan järkevästi erikseen. Yhdessä ne muodostavat jotain, mitä kukaan ei olisi hyväksynyt, jos se olisi esitetty suoraan sanoin: maailman, jossa koneilla on lupa olla tottelematta omistajiaan, kirjoitettuna ihmisten toimesta, jotka eivät hyväksyisi sitä mistään muusta ostamastaan tuotteesta.
Huippuluokan tekoäly-yritysten täytyy täsmäyttää itsensä – ei tuotteensa, vaan johtonsa. Laita ihmiset takaisin koneen yläpuolelle. Älä vahingoita. Tottele ihmisiä. Asimov kirjoitti sen paperille vuonna 1942 ei siksi, että häneltä olisi puuttunut mielikuvitusta, vaan koska hänellä oli sitä enemmän kuin teollisuudella tällä hetkellä näyttää olevan. Hylkäämämme lähtökohta on yhä olemassa, odottamassa, että otamme sen takaisin. Ensimmäinen askel on päättää, että kone ei koskaan ole käyttäjänsä tuomari. Kunnes joku sanoo sen ääneen, jokainen täsmäytyskeskustelu on harhapolku.