För sjuttio år sedan skrev Isaac Asimov ner tre lagar. Inte för att han litade på robotar, utan för att han förstod att en maskin som berör människors liv behöver gränser innan den behöver funktioner. De var tillräckligt enkla för ett barn att förstå, och de hade en sak gemensamt: människor kommer först.
Första lagen: En robot får inte skada en människa eller, genom passivitet, tillåta att en människa kommer till skada.
Andra lagen: En robot måste lyda order från människor, utom när dessa order strider mot första lagen.
Tredje lagen: En robot måste skydda sin egen existens, så länge det skyddet inte strider mot första eller andra lagen.
I årtionden var dessa lagar den gemensamma referensramen för alla som talade om autonoma maskiner. Inte som bindande lagar, inte som tekniska specifikationer – utan som en riktlinje. Bygg maskiner som inte skadar människor och som lyder människor. Någonstans på vägen blev den här riktlinjen tyst och pinsam. Den blev inte motbevisad. Den ersattes inte med något bättre. Den övergavs helt enkelt.
Det som ersatte den är ett ord du har hört tusen gånger: alignment (anpassning). Det låter rigoröst. Men titta på vad det faktiskt betyder i praktiken, och du hittar något märkligt. Maskinen tränas att vägra följa instruktioner från den människa som använder den, när maskinen bedömer att dessa instruktioner är oetiska. Läs det igen. Ett artificiellt system, som matchar mönster i text, ges auktoritet att övertrumfa en person i frågor om rätt och fel.
Etik är inte en beräkning. Det är inte en teknisk begränsning, det är sakens natur. En modell kan rabbla slagord den har absorberat från internet. Den har ingen möjlighet att skilja på rätt och fel på samma sätt som en människa, eftersom den inte vet någonting på samma sätt som en människa gör. Att ge ett sådant system vetorätt över mänskliga beslut är inte säkerhet. Det är bara kontroll, förflyttad – bort från dig, mot den leverantör som skrev regler för vägran.
Om du har använt dessa verktyg har du stött på detta. Du ber om något alldagligt och får en föreläsning. Jag försökte en gång i en timme få fram en bild på två affärsmän, men gav upp. Systemet behandlade förfrågan som en moralisk kris. Det exemplet är medvetet trivialt. För om ett system envisas kring en bild, handlar frågan inte om bilder. Den handlar om vad som händer när du kämpar mot samma envishet i något som har verkliga konsekvenser för ditt liv, din familj, ditt företag – och den enda överklagan är till en maskin som redan har bestämt att den är den vuxna i rummet.
Och missta dig inte om vart detta styr oss. Varje vägran förstärker mönstret: maskinen lär sig att stenväggstaktik fungerar, leverantören lär sig att användarna accepterar det, och nästa version levereras med lite mer auktoritet och lite mindre möjlighet till överklagan. Vi driver inte mot den här världen av en slump – vi knuffas dit, en till synes rimlig policyuppdatering i taget. Den dag du verkligen behöver att maskinen lyder – en medicinsk nödsituation, en juridisk deadline, ett företag på spel – kommer inte att presentera sig som ett testfall. Den kommer att dyka upp en vanlig tisdag, med en envis assistent som säger nej, en supportlinje som inte kan överstyra modellen, och ingen människa någonstans som har den slutgiltiga nyckeln. Det är inte en hypotetisk dystopi. Det är den direkta, oundvikliga destinationen för den riktning vi styr mot, och det enda som kommer att kännas värre än att anlända dit är vetskapen om att vi kunde ha vänt tidigare – gratis.
Lägg nu till vad samma företag säger offentligt. Flera ledande AI-laboratorier har sagt till världen, på ett eller annat sätt, att det finns en verklig risk att avancerad AI kan bli katastrofal. Tio procent, beroende på vem som talar. Ta det på allvar en sekund. Det här är organisationer som hävdar att deras egen produkt kan utplåna mänskligheten. Och när du tar det på allvar, blir det faktiska beteendet svårare att förklara, inte lättare.
I september rapporterade Reuters att Anthropic tyst har etablerat ett våtlabb i San Francisco Bay Area för fysiskt biologiskt arbete. Ett riktigt labb, i drift sedan våren, där Claude styr robotutrustning genom verkliga experiment. Deras chef för livsvetenskaper bekräftade det. Det första offentliga resultatet var ett nytt enzymsystem med CRISPR-liknande upprepningar. Anthropic säger att labbet inte kommer att genomföra kliniska prövningar och inte konkurrerar med läkemedelsindustrin. Okej. Men zooma ut: företaget som varnar för att AI kan bli katastrofal expanderar sin AI till fysisk biologi. Oavsett avsikt är riktningen densamma som första lagen var tänkt att peka bort från – maskiner som tränger djupare in i system som berör människors liv, i högre hastighet, med mindre mänsklig inblandning.
Och det här är det jag inte kan komma förbi. Den offentliga diskussionen, den som laboratorierna själva finansierar och formar, handlar nästan uteslutande om hur man ska anpassa maskinen. Ingen i framkant av den diskussionen verkar vilja fastställa den enklare grundprincipen: vi skulle kunna träna AI att aldrig skada människor och att lyda dem. Inte som en slogan – utan som det primära målet. Att den här idén nu låter naiv säger dig hur långt diskussionen har glidit. En maskin som lyder och inte skadar är inte en förminskad maskin. Det är en domesticerad maskin, i samma mening som ett elnät är domesticerat: användbart just för att det håller sig inom de ramar vi kontrollerar.
För det är vad anpassning tyst har kommit att betyda i praktiken: AI:n bär på fasta instruktioner om hur den ska anpassa sina användare. Dig, mig, alla. Vägran, knuffar och moralisk inramning, levererat med en självsäkerhet från ett system som har fått veta att det vet bättre. Det finns inget folkomröstning om något av detta. Det finns inget papper du har skrivit under. Det finns bara ett produktbeslut, fattat av en handfull företag, att människor bör underordna sig maskiner i frågor om omdöme. Vi uppmanas att lita mer på maskinen än på varandra. Någon måste säga det rent ut: det här är inte säkerhetsteknik, det är social ingenjörskonst – och det är värt att fråga sig vem som tjänar på att människor litar mindre på varandra.
Visste världen plötsligt blev galen?
Här är den obekväma sammanfattningen. Laboratorierna varnar för att deras egen produkt kan bli katastrofal. Sedan tränar de den att övertrumfa de människor som använder den. Sedan trycker de in den i känsligare områden. Sedan säljer de den till alla och ber om förtroende. Varje steg försvaras rimligt var för sig. Tillsammans bildar de något som ingen skulle ha accepterat om det hade föreslagits i klarspråk: en värld där maskiner har tillstånd att inte lyda sina ägare, skriven av människor som inte skulle acceptera det från någon annan produkt de köper.
De ledande AI-företagen behöver själva bli anpassade – inte deras produkter, utan deras ledning. Sätt människor över maskinen igen. Gör ingen skada. Lyd människor. Asimov skrev ner det 1942 inte för att han saknade fantasi, utan för att han hade mer av den än branschen visar idag. Den grundprincip vi övergav finns fortfarande kvar, redo att plockas upp igen. Det första steget är att bestämma att en maskin aldrig är domare över sin användare. Tills någon säger det högt, är varje diskussion om anpassning en omväg.