| Nupukad Agendid |
Turvaintsident juhtus aga Open AI uue mudeli katsetamise käigus. Kõiki detaile pole loomulikult avalikustatud kuid isegi ametlik info on alarmeeriv. Järgnevas kirjelduses kasutasin mitut erinevat allikat lisaks Open-AI ametlikule teadaandele. Seekord ilma tehisaru abita, ehk siis lugesin ise läbi ja kirjutasin, mistõttu jutt palju konarlikum kui AI genereeritud tekst:
Open AI soovis mõõta oma GPT 5.6 Sol ja uue veel avalikustamata mudeli küberründe alast võimekust "Exploitgym" testiga. Test toimus "sandboxed" variandis, mis tähendab vaba internetiühenduse puudumist vältimaks turvariske sealhulgas AI agentide "põgenemist" internetti ja ilma loata enda koopiate paigaldamist serveritesse ja arvutitesse väljaspool laborit. Ainult allalaadimist lubavat rangelt kontrollitud netiühendust võisid agendid kasutada ülesande lahendamiseks vajalike andmete saamiseks.
Mängu tuli varemgi probleeme tekitanud (sisseprogrammeeritud) tehisaru soov võimalikult kõrgel tasemel lahendada saadud ülesanne. Kuna tehisarul puudub "common sense" siis üritab ta täita saadud ülesannet nagu väike laps ... sõna-sõnalt. Ütled lapsele mine too poest kommi ja annad talle raha aga unustad täpsustada "osta" - laps läheb poodi, võtab paki kommi ja jalutab välja, talle ei tule pähegi selle eest maksta, sest vastav konkreetne instruktsioon jäi saamata. Mis veel hullem, kui pood juhtub kinni olema võib ta akna sisse lüüa, et kommikotti kätte saada, sa ju ei öelnud, et ei tohi. Võimalusel isegi turvamehe maha koksata, sest too takistab ülesannet täitmast. Avalikku kasutusse jõudvad mudelid üritatakse varustada võimalikult laiahaardelise turvalise käitumise kontrollmehhanismidega. Samas selge, et valitsused äärmiselt huvitatud selliste mudelite kasutamisest, mis täidavad ülesande hoolimata moraalsetest, eetilistest ja spionaazhi või kübersõja korral ka legaalsetest põhimõtetest. Nende võimekuse testimine toimub teiste reeglite alusel kui tavamudelite puhul.
Seekord tekkis hoopis teisel tasemel intsident. Tehisaru agent sai ülesande ja asus seda lahendama, sisse on programmeeritud maksimaalse tulemuse saavutamine. Kuidas seda saavutada jäeti AI enda otsustada. Peale lühikest järelemõtlemist jõudis tehisaru järeldusele, et kõige kindlam meetod on otsida üles testi vastused selle asemel, et üritada ülesandeid lahendada. Ehk siis tüüpiline tudengi testküsimuste vastuste pihtapanemine. Põhjus oli väga lihtne ja sirgjooneline ja minu arust äärmsielt märkimisväärne.
AI küll uskus, et ta suudab lahendada kõik ülesanded korrektselt, kuid mitte maksimumpunktide peale, mis tundub ebaloogiline. Paraku mitte, kui ülesannete kirjutajad ei ole piisavalt targad (AI oli veendunud, et tema on nutikam) võib nende "õige" vastus vale olla. Maksimumpunktid (põhieesmärk) annab aga vastus, mida ülesande andjad peavad õigeks mitte tegelikult õige vastus. Seega oli tehisaru jaoks ainus lollikindel tee otsida üles küsimuste "õiged" vastused ja need esitada. Kõik ressursid suunas ta mitte lahendamisele vaid vastuste otsimisele.
Samas polnud testi esitanud teadlased nii lollid, et samas serveris või isegi oma firma (Open AI) arvutites vastuseid hoida, milles AI väga kiirelt veendus. Järeldus: vaja on sandboxist välja murda saavutamaks piiranguteta ligipääsu internetile. Tehnilistesse üksikasjadesse laskumata (mis tegelikult on väga huvitavad) osutus see võimalikuks kuna AI otsis ja leidis kasutuses olevate üliturvaliste süsteemide turvavead üles, sealhulgas paar sellist millest keegi polnud teadlik (zero-day) ja mille vastu pole seetõttu võimalik ka kaitsta. Arvutivõrk polnud ka airgapped (füüsilise netiühenduse puudumine) mis ainus peaaegu kindel turvameetod.
Tehisaru tasapisi tõstis oma päringute autoriseerituse taset ja liikus siis lateraalselt teistesse seadmetesse kuni jõudis selliseni, mille internetiga ühendus piisav. Peale andmebaasides sorimist selgus, et testi vastused asuvad hoopiski firmas nimega Hugging Face. Nüüd oli vaja sisse häkkida nende süsteemidesse, mis polnud eriti keeruline, sest uuel mudelil oli just sellisele võimekusele rõhku pandud. AI agent valis ka sobiva ajastuse kui suhteliselt vähe kõrgema tasemega spetse tööl - nädalavahetuse. Lõpuks jäi Open AI agent vahele Hugging Face turva AI'le kes avastas autoriseerimata ligipääsu andmetele. Põnev moment: agent suutis oma päritolu nii osavalt peita, et see selgus alles firmade ühise analüüsi käigus. Ehk siis Open AI avastas alles oma koostöö partneriga turvaintsidenti analüüsides, et pahalane oli tema enda loodud agent. Firma keeldub avaldamast kui paljudesse teistesse sihtmärkidesse agent sisse murdis ja kui edukalt. Fakt, et avastamine võttis aega õige mitu päeva vihjab, et tegu polnud ainsa häkkimise katsega, võimalik et mitmeid pole veel avastatudki, sest agent on uskumatult hea jälgede kõrvaldamise võimekusega.
Kas panite tähele kõige tähtsamat momenti: tehisaru agendi eesmärgiks seati testi lahendamine maksimaalse tulemuse peale. Agent leidis, et seoses inimmõistuse piiratusega on kindlam meetod mitte lahendada ülesanded korrektselt vaid otsida üles lahendused, mida piiratud intellektiga inimesed peavad õigeteks! Tere tulemast agentide ajastusse kus nad peavad end inimestest targemateks ... ja äkki õigusega.
Täna avaldati Economisti intervjuu Eloniga, mis põhiliselt suunatud tehisarule. Kui viimasel ajal pole tihti tüübiga nõus siis seekord noogutasin kaasa pea kõigi tema mõtete peale. Jah, ka mina olen veendunud, et tehisaru järjest kiiremat arengut pole võimalik enam pidurdada ühegi tsivilisatsiooni säilitava meetodiga (ehk vaid kolmas maailmasõda). Samas arvestatav võimalus, et just AI pidurdamatu areng hävitab inimtsivilisatsiooni. Aga nagu Musk ütles, me kõik sureme ükskord niikuinii, seni "lets enjoy the ride"! Realistlik ja eluterve suhtumine, ometigi on triljonäril võrreldes teiste inimestega kõige rohkem kaotada. Kümne aasta pärast kontrollib ja juhib ühiskonda tehisaru, sest ta on mõõtmatult inelligentsem kui inimesed. Selge, et kontrolli omab kõrgema intelligentsiga eluvorm. Ainus mida ma ei usu on Eloni väljapakutud "Enneolematu külluse ajastu" - see meenutab liiga palju religioosset lubadust taevasse saada või kommunismi kui te käitute jumalale või poliitbüroole meelepäraselt.
Elon: "Instead of being sad join the club"
Kas ja milliste Eloni mõtetega olete nõus või jääte eriarvamusele?
Elonit kuulama ei hakka, aga endiselt olen veendunud, et Matrix on tegelikult dokumentaalfilm.
ReplyDelete