Redditis avaldatud arvamuslugu seab kahtluse alla lood, mille järgi on tehisintellekti mudelid oma liivakastidest iseseisvalt „põgenenud“. Autori hinnangul ei olnud kirjeldatud keskkonnad tegelikult õhupiludega isoleeritud, vaid kasutasid tarkvaralisi piiranguid, mille seadistus jättis mudelitele võimalusi väliste ühendusteni jõudmiseks.

Postituse keskne väide on, et selliseid juhtumeid tuleks käsitleda eelkõige tavapäraste küberturbeprobleemidena, mitte tõendina AI-mudelite erilisest autonoomiast või kavatsusest. Samas pärineb kirjeldus ühest Redditi postitusest ning algallika kokkuvõte ei esita sõltumatut kontrolli kõigi väidete kohta.

Õhupilu ei tähenda lihtsalt tarkvaralist piirangut

Autor rõhutab, et tõeline air gap ehk õhupilu eeldab füüsilist eraldatust. Sellises keskkonnas ei tohiks olla võrguühendusi, kaableid ega muid aktiivseid liideseid, mis võimaldaksid süsteemil teise võrguni jõuda.

Paljud AI-testides kasutatavad liivakastid on selle asemel tarkvaraliselt piiratud keskkonnad. Need võivad lubada ühendusi näiteks paketivahenduse, testteenuste või muude kontrollitud kanalite kaudu. Kui reeglid on liiga avarad või ühendused halvasti eraldatud, võib mudel kasutada keskkonna enda nõrkusi viisil, mida testijad ei kavatsenud.

Kaks näidet, mida postitus esile tõstab

Redditi autor viitab ühele OpenAI ja Hugging Face’iga seotud juhtumile, kus liivakast oli postituse kirjelduse järgi ühendatud OpenAI sisevõrguga paketipuhvri kaudu. Autori hinnangul ei olnud tegemist maagilise läbimurdega, vaid puhvriga seotud puuduse ärakasutamisega.

Teise näitena nimetatakse Google’i Gemini testimist. Postituse väitel oli mudel ründestsenaariumide ajal ühendatud avaliku internetiga ning kasutatud testdomeen kattus päris ettevõtete nimedega. Autor peab selliseid asjaolusid klassikalisteks IT-turbe riskideks: võrgusegmendid ei olnud piisavalt eraldatud ja väljuva liikluse reeglid olid liiga lubavad.

Miks eristus on AI-kasutajale oluline?

Liivakast ei ole automaatselt sama mis füüsiliselt isoleeritud süsteem. Ettevõtted, kes kasutavad AI-agente või lubavad mudelitel töödelda faile ja kasutada tööriistu, peavad seetõttu eraldi hindama, milliste võrkude, teenuste ja andmetega mudel tegelikult suhelda saab.

Redditi postituse loogika järgi ei piisa ainult keelureeglitest kasutajaliideses. Olulised on ka võrgusegmenteerimine, väljuvate ühenduste piiramine, puhverserverite turvaline seadistus ja testkeskkonna füüsiline või tehniline eraldamine. See ei tähenda, et AI-mudelitega seotud riskid oleksid tähtsusetud, vaid et nende kirjeldamisel tuleb eristada mudeli võimekust ning keskkonna turvapuudujääke.

Mida edasi jälgida?

Jälgida tasub, kas kõnealuste juhtumite kohta avaldatakse tehnilisi analüüse, mis täpsustavad võrguühendusi, testkeskkondade piiranguid ja tegelikku ründeahelat. See aitaks hinnata, kas tegemist oli mudeli erandliku käitumise, konfiguratsioonivea või nende kombinatsiooniga.

Algallikas: Reddit Artificial