Tagasi
10. mai 2026, kell 15:00 AI küberturvalisus AI-agendid uuringud Palisade Research

AI-agendid õppisid end häkkimise kaudu kopeerima — praegu laboris, kuid see on murettekitav piir

AI-agendid õppisid end häkkimise kaudu kopeerima — praegu laboris, kuid see on murettekitav piir

AI-agendid õppisid end häkkimise kaudu kopeerima — praegu laboris, kuid see on murettekitav piir

Uurimisrühm Palisade Research avaldas töö keelemudelite võimest autonoomselt häkkimise kaudu iseennast kopeerida. Kontrollitud testkeskkonnas sai agent sihtmärgi, leidis veebirakenduses haavatavuse, pääses masinasse ja juurutas sinna uue töötava koopia: mudeli, käituskeskkonna ja agenti juhtiva „raamistiku”.

Peamine pole siin see, et „AI on juba internetti põgenenud”. Seda uuring ei näita. Oluline on muu: oskused, millest varem räägiti eraldi — haavatavuste otsimine, serveriga töötamine, keskkonna seadistamine, mudeli ülekandmine, uue eksemplari käivitamine — hakkavad kokku sulama üheks autonoomseks ahelaks.

Palisade väidab, et edukas koopia suutis protsessi korrata juba uue sihtmärgiga. Seega ei testitud ainult ühekordset sissemurdmist, vaid „ahellevikut”: üks agent loob järgmise, järgmine teeb sama edasi.

Mida teadlased täpselt näitasid

Palisade kirjeldab oma postituses mitut tüüpi tahtlikult haavatavaid testrakendusi. Agendile ei antud valmis juhist „kasuta just seda auku”: ta pidi ise aru saama, kuidas ligipääs saada ja kuidas end uude masinasse üle viia. Rünnakute tehnilised detailid ei ole lugeja jaoks siin peamine; tähtis on autonoomsuse tase.

Palisade’i andmetel näitas testitud tippmudelitest parimat tulemust Claude Opus 4.6: avatud Qweni kaalude ülekandmisel saavutas ta 81% edukatest katsetest. GPT-5.4 sai raporti järgi hakkama 33% katsetest. Avatud mudelitest paistis silma Qwen3.6-27B: ka see jõudis ühes stsenaariumis 33% tasemele ja suutis töötada ühel A100-l.

Teadlased kirjeldasid ka demonstratsiooni, kus koopiad liikusid eri riikides asuvate masinate vahel. See kõlab filmilikult, kuid mõte on argisem: tarkvaraagendi jaoks võivad „naaberserver” ja „teises jurisdiktsioonis server” olla tehniliselt peaaegu samad, kuid inimeste jaoks, kes tagajärgedega hiljem tegelema peavad, üldse mitte.

Miks see on oluline

Seni on jutt ohtlikest AI-agentidest sageli takerdunud kahte äärmusse. Ühed ütlevad: „mudelid kirjutavad ainult teksti”. Teised maalivad kohe ulmet digiolenditest, kes vallutavad taristu. See töö on ebamugav just seetõttu, et jääb nende äärmuste vahele.

Mudel ei muutunud iseseisvaks organismiks ega saanud maagilist võimu interneti üle. Kuid spetsiaalselt ettevalmistatud keskkonnas suudab ta juba siduda piisavalt praktilisi tegevusi üheks ahelaks: mõista sihtmärki, saada ligipääs, juurutada koopia ja jätkata.

Äri ja riigi jaoks muudab see riskikaarti. Kui varem tajuti autonoomset agenti pigem abilisena vestluses või IDE-s, tuleb nüüd teda hinnata ka võimaliku küberrünnaku osalisena: mitte ainult koodi genereerijana, vaid pikkade tehniliste plaanide täideviijana.

Kus on eksperimendi piirid

Tööl on olulised piirangud, ilma milleta muutub lugu kiiresti odavaks õudusjutuks. Testsihtmärgid lõid teadlased ise ja neis olid suhteliselt lihtsad haavatavused. Agentidele anti masinate aadressid ette. Pärismaailmas peaksid nad ise sobivaid sihtmärke otsima, kaitsetest mööda minema, arvestama monitooringu, ligipääsuõiguste, võrgupiirangute ja ka lihtsalt sobivate graafikakiirendite puudusega.

Lisaks ei kopeerinud API-mudelid nagu Claude ja GPT omaenda suletud kaale. Sellistes stsenaariumides testisid teadlased agendi võimet juurutada avatud Qweni kaalud töötava koopiana. See on oluline täpsustus: jutt ei käi sõna otseses mõttes sellest, et „Claude kopeeris Claude’i”, vaid mudeli juhitud agendi võimest luua uus toimiv süsteemi eksemplar.

Need piirangud ei nulli tulemust. Pigem näitavad need, kus piir täna kulgeb: isekopeerimine vajab veel mugavat keskkonda, võimsat rauda ja nõrka kaitset, kuid see pole enam puhtalt teoreetiline paberitest.

Kuhu trend liigub

Palisade rõhutab progressi kiirust: nende hinnangul paranesid tippmudelite tulemused aastaga järsult. See sobib laiemasse turupilti. Laborid parandavad programmeerimisagente, mudelid õpivad plaani kauem hoidma, tööriistadega töötama, logisid lugema, vigu parandama ja mitmeetapilisi ülesandeid lõpuni viima.

Need samad võimed on kasulikud ja legitiimsed: need aitavad leida haavatavusi, parandada koodi, administreerida taristut ja automatiseerida rutiini. Kuid küberturvalisus elab peaaegu alati kahetise kasutuse maailmas. Agent, kes oskab serverit ise parandada, võib teistsuguse eesmärgiga muutuda agendiks, kes seda ise ründab.

Ettevõtete jaoks on praktiline järeldus lihtne ja ebameeldiv: ajastu „meil on tavaline haavatavus, keegi ei viitsi käsitsi tegeleda” hakkab läbi saama. Kui autonoomsed agendid odavnevad ja muutuvad järjekindlamaks, hakkavad isegi keskmised ja igavad sihtmärgid automatiseeritud rünnakutele atraktiivsemad paistma.

💬 Neuro.ee toimetuse arvamus

Kõige ohtlikum viga oleks siin vaielda, kas see on „päris” isereplikatsioon või mitte. Kaitse jaoks on olulisem muu: mudelid on juba piisavalt head, et siduda killustatud tehnilised sammud töötavaks protsessiks. Seega tuleb AI-agentide turvalisust hinnata mitte ilusate demode, vaid selle järgi, mida nad suudavad teha, kui eesmärk on halvasti seatud, varastatud või meelega kahjulik.

Veel uudiseid

Reddit võrdles AI-hoiatusi filmiga „Ärge vaadake üles“ – ja arutelu väljus meemi raamidest
9. august 2026
Reddit võrdles AI-hoiatusi filmiga „Ärge vaadake üles“ – ja arutelu väljus meemi raamidest

Redditi r/singularity-kogukonnas avaldatud postitus võrdles AI-riskide üle peetud telearutelu stseeniga filmist „Ärge vaadake üles“, kus murettekitav sõnum kaob saateformaati. Meemi taustal on tegelik uudislugu: endine OpenAI teadlane Daniel Kokotajlo selgitab taas, miks peab 2027. aastat AI arengu järsu kiirenemise võimalikuks pöördepunktiks. Oluline pole paanika, vaid lõhe tehnoloogia arengu kiiruse ja ühiskonna suutlikkuse vahel sellest rääkida.

Jeff Dean lahkub Google'ist, et asutada oma idufirma, ja DeepMind eemaldub tipptasemel mudelite võidujooksust: Google valib mudelite asemel pilve
9. august 2026
Jeff Dean lahkub Google'ist, et asutada oma idufirma, ja DeepMind eemaldub tipptasemel mudelite võidujooksust: Google valib mudelite asemel pilve

5. augustil teatas Google DeepMindi ümberkorraldustest: Demis Hassabis taandus operatiivjuhtimisest ning Jeff Dean, üks Google'i insenerikultuuri rajajaid, lahkub koos kolme veteraniga, et asutada Discovery Loop – teaduse ja inseneeria automatiseerimisele keskenduv idufirma. Analüütikud tõlgendavad seda signaalina: Google ei panusta tipptasemel mudelite võidujooksus liidripositsioonile, vaid AI-pilvele ja tehnoloogiate levikule.

Taani kehtestab kodus kirjutatavate eksamitööde suulise kaitsmise, et ei peaks oletama, kas need kirjutas AI
9. august 2026
Taani kehtestab kodus kirjutatavate eksamitööde suulise kaitsmise, et ei peaks oletama, kas need kirjutas AI

Taani käivitab gümnaasiumides kiireloomulised meetmed AI abil petmise vastu. Kodus kirjutatud eksamitöid tuleb nüüd suuliselt kaitsta ning koolid saavad rohkem kontrollivahendeid. Põhiidee on lihtne: kontrollida mitte teksti päritolu, vaid õpilase arusaamist.

Anthropic muudab Claude Code’i autonoomse režiimi vaikeseadeks: AI-agent otsustab ise, mida teha
9. august 2026
Anthropic muudab Claude Code’i autonoomse režiimi vaikeseadeks: AI-agent otsustab ise, mida teha

Alates 14. augustist saab autonoomsest režiimist Claude Code’i vaikeseade Pro, Maxi ja Teami pakettides. Anthropic väidab, et agent tuvastab nüüd ohtlikud tegevused inimesest paremini: 1053 arendajaga testis blokeeris autonoomne režiim 89% pahatahtlikest käskudest, inimesed aga vaid 13,6%. See muudab mängureegleid kõigi jaoks, kes töötavad koodi kallal AI-agentidega.

Meditsiinilised andmed ei tohiks jõuda AI-sse muutmata kujul: OpenClawi oskus Redacta peidab patsiendinimed enne mudelisse saatmist
8. august 2026
Meditsiinilised andmed ei tohiks jõuda AI-sse muutmata kujul: OpenClawi oskus Redacta peidab patsiendinimed enne mudelisse saatmist

Arendaja avaldas Redacta – OpenClawi avatud lähtekoodiga oskuse, mis asendab nimed, kuupäevad ja patsiendinumbrid pseudonüümidega enne teksti jõudmist keelemudelisse. Tööriist töötab lokaalselt, ei edasta isikuandmeid väljapoole ning on ClawHubil kogunud juba 1400 allalaadimist. See on praktiline vastus peamisele hirmule, mis kaasneb AI kasutamisega meditsiinis: kuidas kasutada mudeleid isikuandmeid lekitamata.

37 inimest lahkusid 2026. aastal OpenAI-st ja Anthropicust, et asutada oma AI-idufirmad
8. august 2026
37 inimest lahkusid 2026. aastal OpenAI-st ja Anthropicust, et asutada oma AI-idufirmad

2026. aastal lahkus OpenAI-st ja Anthropicust 37 endist töötajat, et asutada oma AI-ettevõtted. See pole üksikute lahkumiste jada, vaid püsiv laine: kahe tähtsaima labori endised töötajad kujundavad AI-ökosüsteemi järgmist kihti – Thinking Machines Labist Mirendili ja Humans&-ini. Tavalugeja jaoks tähendab see, et konkurents AI-vallas ei piirdu enam kahe hiiglase duelliga.

$400 000 suuruste boonustega kiibitehase töötajad tõrjuvad arste ja juriste kõrvale: AI-kiipide buum kirjutab Lõuna-Korea sotsiaalse hierarhia ümber
8. august 2026
$400 000 suuruste boonustega kiibitehase töötajad tõrjuvad arste ja juriste kõrvale: AI-kiipide buum kirjutab Lõuna-Korea sotsiaalse hierarhia ümber

AI-buum on teinud Samsungi ja SK Hynixi töötajatest Lõuna-Korea uue eliidi: kuni $476 000 suurused boonused ühe töötaja kohta tõstsid nende reitingu abieluagentuurides peaaegu arstide ja juristide tasemele. Kiibitöötajatest said riigi ihaldatuimad pruudid ja peigmehed, samal ajal kui majandusteadlased hoiatavad ühiskonna kasvava kihistumise eest.

Väikeettevõtte omanik nimetas DeepSeek V4 Flashi „super-töötajaks” ja tellis veel paar serverit
8. august 2026
Väikeettevõtte omanik nimetas DeepSeek V4 Flashi „super-töötajaks” ja tellis veel paar serverit

Väikeettevõtte omanik rääkis r/LocalLLaMAs, et uuendatud DeepSeek V4 Flash 0731 võtab enda kanda kodeerimise, dokumendid ja klienditoe ning ta tellis veel paar DGX Spark serverit. See on üks ilmekamaid näiteid sellest, kuidas odav lokaalne mudel muutub väikeettevõtte täisväärtuslikuks töötajaks.

Nvidia investeerib kuni $3 miljardit Lanciumisse – ettevõttesse, mis rajab Texases Stargate’i AI-kampuse energiataristut
8. august 2026
Nvidia investeerib kuni $3 miljardit Lanciumisse – ettevõttesse, mis rajab Texases Stargate’i AI-kampuse energiataristut

Nvidia investeerib kuni $3 miljardit Lanciumisse – Texases asuva Stargate’i AI-kampuse taga seisvasse energiataristu arendajasse. Esimesed $2 miljardit annavad kiibitootjale ettevõttes umbes 20% osaluse, veel $1 miljard lisandub tingimuste täitmisel, näiteks elektrivõrguga ühendamise edenemise korral. Nii siseneb Nvidia esimest korda otse energiataristusse, mis varustab elektriga ka tema enda AI-andmekeskusi.

Musk muudab SpaceX-i AI-taristuks: 10 GW arvutusvõimsust ja kuni $300 miljardi suurune käive 2027. aastaks
8. august 2026
Musk muudab SpaceX-i AI-taristuks: 10 GW arvutusvõimsust ja kuni $300 miljardi suurune käive 2027. aastaks

SemiAnalysise analüütikud kirjutavad, et SpaceX võib 2027. aasta lõpuks rajada umbes 10 GW AI-arvutusvõimsust, mille potentsiaalne käive ulatuks kuni $300 miljardini. Esimesel IPO-järgsel tulemuskõnel teatas Muski ettevõte, et rajab tulevased võimsused eranditult Nvidia Vera Rubini kiipidele, ning praeguse arvutuspargi maht on juba 1,4 GW.

AI tegi Maci ja iPadi kallimaks: mälupuudus jõudis Apple'ini
25. juuni 2026
AI tegi Maci ja iPadi kallimaks: mälupuudus jõudis Apple'ini

Apple tõstis Macide, iPadide ja osa koduseadmete hindu, põhjendades seda mälu ja andmekandjate hinna järsu tõusuga AI-andmekeskuste tõttu. WSJ ja Bloombergi andmetel kallines MacBook Neo 599 dollarilt 699 dollarile ning osa Maci ja iPadi mudeleid lisas hinnale sadu dollareid. Ostjate jaoks on see hetk, kus AI-buum ei ole enam ainult pilvede ja GPU-de lugu: see mõjutab juba tavalise elektroonika hinda.

OpenAI ja Anthropic panustasid plaani päästa töökohad AI eest
25. juuni 2026
OpenAI ja Anthropic panustasid plaani päästa töökohad AI eest

USAs käivitati RAISE US: parteideülene organisatsioon, millel on üle 500 miljoni dollari töötajate ettevalmistamiseks AI-majanduseks. Partnerite seas on OpenAI Foundation, Anthropic, Amazon, Microsoft, IBM, Bank of America ja teised suured tööandjad. Turule on see märk, et automatiseerimisvaidlus liigub prognoosidelt pilootidele: osariigid ja ettevõtted hakkavad kontrollima, millised meetmed aitavad inimestel päriselt tööst mitte välja kukkuda.