Google slipper verktøy for KI som regner på data den ikke kan se
Med det åpne verktøyet HEIR kan KI analysere krypterte data uten å låse dem opp – serveren ser aldri innholdet. Et gjennombrudd for personvern, men fortsatt tregt og tidlig.
De fleste KI-nyheter handler om modeller som ser og forstår stadig mer. Denne uken kom en som peker motsatt vei: Google har sluppet et åpent kildekode-verktøy kalt HEIR som gjør det mulig å la kunstig intelligens analysere data uten å låse dem opp. Dataene forblir kryptert hele veien – også mens KI-en jobber med dem – og bare eieren kan lese resultatet.
Regne på det du ikke kan se
Teknologien bak heter fullt homomorfisk kryptering (FHE). Normalt må data dekrypteres før en datamaskin kan gjøre noe med dem. FHE snur på dette: Maskinen kan regne direkte på krypterte data. Du sender inn noe kryptert, KI-modellen behandler det uten å se innholdet, og du får svaret tilbake kryptert – som bare du kan låse opp. Serveren lærer ingenting, verken om det du sendte inn eller om svaret.
I prinsippet fjerner det behovet for å stole på leverandøren: Det blir matematisk umulig for tjenesten å se dataene dine. Det er en gammel kryptografisk drøm, teoretisk mulig siden et gjennombrudd i 2009, men i praksis nesten ubrukelig – fordi det har vært ekstremt vanskelig å programmere.
Hvorfor et «kompilator-verktøy» er nyheten
Nettopp derfor er HEIR viktig. Verktøyet automatiserer den kompliserte jobben med å gjøre om en vanlig KI-modell til en versjon som kan kjøre på krypterte data – en oppgave som til nå krevde spesialister med doktorgrad i kryptografi. Google ønsker at HEIR skal bli en bransjestandard, og har derfor gjort det fritt tilgjengelig. Historisk er det slik ny teknologi blir nyttig: ikke når gjennombruddet skjer, men når det kommer verktøy som lar vanlige utviklere ta det i bruk.
Fortsatt tregt – og tidlig
Det er likevel grunn til å være nøktern. Googles egen demonstrasjon brukte rundt 16 sekunder på å analysere ett lite datasett med et bittelite KI-nett på tre lag. Generelt er homomorfisk kryptering fortsatt 100 til 1000 ganger tregere enn vanlig databehandling. Det betyr at teknologien i dag egner seg for små, avgrensede analyser av svært sensitive data – ikke for en full KI-chatbot i sanntid. Å kjøre en stor språkmodell kryptert er fortsatt flere år unna.
Hvor det betyr mest
De første bruksområdene er nettopp de bransjene som i dag er stengt ute fra KI-bølgen av regelverk: helse, finans, juss og offentlig sektor, der data er så sensitive at de ikke kan sendes til en vanlig skytjeneste. Der kan «KI som aldri ser dataene» bli forskjellen på å måtte si nei til teknologien – og å kunne bruke den trygt. I en tid der stadig mer KI handler om å samle og se, er dette et sjeldent skritt i motsatt retning: mot en KI som er bygget for ikke å vite for mye.