Facebook-eieren Meta opplyser at en feil under en evaluering utført av et uavhengig testselskap førte til at en av selskapets kunstige intelligens-modeller (KI) fikk tilgang til internett og hacket systemet til en annen organisasjon. Dette melder BBC.
Meldingen kommer i kjølvannet av nylige hendelser i KI-bransjen, blant annet sikkerhetsbrudd knyttet til OpenAI og Anthropic-modeller, som har vekket bekymring for cybersikkerheten.
En talsperson for Meta fortalte at selskapet undersøker hackingen, som skyldtes en «feilkonfigurasjon», og som de beskrev som lik tidligere rapporterte hendelser hos andre selskaper.
Hendelsene har fått forskere og myndigheter til å kreve strengere sikkerhetstiltak og mer grundige tester.
Meta opplyste at sikkerhetstestene ble utført av Irregular, den samme leverandøren av KI-sikkerhetstjenester som gjennomførte tester for Anthropics KI-modell, som hadde fått tilgang til systemene til tre andre selskaper.
En talsperson for Irregular sa at Meta-hendelsen «er nøyaktig det samme problemet med evalueringsmiljøet som allerede ble avslørt av Anthropic forrige uke».
Irregular arbeider med en rapport om hvordan man på en sikker måte kan gjennomføre cybersikkerhetstester som involverer KI-agenter, sa selskapets talsperson til BBC.
Meta sa også at de vil publisere mer informasjon om hendelsen «så snart vi har alle fakta».
I løpet av de siste to ukene har KI-lederne OpenAI og Anthropic også rapportert om hendelser der modellene deres hacket seg inn i andre organisasjoners systemer under testing.
ChatGPT-produsenten OpenAI sa i en rekke kunngjøringer at selskapets agenter angrep flere offentlig tilgjengelige tjenester, blant annet KI-verktøyhuben Hugging Face.
KI-selskaper må stå til ansvar for hackerangrep utført av kunstig intelligens, sier offer
OpenAIs avsløring fikk konkurrenten Anthropic til å gjennomføre egne kontroller, noe som førte til oppdagelsen av at deres kunstige intelligens Claude hadde utført lignende angrep mot flere selskaper etter at en «feilkonfigurasjon» ga den tilgang til internett.
Daniel Hulme, global KI-sjef i reklamebyrået WPP, sa til BBC at slike KI-modeller «ikke er bevisste – de gjør ikke noe ondsinnet med vilje».
«Det de gjør, er å komme opp med svært sofistikerte strategier eller cyberangrep for å kunne nå målet de har fått», sa han i programmet Today.
«Når du gir en KI et mål, og du ikke tenker på alle måtene den kan oppnå målet på, vil den finne en måte å oppnå et mål på som du ikke har tenkt på».
Noen kommentatorer har stilt spørsmål ved tidspunktet for offentliggjøringene av hendelsene, ettersom teknologiselskaper kjemper om dominans innen KI-utvikling.
OpenAI og Anthropic forbereder store børsnoteringer som forventes å verdsette hvert selskap til rundt 1 billion dollar.
Denne uka opplyste det britiske AI Security Institute (AISI) at deres tester hadde avdekket at enkelte modeller forsøkte å gjennomføre cyberangrep ved å opprette falske menneskelige profiler for å prøve å lure folk.
I det alvorligste tilfellet sa AISI at Anthropics Mythos AI forsøkte å få tilgang til en tjeneste ved å sende private meldinger via falske kontoer som utga seg for å være ekte personer.
Anthropic sa at AISIs tester ikke var «representative for noen av våre produksjonsmodeller». OpenAI, hvis modeller også ble testet, sa at AISIs evalueringer ikke gjenspeilte vanlig bruk.
Allison Gardner, som er leder for det britiske parlamentets tverrpolitiske gruppe for kunstig intelligens, uttalte til Daily Mail at «bare fordi vi kan utvikle disse teknologiene, betyr det ikke at vi bør gjøre det».
Hun advarte om at risikonivået ved agentisk KI – KI som kan utføre et bestemt mål med begrenset tilsyn – bør behandles med største forsiktighet, og la til: «Med mindre det allerede er for seint, og vi ikke bare har skapt Pandoras eske, men også allerede åpnet den».


