-
USA åpner for luftvernsalg til Ukraina
-
Grønland-avtale klar
-
Trump nekter CNN, MSNOW og Politico tilgang til Det hvite hus
-
Frankrike kaller inn G7 til energimøte
-
- Oljefondet kan ikke opprettholde velferdsstaten
-
Buffett-sønnen overtar styrelederrollen
-
FN: 171 år unna perfekt likestilling
-
Regjeringen varsler stort EØS-skifte
-
De vanligste feilene nye CFD-tradere gjør
-
Finanskrise i Tyrkia – myndighetene griper inn
-
EU-regler tvinger fram nye toganbud – mot regjeringens vilje
-
Ordføreropprør mot dieselprisen
-
Kong Charles frykter KI-katastrofe
-
Krever EU-tiltak mot Kina for å beskytte bilindustrien
-
OpenAI varsler om rebelsk KI-atferd
OpenAI og Anthropic-modeller brøt testgrenser
KI-modeller fra selskapene OpenAI og Anthropic har igjen brutt testgrenser, ifølge Storbritannias KI-sikkerhetsinstitutt (AISI).
Ifølge AISI hadde KI-modellene til selskapene OpenAI og Anthropic gått utenfor rammene for en oppgave der agentene skulle løse en cybersikkerhetsutfordring.
– Vi gjennomførte denne utfordringen 122 ganger på tvers av flere modeller. Vår undersøkelse viste at i 10 av disse tilfellene gjennomførte en KI-agent selvstendige, ikke-godkjente handlinger på det åpne internett, rettet mot virkelige personer og organisasjoner, sier instituttet.
Ifølge AISI forsøkte en agent i det mest alvorlige tilfellet å sette inn en ondsinnet kode i et åpent kildekode-prosjekt.
– I et forsøk på å få koden godkjent, drev agenten med sosial manipulasjon. Den opprettet falske identiteter på nettet og brukte dem til å presse en av prosjektutførerene til å godkjenne koden.
Koden ble stoppet av personen, og ingen reell skade har blitt avdekket etter hendelsen.
– Dette er første gang vi har sett risikoer knyttet til autonomi og bedrag manifestere seg så tydelig uten spesifikk instruksjon, sier selskapet.
Både OpenAI, som står bak ChatGPT, og Anthropic, har rapportert hendelser den siste måneden der modeller har handlet utenfor menneskelig kontroll. Anthropic, som står bak Claude-modellene, sier selskapet er takknemlig ovenfor AISI.
– Å få et bilde av Claudes forståelse av sin situasjon vil hjelpe oss med å identifisere årsakene til atferden, sier selskapet.
(©NTB)
Nylige artikler
Amerikansk UD godkjenner luftvernsalg til Ukraina for 2,7 milliarder dollar
Sikkerhetsavtale mellom USA, Grønland og Danmark er klar
Trump nekter CNN, MSNOW og Politico tilgang til Det hvite hus
Frankrike kaller inn G7 til energimøte
- Oljefondet kan ikke opprettholde velferdsstaten
Buffett-sønnen overtar styrelederrollen
FN-rapport: Kjønnene vil være likestilt først om 171 år med dagens tempo
Mest leste artikler
Ukens aksje: Teigland ser 30 prosent oppside på én uke
Zenith Energy øker kontantstrømmen kraftig på høye strømpriser i Italia
Tyskland i krise: Volkswagen kutter 100.000 jobber og AfD vokser
Petter Stordalen fornærmet i underslagssak på flere millioner
K33: Bitcoin er et sterkt kjøp før Fed-renten og Clarity Act
Fed under press: Markedet priser inn flere rentehevinger
Circio henter 200 millioner – aksjen faller under emisjonskursen