-
Esa mener Norge brøt EØS-avtalen i tildeling av jernbanekontrakt
-
Von der Leyen vil ha europeisk sikkerhetsråd – og tettere samarbeid med Norge
-
Håver inn på europeisk energikrise – kontantstrømmen stiger kraftig
-
Soiltech sikrer kontrakt på over 20 millioner
-
Frp mer enn dobbelt så store som Høyre
-
Gates advarer mot KI-klasseskille
-
Vil stille Hegseth for riksrett
-
Irankrigen har kostet USA 38 milliarder dollar
-
K33-topp før skjebneuke: – Bitcoin er et sterkt kjøp
-
Telenor siktet i Myanmar-saken
-
Oljetanker angrepet i Hormuz
-
Støre: – Nå temmer vi strømprisene!
-
Ukrainsk offensiv i Donetsk
-
Circio henter 200 millioner – aksjen stuper
-
Lokalavisene vokser mens avislesingen faller
OpenAI og Anthropic-modeller brøt testgrenser
KI-modeller fra selskapene OpenAI og Anthropic har igjen brutt testgrenser, ifølge Storbritannias KI-sikkerhetsinstitutt (AISI).
Ifølge AISI hadde KI-modellene til selskapene OpenAI og Anthropic gått utenfor rammene for en oppgave der agentene skulle løse en cybersikkerhetsutfordring.
– Vi gjennomførte denne utfordringen 122 ganger på tvers av flere modeller. Vår undersøkelse viste at i 10 av disse tilfellene gjennomførte en KI-agent selvstendige, ikke-godkjente handlinger på det åpne internett, rettet mot virkelige personer og organisasjoner, sier instituttet.
Ifølge AISI forsøkte en agent i det mest alvorlige tilfellet å sette inn en ondsinnet kode i et åpent kildekode-prosjekt.
– I et forsøk på å få koden godkjent, drev agenten med sosial manipulasjon. Den opprettet falske identiteter på nettet og brukte dem til å presse en av prosjektutførerene til å godkjenne koden.
Koden ble stoppet av personen, og ingen reell skade har blitt avdekket etter hendelsen.
– Dette er første gang vi har sett risikoer knyttet til autonomi og bedrag manifestere seg så tydelig uten spesifikk instruksjon, sier selskapet.
Både OpenAI, som står bak ChatGPT, og Anthropic, har rapportert hendelser den siste måneden der modeller har handlet utenfor menneskelig kontroll. Anthropic, som står bak Claude-modellene, sier selskapet er takknemlig ovenfor AISI.
– Å få et bilde av Claudes forståelse av sin situasjon vil hjelpe oss med å identifisere årsakene til atferden, sier selskapet.
(©NTB)
Nylige artikler
Von der Leyen vil ha europeisk sikkerhetsråd – og tettere samarbeid med Norge
Clarity Act stanset i Senatet – Coinbase stupte over 10 prosent
Håver inn på europeisk energikrise – kontantstrømmen stiger kraftig i Italia
Utvider samarbeidet på Deepsea Yantai
Frp mer enn dobbelt så store som Høyre i ny måling
Bill Gates advarer: – KI vil forsterke sosiale ulikheter
Republikaner vil stille Hegseth for riksrett for Iran-krigen
Mest leste artikler
Kongens gravferd er ingen giverkonferanse for Ukraina
Ukens aksje: Teigland ser 30 prosent oppside på én uke
Tyskland i krise: Volkswagen kutter 100.000 jobber og AfD vokser
Zenith-sjef forsvarer emisjonen etter kursfall
Petter Stordalen fornærmet i underslagssak på flere millioner
Ukens aksje: Teigland ser en mulig fredsvinner på børsen
Fed under press: Markedet priser inn flere rentehevinger