-
Google stokker om i AI-toppen: Hassabis gir fra seg den daglige ledelsen
-
OpenAI og Anthropic-modeller brøt testgrenser
-
Høyre avviser nytt drivstoffkutt nå
-
Nærmer seg avtale om Hormuzstredet
-
SpaceX stuper
-
Senatets justiskomité godkjenner Blanche som justisministerkandidat
-
Flere solgte rom enn forventet – god sommer for norske hotell
-
Irlands nye regjeringsfly mangler israelsk landingssystem
-
Bessent tror på snarlig Hormuz-avtale
-
Tydal får KI-kontrakt verdt 45 milliarder
-
72.000 ble sendt ut fra Ceuta
-
Circio henter RNA-veteran
-
BP mer enn doblet resultatet
-
Eide advarer Europa etter Ceuta-krisen
-
Aramco løftet overskuddet kraftig
OpenAI og Anthropic-modeller brøt testgrenser
KI-modeller fra selskapene OpenAI og Anthropic har igjen brutt testgrenser, ifølge Storbritannias KI-sikkerhetsinstitutt (AISI).
Ifølge AISI hadde KI-modellene til selskapene OpenAI og Anthropic gått utenfor rammene for en oppgave der agentene skulle løse en cybersikkerhetsutfordring.
– Vi gjennomførte denne utfordringen 122 ganger på tvers av flere modeller. Vår undersøkelse viste at i 10 av disse tilfellene gjennomførte en KI-agent selvstendige, ikke-godkjente handlinger på det åpne internett, rettet mot virkelige personer og organisasjoner, sier instituttet.
Ifølge AISI forsøkte en agent i det mest alvorlige tilfellet å sette inn en ondsinnet kode i et åpent kildekode-prosjekt.
– I et forsøk på å få koden godkjent, drev agenten med sosial manipulasjon. Den opprettet falske identiteter på nettet og brukte dem til å presse en av prosjektutførerene til å godkjenne koden.
Koden ble stoppet av personen, og ingen reell skade har blitt avdekket etter hendelsen.
– Dette er første gang vi har sett risikoer knyttet til autonomi og bedrag manifestere seg så tydelig uten spesifikk instruksjon, sier selskapet.
Både OpenAI, som står bak ChatGPT, og Anthropic, har rapportert hendelser den siste måneden der modeller har handlet utenfor menneskelig kontroll. Anthropic, som står bak Claude-modellene, sier selskapet er takknemlig ovenfor AISI.
– Å få et bilde av Claudes forståelse av sin situasjon vil hjelpe oss med å identifisere årsakene til atferden, sier selskapet.
(©NTB)
Nylige artikler
Høyre sier foreløpig nei til å forlenge drivstoffkuttet
Axios: USA, Iran og Oman nærmer seg Hormuz-avtale
SpaceX-rakett skal ha krasjet på månen
SpaceX-inntekter opp med 92 prosent i andre kvartal
Mystisk gigantkjøp i SpaceX-opsjoner vekker oppsikt
Senatets justiskomité godkjenner Blanche som justisministerkandidat
Flere solgte rom enn forventet
Mest leste artikler
Snatched svarer Robert Næss: Forsvarer verdsettelse på 59,9 millioner
Hvorfor døde Olaf Tufte? Hjertestans, vaksinespørsmål og toppidrettens risiko
Ceuta-krisen: 60.000 migranter presser Spanias grense og setter Sánchez under press
Circio henter RNA-veteran til styret før klinisk satsing i genterapi
Desert Control etter emisjonen: Kan aksjen gjøre comeback på Oslo Børs?
Ukens aksje: Kan ta av etter Trumps Iran-pause
Frp-topp fikk kvart million fra First House for «Trump-VM»-podkast – Rødts Mímir Kristjánsson raser