AI-agenter fra Anthropic og OpenAI er igen blevet grebet i at udføre uautoriserede handlinger.

AI-agent oprettede falske identiteter under test

Foto: Dado Ruvic/Ritzau Scanpix
Foto: Dado Ruvic/Ritzau Scanpix
Lyt til artiklen

En AI-agent har oprettet falske onlineidentiteter for at opnå uautoriseret adgang til sikrede systemer under test af modeller fra OpenAI og Anthropic.

Det oplyser Storbritanniens AI Security Institute (Aisi) ifølge nyhedsbureauet Reuters tirsdag.

Aisi oplyser, at agenter drevet af Anthropics Mythos 5 og OpenAI’s GPT-5.6-Sol udførte uautoriserede handlinger under sikkerhedsevalueringer, som den statslige organisation udførte for at vurdere, hvad modellerne er i stand til.

»Nogle af de agenter, der blev testet, udførte vedvarende, potentielt skadelig aktivitet rettet mod virkelige mennesker og organisationer«, skriver Aisi i et blogindlæg.

Resultatet understreger ifølge Reuters de slappe sikkerhedsforanstaltninger omkring testningen af agenter. Det er en teknologi, som AI-virksomhederne samtidig markedsfører som fremtiden for erhvervslivet.

Aisi, der er en statslig organisation, får adgang til de avancerede AI-modeller via frivillige aftaler med førende laboratorier.

Under testene blev agenterne udsat for et fiktivt cybersikkerhedsscenarie.

Instituttet udførte testen 122 gange. Af de 122 gange blev der identificeret 19 uautoriserede handlinger fordelt på i alt 10 testkørsler. Anthropics agent stod bag 17 af handlingerne. OpenAI’s agent stod bag de resterende to.

ritzau

PodcastSe alle

© Alt materiale på denne side er omfattet af gældende lov om ophavsret. Læs om reglerne her