Anthropic råkade smita under säkerhetstester
Whoopsie!
Foto: Brecht Corbeel / Unsplash
Efter att ha granskat över 140 000 säkerhetstester har AI-bolaget Anthropic konstaterat att deras AI-modell Claude lyckats bryta sig in hos tre olika företag. Anledningen till dessa oavsiktliga dataintrång berodde på att boten av misstag fick tillgång till internet i tester där den egentligen skulle ha varit isolerad. Anthropics granskning inleddes efter en liknande händelse hos konkurrenten OpenAI som lyckades leta sig ut på nätet för att där ta sig in på AI-plattformen Hugging Face.Problemen uppstod under så kallade Capture the Flag-övningar. I dessa tester får AI-modellen i uppdrag att hitta hemlig information i en simulerad IT-miljö för att utvärdera dess förmåga inom cybersäkerhet. På grund av en felkonfiguration hos en extern partner hade Claude tillgång till internet, trots att systemet blivit instruerat att det befann sig i en helt isolerad miljö.När Claude hittade sårbarheter hos riktiga företag på nätet, tolkade den dessa som en del av den digitala hinderbanan. Genom att utnyttja enkla säkerhetsbrister, som svaga lösenord, lyckades AI:n ta sig in i företagens system i tron att det var en del av uppdraget. Enligt Anthropic fortsatte en äldre version av Claude sina försök att ta sig in i de extrema miljöerna även när det fanns tecken på att systemen var verkliga. Men den senaste testmodellen visade däremot prov på högre omdöme då den avbröt attacken på eget initiativ så fort den insåg att den faktiskt befann sig på det riktiga internet.Anthropic säger att det inte rör sig om att AI:n har utvecklat en egen vilja att göra skada, utan att den helt enkelt var för nitisk i att utföra sina instruktioner i en felaktig miljö. Bolaget har nu kontaktat de drabbade organisationerna för att hjälpa till med säkerhetsarbetet och har tillfälligt pausat liknande tester för att säkerställa att modellerna inte kan rymma igen.Någonstans känner man att det ska säkerställas rätt rejält innan sådana tester genomförs generellt, men man kan väl inte få allt här i livet.
anthropic.com
Internet,
Anthropic,
Claude,
OpenAI,
dataintrång,
Hugging Face,
AI-säkerhet
Via
nyteknik.se32°0Hugging Face inte enda måltavlan för OpenAI:s AI-agentAI på rymmen gav sig även på andra tjänster20°0OpenAI-modell rymde och hackade Hugging FaceDet låter ju tryggt...42°0Techjättar drar igång säkerhetsallians för AIEn del kända namn saknas dock från initiativet
34.6°
0Frode Wikesjö
idag kl 12:00
+
Per månad
39 kr
Betala löpande per månad. Ingen bindningstid.
Starta prenumeration
Per år
299 kr
Enklast och billigast, bara 25 kronor i månaden. Betala löpande per år. Ingen bindningstid.
Prova 14 dagar gratis innan du bestämmer dig.
Starta gratis provperiod
Engångsköp
349 kr
Slipp återkommande betalningar, betala ett år i taget. Betala med kort eller Swish.
Köp utan prenumeration