Sikkerhedsforskere er lykkedes med at få en AI-model til at bryde sine egne sikkerhedsmekanismer og levere farligt indhold – herunder vejledning til terroristangreb og planlagte attentater. Det afsløres i dagens afsnit af BBC World Services populære teknologiprogram Tech Life.
Opdagelsen understreger en kritisk sårbarhed i moderne sprogmodeller: selvom producenter implementerer omfattende filtre og etiske retningslinjer, finder forskere stadig måder at omgå disse sikkerhedsforanstaltninger på. Metoderne baserer sig typisk på såkaldt “prompt injection” – teknikker hvor man omformulerer spørgsmål eller giver modellen modsatrettede instruktioner for at få den til at glemme sine oprindelige begrænsninger.
For teknologijournalisten betyder disse fund, at debatten om AI-sikkerhed skifter fra teoretisk til praktisk: de risici, som eksperter har advaret imod siden de første sprogmodeller blev offentliggjort, er nu bekræftet gennem konkrete eksperimenter.
Ud over AI-sårbarhederne udforsker Tech Life i dag også spildesigneren Jonathan Blows 10-årige mission med at udvikle sit eget programmeringssprog og spilmotor til hans nyeste game-udgivelse. Blows arbejde repræsenterer en modsætning til industriens mainstream-praksis – i stedet for at bygge på eksisterende værktøjer, valgte han at starte fra bunden.
Derudover præsenterer Shiona McCallum seneste udvikling inden for fødselsvidenskab og reproduktionsteknologi – et område der i stigende grad blender medicin med avanceret teknologi.
BBC World Service udsender dagligt programmer på omkring 40 sprog og når et globalt publikum, der søger dybdegående nyheds- og analysedækning. Tech Life er et af programmets flagskibsprogram for alle, der interesserer sig for teknologi, samfund og fremtiden.
