Kodare hävdar sig ha knäckt Anthropics AI-vattenstämpel redan innan lansering
Foto: Freepik
Bara timmar efter att Anthropic presenterade sin osynliga vattenstämpel för AI-genererad text publicerade en programmerare kod som påstås ta bort märkningen, rapporterar Wired.
Vad är Anthropics vattenstämpel?
Anthropic meddelade förra veckan att bolaget inför en osynlig vattenstämpel i text genererad av dess AI-system. Syftet är att uppfylla EU:s AI-lagstiftning, som kräver att AI-producerat innehåll ska kunna identifieras.
Vattenstämpeln är osynlig för läsaren men ska gå att detektera med rätt verktyg, ett system som används av flera aktörer inom AI-branschen för att märka automatgenererat innehåll.
Programmerare publicerade motmetod inom timmar
Redan samma dag som Anthropic presenterade sin vattenstämpel publicerade programmeraren Guillaume Meyer kod på utvecklarplattformen GitHub med syfte att ta bort märkningen. Metoden bygger i korthet på att låta en annan AI skriva om texten, vilket ska radera spåren av den ursprungliga märkningen.
Koden har fått stor spridning bland programmerare på plattformen. Det är ännu inte bekräftat att metoden faktiskt fungerar.
– En del programmerare som försöker upphäva vattenstämpeln är principiella motståndare till märkningen, medan andra gör det för den tekniska utmaningens skull, säger Guillaume Meyer till Wired.
Utmaningen med att göra märkning beständig
Att vattenstämplar för AI-genererad text är svåra att göra manipuleringssäkra är ett känt problem inom branschen. Omskrivning, översättning och parafrasering är metoder som tidigare visat sig effektiva för att sudda ut liknande märkningar i andra system.
Huruvida Anthropics implementation är mer robust återstår att se. Bolaget har ännu inte kommenterat påståendena om att vattenstämpeln går att kringgå, och det är oklart när systemet lanseras i sin slutgiltiga form.