Anthropic uvodi vodene žigove u Claude: šta to znači za sigurnost AI sadržaja
Anthropic je ove sedmice objavio detalje o svom novom sistemu za vodene žigove (watermarking) koji će biti primjenjen na sav tekst generisan od strane Claude modela. Koristeći SynthID-Text pristup razvijen od strane Google DeepMind tima, Kompanija nastoji ispuniti zahtjeve EU AI Act Transparency Code-a koji obavezuje AI provajdere da omoguće identifikaciju AI-generisanog sadržaja.
Kako radi tehnički
Sustav koristi statističku manipulaciju verovatnoće tokena prilikom generisanja. Kod "nizakih rizika" izbora — na primjer, kada model bira između sinonima poput "oblačno" i "sivkasto" za opis vremena — sistem umeće neprimjetan uzorak koji je nevidljiv čitaocu, ali detektibilan onima koji posjeduju ključ za validaciju. Ključno: kvalitet izlaza ne pati, a vodeni žig ostaje otporan na lagano uređivanje.
Šta za enterprise korisnike u regionu?
- Compliance: Firme koje koriste Claude za generisanje zvanične dokumentacije, izvještaja ili klijentske komunikacije sada imaju ugrađeni mehanizam dokaza porekla teksta — važno za regulirane sektore (financije, zdravstvo, javna uprava).
- Detekcija API: Anthropic planira objaviti API za detekciju vodena žigova. To dozvoljava integraciju u interne CI/CD pipeline-ove, DLP sisteme ili procese revizije sadržaja.
- Kod je drugačije: Vodeni žig u kodu ima manje uticaja jer model nema slobodu izbora među istovjetno validnim opcijama — radi se o sintaksi, ne stilu. Komentari unutar koda mogu nositi žig, ali funkcionalnost ostaje neizmenjena.
- Obmana sistemima: Potpuno prepisivanje teksta (svaka riječ zamijenjena) uklanja žig, ali tada se radi o ljudskom autorstvu, ne AI generisanju. Laganu editiranje ne briše uzorak.
Regionalni kontekst
Za firme u BiH i regionu koje ulaze u lancu opskrbe EU korporacija, ovo je signal: AI alati će morati imati "provenance" sloj. One koje rano adoptiraju detekciju i evidentiranje AI sadržaja bit će u prednosti pri tenderima i partnerstvima. BIXIE klijenti već sada testiraju integraciju Anthropic detekcijske API-je u svoje DLP pravila — nije višek, postaje standard dobre prakse.
Izvor: TechCrunch, "Anthropic shares more details about how Claude's new watermarks will work", 15. avgust 2026.