Anthropic elindította az új Watermarking API-ját, mely lehetővé teszi a harmadik fél számára, hogy megbízhatóan ellenőrizze, hogy egy szöveg az MI-alapú Claude modell által generált-e. Az újítás célja az átláthatóság növelése, különös tekintettel az EU mesterséges intelligencia rendeletének (AI Act) megfelelésére[^1].
Az új Watermarking API segítségével fejlesztők integrálhatják az MI-szövegek felismerését alkalmazásaikba. A technológia lényege, hogy az MI által generált szövegekben egyedi, visszakövethető mintázatokat helyez el, melyek a szóválasztás véletlenszerűségének módosításával keletkeznek. Ez a módszer nem befolyásolja a szöveg tartalmát, kreativitását vagy olvashatóságát, így az emberi felhasználók számára észrevehetetlen marad[^1].
Az Anthropic által alkalmazott vízjelezési eljárás a Google Deepmind 2024-ben bemutatott SynthID szövegvízjelezési módszerének egy változata. Ez az eljárás biztosítja, hogy a Claude által generált szövegek utólag is felismerhetők legyenek, még akkor is, ha a szövegeket többször átmásolják vagy megosztják[^1].
A Watermarking API fő előnye, hogy megbízhatóbb, mint a külső MI-felismerő szoftverek, például a Pangram, amelyek csak tipikus szóhasználat vagy gyakorisági minták alapján próbálják felismerni az MI-szövegeket. A vízjelezés ennél lényegesen pontosabb, hiszen magába a szöveg generálási folyamatába épül be[^1].
Azonban a technológia ismer bizonyos korlátokat: rövid, kevés alternatív megfogalmazást lehetővé tevő szövegeknél vagy kódrészleteknél kevésbé működik hatékonyan. Erős átfogalmazás, illetve kizárólag emberi szerkesztés esetén a vízjel eltűnhet, de teljes fordításoknál vagy MI által teljesen generált szövegeknél megmarad.
Fontos, hogy a Watermarking csak azt tudja megállapítani, hogy Claude valószínűleg részt vett a szöveg létrehozásában – nem tudja pontosan megmondani, hogy az egész szöveg MI-től származik-e, vagy csak részben szerkesztette azt az MI. Más MI-modellek vagy teljesen emberi szerkesztés felismerése nem megoldott ezzel a technológiával.
Az Anthropic a Watermarking bevezetésével az EU AI Act átláthatósági követelményeinek kíván megfelelni. 2026 júliusában a vállalat több mint 190 másik szereplővel együtt aláírta az EU MI által generált tartalomra vonatkozó Átláthatósági Magatartási Kódexet. A technológia földrajzi korlátozása jelenleg nem megoldható, ezért a Watermarking világszerte elérhetővé vált. A frissítések és további fejlesztések folyamatosan várhatók[^1].
Az augusztus 2-tól kiadott Claude-modellek már alapértelmezetten tartalmazzák a Watermarking funkciót, míg a korábbi modelleket a közeljövőben frissítik. Fájlok esetén az C2PA nyílt szabvány kerül alkalmazásra, amely metadatokat fűz a fájlhoz anélkül, hogy magát a tartalmat módosítaná.
Az Anthropic Watermarking API-ja jelentős lépést jelent az MI által generált szövegek átláthatóságának biztosítása felé, különösen az európai szabályozásoknak való megfelelés miatt. Bár a technológia nem tökéletes, a fejlesztők és felhasználók számára lényegesen megbízhatóbb ellenőrzési lehetőséget kínál, mint a korábbi megoldások.
[^1]: THE DECODER (2026-08-14). “Anthropics neue Watermarking-API soll KI-generierte Claude-Texte zuverlässig erkennen”. Közzétéve [2026. 08. 14.].