Anthropic új Watermarking API-ja megbízhatóan felismeri az MI által generált Claude-szövegeket

Hírek2026.08.15.17 megtekintés

  • Az Anthropic bemutatta az új Watermarking API-t, amely képes felismerni az MI által generált Claude-szövegeket[^1].
  • Az új technológia világszerte elérhető, hogy megfeleljen az EU AI Act átláthatósági követelményeinek.
  • A megoldás a Google Deepmind által fejlesztett SynthID szövegvízjelezési módszeren alapul.
  • Régebbi Claude-modellek is frissítést kapnak a funkcióval a közeljövőben.

Anthropic elindította az új Watermarking API-ját, mely lehetővé teszi a harmadik fél számára, hogy megbízhatóan ellenőrizze, hogy egy szöveg az MI-alapú Claude modell által generált-e. Az újítás célja az átláthatóság növelése, különös tekintettel az EU mesterséges intelligencia rendeletének (AI Act) megfelelésére[^1].

Az Anthropic Watermarking API működése és technológiai háttere

Az új Watermarking API segítségével fejlesztők integrálhatják az MI-szövegek felismerését alkalmazásaikba. A technológia lényege, hogy az MI által generált szövegekben egyedi, visszakövethető mintázatokat helyez el, melyek a szóválasztás véletlenszerűségének módosításával keletkeznek. Ez a módszer nem befolyásolja a szöveg tartalmát, kreativitását vagy olvashatóságát, így az emberi felhasználók számára észrevehetetlen marad[^1].

Google Deepmind SynthID technológia

Az Anthropic által alkalmazott vízjelezési eljárás a Google Deepmind 2024-ben bemutatott SynthID szövegvízjelezési módszerének egy változata. Ez az eljárás biztosítja, hogy a Claude által generált szövegek utólag is felismerhetők legyenek, még akkor is, ha a szövegeket többször átmásolják vagy megosztják[^1].

Előnyök és korlátozások

A Watermarking API fő előnye, hogy megbízhatóbb, mint a külső MI-felismerő szoftverek, például a Pangram, amelyek csak tipikus szóhasználat vagy gyakorisági minták alapján próbálják felismerni az MI-szövegeket. A vízjelezés ennél lényegesen pontosabb, hiszen magába a szöveg generálási folyamatába épül be[^1].

Azonban a technológia ismer bizonyos korlátokat: rövid, kevés alternatív megfogalmazást lehetővé tevő szövegeknél vagy kódrészleteknél kevésbé működik hatékonyan. Erős átfogalmazás, illetve kizárólag emberi szerkesztés esetén a vízjel eltűnhet, de teljes fordításoknál vagy MI által teljesen generált szövegeknél megmarad.

Fontos, hogy a Watermarking csak azt tudja megállapítani, hogy Claude valószínűleg részt vett a szöveg létrehozásában – nem tudja pontosan megmondani, hogy az egész szöveg MI-től származik-e, vagy csak részben szerkesztette azt az MI. Más MI-modellek vagy teljesen emberi szerkesztés felismerése nem megoldott ezzel a technológiával.

Bevezetés világszerte és megfelelés az EU AI Act előírásainak

Az Anthropic a Watermarking bevezetésével az EU AI Act átláthatósági követelményeinek kíván megfelelni. 2026 júliusában a vállalat több mint 190 másik szereplővel együtt aláírta az EU MI által generált tartalomra vonatkozó Átláthatósági Magatartási Kódexet. A technológia földrajzi korlátozása jelenleg nem megoldható, ezért a Watermarking világszerte elérhetővé vált. A frissítések és további fejlesztések folyamatosan várhatók[^1].

Az augusztus 2-tól kiadott Claude-modellek már alapértelmezetten tartalmazzák a Watermarking funkciót, míg a korábbi modelleket a közeljövőben frissítik. Fájlok esetén az C2PA nyílt szabvány kerül alkalmazásra, amely metadatokat fűz a fájlhoz anélkül, hogy magát a tartalmat módosítaná.

Összefoglaló

Az Anthropic Watermarking API-ja jelentős lépést jelent az MI által generált szövegek átláthatóságának biztosítása felé, különösen az európai szabályozásoknak való megfelelés miatt. Bár a technológia nem tökéletes, a fejlesztők és felhasználók számára lényegesen megbízhatóbb ellenőrzési lehetőséget kínál, mint a korábbi megoldások.

Forrás:

[^1]: THE DECODER (2026-08-14). “Anthropics neue Watermarking-API soll KI-generierte Claude-Texte zuverlässig erkennen”. Közzétéve [2026. 08. 14.].

Follow
Keresés Népszerű
Loading

Signing-in 3 seconds...

Signing-up 3 seconds...