کجای متن، واترمارک کلود قایم شده؟
خلاصهٔ کاملتر
به گفتهٔ نویسنده، آنتروپیک از ۱۱ اوت ۲۰۲۶ اعلام کرده هر چیزی که کلود تولید کنه رو نشونهگذاری میکنه؛ برای فایلهای تصویری از استاندارد C2PA استفاده میکنه، ولی برای متن ساده یه واترمارک نامرئی میزنه که حتی بعد از کپیپیست هم تو متن میمونه. آنتروپیک هیچ الگوریتم یا ابزار تشخیصی منتشر نکرده، پس نویسنده تلاش کرده از روی رفتار مدل حدس بزنه این واترمارک چطور کار میکنه.
نویسنده متن رو به چهار لایه تقسیم میکنه: کدگذاری کاراکترها، فرمتبندی (مثل جای شکستن خطها)، انتخاب کلمهها، و در نهایت معنا. دو لایهٔ اول، همونایی هستن که «دنیل» تو اعتراضش بهشون اشاره کرده بود؛ نویسنده با یه اسکریپت چک کرده و تو خروجی کلود هیچ کاراکتر مخفی یا فاصلهٔ غیرعادیای پیدا نکرده، چون این لایهها به محض تبدیل متن به ASCII خالص از بین میرن.
لایهای که با توضیحات آنتروپیک جور در میاد، لایهٔ سوم یعنی انتخاب کلمههاست: مدل یه کلید مخفی داره و تو هر قدم کمی به سمت کلمههای موردنظر اون کلید متمایل میشه؛ برای خواننده عادی هیچ فرقی حس نمیشه، ولی کسی که کلید رو داره میتونه این تمایل رو آماری اندازه بگیره. روشهای منتشرشدهٔ green-list کیرشنباوئر و تکنیک SynthID-Text گوگل تو Gemini، نمونههای شناختهشدهٔ همین ایدهان. نویسنده تاکید میکنه ممکنه واترمارک واقعی حتی تو لایهٔ چهارم (معنا) باشه که در برابر پارافریز سبک هم دووم میاره.
برای پاک کردن این نشونه، نویسنده دو راه معرفی میکنه: بازتولید کامل متن به فرم ASCII استاندارد که نشونههای لایهٔ کدگذاری و فرمت رو از بین میبره، و بازنویسی کامل جملهها که نشونهٔ لایهٔ انتخاب کلمه رو ضعیف میکنه. نکتهٔ جالب اینه که اگه یه هوش مصنوعی دیگه متن رو بازنویسی کنه، فقط واترمارک خودش رو جایگزین میکنه، نه اینکه پاکش کنه؛ فقط بازنویسی واقعی توسط یه انسان میتونه کاملاً اثری باقی نذاره.
نویسنده تاکید میکنه که پیدا شدن واترمارک فقط ثابت میکنه یه جایی کلود روی متن کار کرده، نه اینکه کلود نویسندهٔ اصلیشه؛ حتی اگه فقط از کلود بخوای غلط گرامری یه متن رو درست کنه، ممکنه خروجی نشونهدار بشه. از طرف دیگه، نبود نشونه هم چیزی رو ثابت نمیکنه، چون متنهای کوتاه یا ویرایششده هم میتونن پاک به نظر برسن.
نکات کلیدی:
- آنتروپیک از ۱۱ اوت ۲۰۲۶ رو همهٔ متنهای کلود واترمارک نامرئی میزنه، ولی الگوریتمش رو نگفته
- کاراکترهای مخفی و فاصلههای غیرعادی تو خروجی کلود پیدا نشده
- محتملترین جا برای واترمارک، انتخاب کلمههاست؛ شبیه روشهای منتشرشدهٔ کیرشنباوئر و SynthID-Text گوگل
- تبدیل به ASCII خالص و بازنویسی کامل جملهها میتونن نشونه رو پاک کنن، ولی بازنویسی با AI فقط واترمارک رو عوض میکنه
- وجود واترمارک فقط نشون میده مدل به متن دست زده، نه اینکه چه کسی واقعاً نویسندهست




