شرکت انتروپیک از دوم اوت روی همه متن ها و فایل های خروجی کلود واترمارک نامرئی میگذارد تا با مقررات شفافیت قانون هوش مصنوعی اتحادیه اروپا همخوان شود؛ این علامت گذاری در سراسر جهان اعمال میشود، مهم نیست کاربر نزدیک بروکسل باشد یا نه.
شرکت آنتروپیک قصد دارد برای متنهایی که توسط مدل زبانی بزرگ و چتبات «کلود» تولید میشود، واترمارکهای نامرئی تعبیه کند؛ اقدامی که با هدف پاسخگویی به مقررات تازه اتحادیه اروپا درباره شفافیت هوشمصنوعی انجام میشود.
آنتروپیک، غول هوشمصنوعی مستقر در سانفرانسیسکو، در بیانیهای اعلام کرد: «مدلهای کلود که از ۲ اوت ۲۰۲۶ یا پس از آن راهاندازی میشوند از همان ابتدا از نشانهگذاری پشتیبانی میکنند. همچنین در حال کار روی افزودن این قابلیت به مدلهای کلود هستیم که پیش از آن تاریخ عرضه شدهاند.»
سیاست تازه نشانهگذاری همه خدماتی را که با کلود ارائه میشوند در بر میگیرد؛ از جمله اپلیکیشن مصرفکننده، پلتفرم توسعهدهندگان کلود (API)، کلود کد، کلود کوورک و کلود تگ، و همچنین نسخههای کلود که از طریق AWS، گوگل کلاد و مایکروسافت فاندری در دسترس هستند.
واترمارک یا به صورت «نشانهگذاری نامحسوس مستقیما در خود متن» درج میشود یا به شکل فراداده اضافه خواهد شد، بهطوریکه وقتی «کلود یک نوع فایل پشتیبانیشده مثل .svg، .png یا .jpg تولید میکند، فراداده منشای امضا شدهای را ضمیمه میکند که نشان میدهد فایل توسط کلود پردازش شده و به شما امکان میدهد تشخیص دهید آیا فایل دستکاری شده است یا نه».
آنتروپیک اعلام کرده است که واترمارک به همه مناطقی که کلود در آن عرضه میشود اعمال خواهد شد نه فقط اتحادیه اروپا.
نشانهگذاری به اروپا محدود نمیشود. آنتروپیک میگوید این واترمارک در همه جا که کلود در سراسر جهان ارائه میشود فعال خواهد بود؛ نمونه دیگری از این که چگونه استانداردهای انطباق اتحادیه اروپا بر قواعد جهانی در حال شکلگیری برای هوشمصنوعی اثر میگذارند.
واترمارک چگونه کار میکند
آنتروپیک از دو روش مجزا استفاده میکند. در روش اول، یک الگوی نامحسوس مستقیما در متن تولیدشده درج میشود؛ الگویی که برای خوانندگان قابل دیدن نیست اما توسط ماشینها قابل تشخیص است و حتی پس از کپی و پیست شدن متن در جاهای دیگر همراه آن باقی میماند.
به گفته این شرکت، این الگو معنای پاسخ کلود، کیفیت آن یا خوانایی متن را تغییر نمیدهد.
روش دوم برای فایلها به کار میرود. این روش بیشتر شبیه رد دیجیتال روی سند است، مشابه اطلاعات EXIF روی یک عکس و بهگونهای طراحی شده که قابل بررسی باشد نه پنهان.
برای دیدن این نشانهها در عمل احتمالا به یک ابزار سازگار با استاندارد C2PA یا سامانه تشخیص در دست توسعه آنتروپیک نیاز است، نه صرفا منوی معمول «ویژگیها» در سیستمعامل. این فراداده لزوما نام کلود را نشان نمیدهد بلکه بیشتر مشخص میکند فایل از یک سامانه هوشمصنوعی عبور کرده است.
این شرکت همچنین بهصراحت اعلام کرده است که امکان از دست رفتن فراداده وجود دارد.
آنتروپیک توضیح داده است: «نشانهگذاری یک فایل میتواند در اثر تبدیل فرمت، ذخیرهسازی مجدد، گرفتن اسکرینشات یا فرایندهای مشابه حذف شود؛ به این معنی که سند یا تصویری که زمانی علامت کلود را حمل میکرد ممکن است پس از ویرایش یا تبدیل دیگر هیچ اثری از آن نداشته باشد.»
چرا حالا
زمان اجرای این سیاست مستقیم به قانون هوشمصنوعی اتحادیه اروپا گره خورده است.
بر اساس ماده ۵۰ این قانون، سامانههای هوشمصنوعی که محتوای مصنوعی مانند دیپفیک تولید میکنند موظفاند خروجیهای خود را بهعنوان محتوای ساختگی علامتگذاری کنند.
نهادهای ناظر انتظار دارند شرکتها از یک راهبرد چندلایه برای نشانهگذاری استفاده کنند که ترکیبی از فراداده امضا شده دیجیتال، واترمارک نامرئی و در برخی موارد اثر انگشت دیجیتال یا ثبت رخداد بهعنوان پشتوانه است، زیرا آییننامه رفتار روشن کرده که هیچ روش نشانهگذاری بهتنهایی کافی نیست.
الزامات شفافیت مندرج در ماده ۵۰ از ۲ اوت ۲۰۲۶ لازمالاجرا شده است. عدم پایبندی به این مقررات میتواند به جریمههایی تا ۱۵ میلیون یورو یا ۳ درصد از کل گردش مالی سالانه جهانی، هر کدام که بیشتر باشد، منجر شود.
آیا کاربران هنوز میتوانند رد خود را پنهان کنند؟
آنتروپیک بهروشنی تاکید کرده است که واترمارک شناساییشده یک نشانه است نه مدرک قطعی.
ظاهر شدن این علامت در یک متن فقط تایید میکند که آن متن در مقطعی ممکن است از کلود عبور کرده باشد نه این که کل تاریخچه شکلگیری آن را نشان دهد.
کاربران اغلب از این دستیار برای ویرایش، ترجمه یا خلاصهکردن مطالبی استفاده میکنند که در جای دیگری تولید شدهاند بنابراین ممکن است واترمارک روی متنی دیده شود که کلود نویسنده اولیه آن نبوده است.
عکس آن هم صادق است: ویرایش سنگین، ترجمه، بخشهای بسیار کوتاه یا استفاده از مدلهای قدیمیتر که نشانهگذاری را پشتیبانی نمیکنند میتواند باعث شود خروجی واقعی کلود بدون شناسایی باقی بماند.
آنتروپیک در این مسیر تنها نیست. گوگل دیپمایند پیشتر ابزار SynthID را برای نشانهگذاری متن، تصویر و صدای تولیدشده توسط هوشمصنوعی توسعه داده است، در حالی که اوپناِیآی درباره رویکردهای واترمارکگذاری گفتوگو کرده اما در بهکارگیری گسترده آنها آهستهتر عمل کرده است.