۰۳ شهريور ۱۴۰۵ - ۱۶:۴۹
کد خبر: ۷۹۵۵۴

کلود تمام محتوای تولیدی خود را «واترمارک» می‌زند

کلود تمام محتوای تولیدی خود را «واترمارک» می‌زند
شرکت آنتروپیک (Anthropic) آیین‌نامه اتحادیه اروپا در مورد شفافیت محتوای تولید شده توسط هوش مصنوعی خود موسوم به کلود (Claude) را امضا کرده است و از این پس تمام محتوای تولید شده با استفاده از ابزار‌های خود را واترمارک خواهد کرد.

به گزارش پایگاه خبری پایداری ملی به نقل از خبرگزاری ایسنا، طبق تحلیل موسسه Ahrefs در سال ۲۰۲۵، از حدود ۹ میلیون صفحه در وب، تقریباً سه چهارم صفحات تازه منتشر شده اکنون حاوی متن نوشته شده توسط ماشین‌ها هستند. ضمن اینکه این رقم شامل اسناد آفلاین نمی‌شود. همچنین فقط متن را پوشش می‌دهد.

هوش مصنوعی مولد اکنون موسیقی، تصاویر، نرم‌افزار، عکس و ویدیو‌های قانع‌کننده‌ای تولید می‌کند. مشکل این است که تشخیص بخش زیادی از آن از آثار ساخته شده توسط انسان دشوار شده و نگرانی‌های شفافیت و امنیتی را افزایش داده است.

پاسخ اتحادیه اروپا به این نگرانی‌ها، وضع مقررات است. طبق ماده ۵۰ (۲) قانون هوش مصنوعی اتحادیه اروپا، ارائه دهندگان سیستم‌های هوش مصنوعی مولد موظف هستند تمام محتوای تولید شده را به عنوان محتوای تولید شده مصنوعی یا دستکاری شده قابل تشخیص کنند.

شرکت آنتروپیک که شرکت پشتیبان هوش مصنوعی «کلود» است، آیین‌نامه عملکرد این اتحادیه در مورد شفافیت محتوای تولید شده توسط هوش مصنوعی را امضا کرده است و اکنون قصد دارد خروجی‌های «کلود» را در سراسر اکوسیستم خود «واترمارک» کند.

به گفته این شرکت، متن دارای یک واترمارک آماری نامرئی خواهد بود، در حالی که فرمت‌های تصویری پشتیبانی شده (مانند PNG، JPG یا SVG) فراداده‌های امضا شده‌ای را دریافت می‌کنند که نشان می‌دهد Claude در این کار مشارکت داشته است.

هوش مصنوعی مولد در نوشتار، موسیقی، هنر، نرم‌افزار و تقریباً هر چیز دیجیتالی گسترش یافته است. برای بسیاری، کار را سریع‌تر و ارزان‌تر کرده است. برعکس، نگرانی‌های جدی در مورد استفاده و امنیت غیرمسئولانه نیز ایجاد کرده است. استفاده از هوش مصنوعی برای تولید کامل مقالات دانشگاهی یا در قرارداد‌های محتوایی که هوش مصنوعی به صراحت مجاز نیست، نگرانی‌های معتبری هستند. سپس موارد کم‌اهمیت‌تری وجود دارد که افراد متوجه می‌شوند آهنگ یا ویدیوی تأثیرگذاری که تحسین می‌کردند، از ابتدا به طرز فریبنده‌ای توسط هوش مصنوعی تولید شده است.

با این حال، مسئله بسیار بزرگتر در مورد امنیت است. محتوای تولید شده توسط هوش مصنوعی آنقدر قدرتمند شده است که شناسایی آن به طور فزاینده‌ای دشوار می‌شود. البته که ویدیوی یک گربه عضلانی که در حال قدم زدن روی ماه در اقیانوس است، حساب نمی‌شود، اما ویدیویی از یک چهره عمومی که خواستار خشونت یا یک سند رسمی جعلی است، می‌تواند عواقب وخیمی داشته باشد.

اینها برخی از مسائلی هستند که واترمارک و شناسایی می‌تواند به حل آنها کمک کنند. شرکت آنتروپیک می‌گوید که علامت‌گذاری آن برای خروجی مدل‌های پشتیبانی شده در هر جایی که «کلود» اجرا می‌شود، از جمله API پلتفرم کلود، برنامه‌های کلود، کلود کد، کلود کوورک و کلود تگ، اعمال می‌شود. دامنه این علامت‌گذاری به محصولات شخص ثالث ساخته شده بر اساس API کلود نیز می‌رسد، زیرا علامت‌گذاری به جای هر رابط کاربری واحد، در خروجی قرار می‌گیرد.

مدل‌هایی که در تاریخ ۲ اوت ۲۰۲۶ یا بعد از آن عرضه شده‌اند، از علامت‌گذاری در زمان عرضه پشتیبانی می‌کنند، در حالی که این شرکت در تلاش است تا آن را در ماه‌های آینده تحت یک دوره انتقالی که قانون اتحادیه اروپا اجازه می‌دهد، به مدل‌های قدیمی‌تر اضافه کند.

اگرچه این الزام، اروپایی است، اما شرکت آنتروپیک از ابتدا واترمارک را در سراسر جهان اعمال می‌کند و می‌گوید هنوز راهی پایدار برای محدود کردن آن بر اساس مناطق مختلف ندارد.

این علامت‌گذاری چگونه کار می‌کند؟ آنتروپیک برای متن، از نسخه‌ای از روش SynthID-Text گوگل دیپ‌مایند استفاده می‌کند. این روش به کاراکتر‌های پنهان یا فراداده‌های متصل به یک سند متکی نیست. در عوض، واترمارک از طریق کلماتی که کلود هنگام تولید متن انتخاب می‌کند، ایجاد می‌شود.

مدل‌های زبانی بزرگ هنگام تولید متن، هر کلمه بعدی را از مجموعه‌ای از کاندیدا‌های محتمل انتخاب می‌کنند. در بسیاری از موقعیت‌ها، چندین کلمه می‌توانند یک جمله را به یک اندازه خوب ادامه دهند، بنابراین انتخاب معمولاً به صورت تصادفی انجام می‌شود.

با واترمارک به سبک SynthID، یک کلید مخفی و متن قبلی بر آن انتخاب تأثیر می‌گذارند. در تعداد کافی از کلمات، آن انتخاب‌های کوچک به یک الگوی آماری تبدیل می‌شوند؛ بنابراین در حالی که متن هنوز به طور طبیعی خوانده می‌شود، اکنون دارای امضایی است که یک آشکارساز با کلید مناسب می‌تواند آن را بررسی کند تا مشخص کند که آیا الگوی انتخاب کلمه آن شبیه به تولید واترمارک «کلود» است یا خیر.

آنتروپیک می‌گوید که این تکنیک هیچ کاراکتری به متن اضافه نمی‌کند، به هیچ توکن اضافی نیاز ندارد، کیفیت خروجی را تغییر نمی‌دهد و هیچ چیزی را که کاربر، سازمان یا چت را شناسایی کند، حمل نمی‌کند.

آنتروپیک برای فایل‌های پشتیبانی شده از یک تکنیک مرسوم‌تر استفاده می‌کند. وقتی کلود فرمت‌هایی مانند PNG، JPG یا SVG تولید می‌کند، یک یادداشت امضا شده با رمزنگاری را در فراداده فایل تحت استاندارد باز C۲PA ضمیمه می‌کند. هیچ چیز در خود تصویر تغییر نمی‌کند، تنها اعتبارنامه ثبت می‌کند که کلود فایل را ساخته یا پردازش کرده است و هیچ اطلاعات شخصی را در خود نگه نمی‌دارد.

سپس یک خواننده سازگار می‌تواند آن اعتبارنامه را بررسی کند و تشخیص دهد که کلود فایل را پردازش کرده است یا خیر. از آنجا که اطلاعات به صورت رمزنگاری امضا شده‌اند، می‌تواند به آشکار شدن اینکه آیا اعتبارنامه یا فایل متعاقباً دستکاری شده است یا خیر نیز کمک کند.

در حالی که آنتروپیک نحوه علامت‌گذاری خروجی متن خود را کشف کرده است، هنوز در حال کشف نحوه تشخیص این علامت‌گذاری‌ها است. آنتروپیک می‌گوید یک API تشخیص واترمارک در حال روی کار آمدن است، اما هنوز نحوه کار آن را نهایی نکرده است. برای فایل‌ها، هر ابزار آگاه از C۲PA می‌تواند اعتبارنامه‌های فایل را بخواند و این شرکت قول بررسی‌کننده‌های خود را داده است.

اکنون شرکت آنتروپیک اذعان می‌کند که نشانه‌هایش سیگنال هستند، نه مدرک قطعی تولید هوش مصنوعی. یک واترمارک شناسایی‌شده فقط نشان می‌دهد که کلود احتمالاً در مقطعی درگیر بوده است، نه اینکه یک انسان به طور کلی آن متن را ننوشته باشد.

از آنجا که واترمارک به هر کلمه‌ای که کلود انتخاب می‌کند متصل می‌شود، نمی‌تواند نویسندگی را از کمک جدا کند. آنتروپیک خاطرنشان می‌کند که نمی‌تواند «کلود این را نوشت» را از «کلود این را به شدت ویرایش کرده است» تشخیص دهد و ترجمه‌ای که کلود تولید می‌کند کاملاً واترمارک شده است، زیرا هر کلمه انتخاب خودش است.

در بخش تشخیص نیز این شرکت اذعان می‌کند که اگرچه ویرایش سبک احتمالاً واترمارک را به طور کامل حذف نمی‌کند، اما یک بازنویسی کامل که در آن هر کلمه جایگزین می‌شود، این کار را انجام خواهد داد که در آن مرحله، متن به هر حال به سختی توسط هوش مصنوعی تولید شده است.

متنی که به شدت ویرایش، بازنویسی، ترجمه یا با نوشته‌های دیگر مخلوط شده باشد، ممکن است به اندازه کافی الگوی آماری کلود را از دست بدهد تا غیرقابل تشخیص شود. در عمل، کسی که عمداً سعی در پنهان کردن دخالت کلود دارد، می‌تواند به سادگی خروجی را به طور قابل توجهی بازنویسی کند.

گزارش خطا
ارسال نظرات
نام
ایمیل
نظر
captcha