کلود به متنهایش واترمارک مخفی میزند
شرکت آنتروپیک از روش جدید خود برای واترمارکگذاری متنهای تولیدشده توسط مدلهای هوش مصنوعی کلود خبر داده است. این روشی با هدف رعایت مقررات جدید اتحادیه اروپا درباره شفافیت محتوای تولیدشده توسط هوش مصنوعی طراحی شده و بدون ایجاد نشانهای قابل مشاهده برای خوانندگان امکان شناسایی متن تولیدشده توسط کلود را فراهم میکند.
به گزارش گروه ترجمه خبرگزاری برنا به نقل از انگجت، بر اساس توضیحات آنتروپیک واترمارک متنی این شرکت به شکل ظاهری و قابل مشاهده روی نوشته قرار نمیگیرد و هیچ کاراکتر پنهانی نیز به متن اضافه نمیشود. در عوض الگویی در نحوه انتخاب کلمات ایجاد میشود که تنها فرد یا سامانهای که کلید رمزگشایی آن را در اختیار داشته باشد میتواند آن را شناسایی کند.
انتخاب کلمات پایه واترمارک کلود
مدلهای زبانی بزرگ هنگام تولید متن کلمات بعدی را از میان مجموعهای از گزینههای مناسب برای ادامه جمله انتخاب میکنند. این انتخاب معمولا با استفاده از یک فرایند تصادفی انجام میشود تا متن طبیعیتر و متنوعتر باشد.
آنتروپیک در روش جدید خود این فرایند را با یک کلید مشخص ترکیب میکند. به این ترتیب کلود بهجای استفاده از یک عدد تصادفی برای انتخاب کلمه بعدی از کلید واترمارک برای تعیین اینکه کدام گزینه از فهرست انتخاب شود استفاده میکند. نتیجه این فرایند الگویی آماری در متن است که برای خواننده عادی قابل تشخیص نیست، اما میتوان آن را با استفاده از کلید مربوطه شناسایی کرد.
آنتروپیک برای توضیح این روش از ارقام عدد پی بهعنوان نمونه یک کلید استفاده کرده است. برای مثال اگر رقم آغازین کلید عدد ۲ باشد مدل بر اساس این الگو یکی از کلمات موجود در فهرست گزینههای خود را انتخاب میکند و در ادامه نیز ارقام بعدی کلید، ترتیب انتخاب کلمات را تعیین میکنند.
این فناوری در واقع اقتباسی از روش SynthID-Text شرکت گوگل دیپمایند است، روشی که جزئیات آن پیشتر در یک مقاله علمی در نشریه Nature تشریح شده است.
بدون افت کیفیت و افزایش هزینه
آنتروپیک میگوید فعال شدن واترمارک تاثیری بر کیفیت خروجی کلود یا سرعت تولید متن نخواهد داشت. همچنین برای اعمال این روش به توکنهای اضافی نیاز نیست و در نتیجه هزینه تولید پاسخها نیز افزایش پیدا نمیکند.
این ویژگی اهمیت زیادی دارد، زیرا روشهای واترمارکگذاری میتوانند در صورت ایجاد محدودیت در فرایند تولید، کیفیت خروجی مدلهای زبانی را کاهش دهند یا زمان و هزینه پردازش را افزایش دهند.
از سوی دیگر متنهای تولیدشده توسط هوش مصنوعی گاهی از طریق الگوهای زبانی خاص قابل تشخیص هستند. برای نمونه، مدلهای زبانی تمایل دارند از ساختارهای جملهای مشخصی استفاده کنند. با این حال چنین نشانههایی معمولا تنها میتوانند احتمال استفاده از هوش مصنوعی را نشان دهند و مشخص نمیکنند متن دقیقاً توسط کدام مدل تولید شده است.
آنتروپیک قصد دارد یک API تشخیص واترمارک نیز ارائه کند که کلیدهای لازم برای رمزگشایی الگوی ایجادشده را در اختیار سامانههای تشخیص قرار میدهد. این API میتواند بررسی کند که آیا یک قطعه متن به احتمال زیاد در مقطعی توسط کلود تولید شده است یا خیر.
واترمارک لزوما ثابت نمیکند کلود متن را از ابتدا نوشته است
آنتروپیک در عین حال تاکید کرده است که فناوری جدید محدودیتهایی دارد. مهمترین محدودیت این است که واترمارک نمیتواند مشخص کند کلود متن را از ابتدا تولید کرده یا فقط در ویرایش آن نقش داشته است. برای مثال اگر کاربر متنی را در اختیار کلود قرار دهد و از این مدل بخواهد آن را ویرایش کند نسخه ویرایششده نیز ممکن است دارای واترمارک باشد؛ بنابراین نتیجه آزمایش صرفا میتواند نشان دهد که کلود احتمالا در بخشی از فرایند تولید یا ویرایش متن دخالت داشته است.
ترجمه متن نیز ممکن است واترمارک دریافت کند. با این حال اگر کلود تنها اصلاحات بسیار جزئی و ویرایشهای سبک روی یک متن انجام داده باشد یا متن مورد بررسی بیش از حد کوتاه باشد الگوی واترمارک ممکن است به اندازه کافی قوی نباشد و قابل تشخیص نباشد.
آنتروپیک همچنین میگوید ویرایش جزئی یک متن تولیدشده توسط کلود لزوما واترمارک آن را از بین نمیبرد. برای حذف مطمئن این الگو متن باید بهطور کامل بازنویسی شود.
واترمارکگذاری کد دشوارتر است
یکی دیگر از چالشهای مطرحشده، اعمال واترمارک روی کدهای برنامهنویسی است. از آنجا که کد معمولا به خروجی دقیق و مشخص نیاز دارد، فضای کمتری برای انتخاب میان کلمات یا عبارات مختلف وجود دارد.
آنتروپیک اعلام کرده است که کدها در مقایسه با بسیاری از انواع دیگر متن معمولا واترمارک کمتری خواهند داشت. دلیل آن نیز مشخص است: اگر در فرایند تولید کد گزینههای جایگزین کمی وجود داشته باشد یا مدل مجبور باشد دقیقا یک خروجی مشخص را تولید کند امکان اعمال الگوی واترمارک کاهش پیدا میکند.
این موضوع از منظر حقوقی نیز اهمیت دارد زیرا در برخی نظامهای حقوقی تعیین میزان نقش انسان در تولید کد میتواند بر موضوعاتی مانند مالکیت و قابلیت حمایت از اثر تأثیر بگذارد.
واترمارک رمزنگاریشده برای تصاویر کلود
آنتروپیک تنها به متن محدود نمانده و برای تصاویر تولیدشده توسط کلود نیز سازوکار واترمارک در نظر گرفته است. این شرکت اعلام کرده که در متادیتای تصاویر تولیدشده، یک یادداشت دارای امضای رمزنگاریشده قرار میدهد که مشخص میکند تصویر توسط کلود تولید شده است. در نتیجه برخلاف واترمارک متنی که در ساختار انتخاب کلمات پنهان میشود شناسایی منشا تصاویر از طریق اطلاعات رمزنگاریشده موجود در متادیتا انجام خواهد شد.
اعمال واترمارک روی همه خروجیهای کلود
آنتروپیک اعلام کرده است که در زمان آغاز اجرای این طرح واترمارک را روی همه خروجیهای کلود اعمال میکند. دلیل این تصمیم آن است که شرکت در حال حاضر راه مطمئنی برای اجرای این تغییرات به تفکیک مناطق جغرافیایی ندارد.
این تغییرات برای خروجی محصولاتی از کلود که از مدلهای عرضهشده پس از ۲ اوت ۲۰۲۶ استفاده میکنند اعمال خواهد شد. آنتروپیک همچنین قصد دارد طی ماههای آینده قابلیت واترمارکگذاری را به مدلهای قدیمیتر کلود نیز اضافه کند.
اقدام آنتروپیک در حالی انجام میشود که قوانین جدید اتحادیه اروپا، شرکتهای ارائهدهنده سامانههای هوش مصنوعی را به شفافیت بیشتر درباره محتوای تولیدشده توسط این فناوری ملزم میکند. بر همین اساس شرکتهای فعال در حوزه هوش مصنوعی بهتدریج در حال توسعه روشهایی برای علامتگذاری و قابلتشخیص کردن محتوای تولیدشده توسط مدلهای خود هستند هرچند روش اجرای این الزام در متن، تصویر، ویدئو و سایر انواع محتوا متفاوت است.
انتهای پیام/