سایر زبان ها

صفحه نخست

فیلم

عکس

ورزشی

اجتماعی

باشگاه جوانی

سیاسی

فرهنگ و هنر

اقتصادی

هوش مصنوعی، علم و فناوری

بین الملل

استان ها

رسانه ها

بازار

صفحات داخلی

کلود به متن‌هایش واترمارک مخفی می‌زند

۱۴۰۵/۰۵/۲۵ - ۲۰:۰۰:۰۲
کد خبر: ۲۳۷۷۵۷۷
برنا – گروه علمی و فناوری: آنتروپیک برای رعایت قوانین جدید اتحادیه اروپا الگوی نامرئی در متن‌های تولیدشده توسط کلود ایجاد می‌کند تا منشأ آنها قابل شناسایی باشد.

شرکت آنتروپیک از روش جدید خود برای واترمارک‌گذاری متن‌های تولیدشده توسط مدل‌های هوش مصنوعی کلود خبر داده است. این روشی با هدف رعایت مقررات جدید اتحادیه اروپا درباره شفافیت محتوای تولیدشده توسط هوش مصنوعی طراحی شده و بدون ایجاد نشانه‌ای قابل مشاهده برای خوانندگان امکان شناسایی متن تولیدشده توسط کلود را فراهم می‌کند.

به گزارش گروه ترجمه خبرگزاری برنا به نقل از انگجت، بر اساس توضیحات آنتروپیک واترمارک متنی این شرکت به شکل ظاهری و قابل مشاهده روی نوشته قرار نمی‌گیرد و هیچ کاراکتر پنهانی نیز به متن اضافه نمی‌شود. در عوض الگویی در نحوه انتخاب کلمات ایجاد می‌شود که تنها فرد یا سامانه‌ای که کلید رمزگشایی آن را در اختیار داشته باشد می‌تواند آن را شناسایی کند.

انتخاب کلمات پایه واترمارک کلود

مدل‌های زبانی بزرگ هنگام تولید متن کلمات بعدی را از میان مجموعه‌ای از گزینه‌های مناسب برای ادامه جمله انتخاب می‌کنند. این انتخاب معمولا با استفاده از یک فرایند تصادفی انجام می‌شود تا متن طبیعی‌تر و متنوع‌تر باشد.

آنتروپیک در روش جدید خود این فرایند را با یک کلید مشخص ترکیب می‌کند. به این ترتیب کلود به‌جای استفاده از یک عدد تصادفی برای انتخاب کلمه بعدی از کلید واترمارک برای تعیین اینکه کدام گزینه از فهرست انتخاب شود استفاده می‌کند. نتیجه این فرایند الگویی آماری در متن است که برای خواننده عادی قابل تشخیص نیست، اما می‌توان آن را با استفاده از کلید مربوطه شناسایی کرد.

آنتروپیک برای توضیح این روش از ارقام عدد پی به‌عنوان نمونه یک کلید استفاده کرده است. برای مثال اگر رقم آغازین کلید عدد ۲ باشد مدل بر اساس این الگو یکی از کلمات موجود در فهرست گزینه‌های خود را انتخاب می‌کند و در ادامه نیز ارقام بعدی کلید، ترتیب انتخاب کلمات را تعیین می‌کنند.

این فناوری در واقع اقتباسی از روش SynthID-Text شرکت گوگل دیپ‌مایند است، روشی که جزئیات آن پیش‌تر در یک مقاله علمی در نشریه Nature تشریح شده است.

بدون افت کیفیت و افزایش هزینه

آنتروپیک می‌گوید فعال شدن واترمارک تاثیری بر کیفیت خروجی کلود یا سرعت تولید متن نخواهد داشت. همچنین برای اعمال این روش به توکن‌های اضافی نیاز نیست و در نتیجه هزینه تولید پاسخ‌ها نیز افزایش پیدا نمی‌کند.

این ویژگی اهمیت زیادی دارد، زیرا روش‌های واترمارک‌گذاری می‌توانند در صورت ایجاد محدودیت در فرایند تولید، کیفیت خروجی مدل‌های زبانی را کاهش دهند یا زمان و هزینه پردازش را افزایش دهند.

از سوی دیگر متن‌های تولیدشده توسط هوش مصنوعی گاهی از طریق الگو‌های زبانی خاص قابل تشخیص هستند. برای نمونه، مدل‌های زبانی تمایل دارند از ساختار‌های جمله‌ای مشخصی استفاده کنند. با این حال چنین نشانه‌هایی معمولا تنها می‌توانند احتمال استفاده از هوش مصنوعی را نشان دهند و مشخص نمی‌کنند متن دقیقاً توسط کدام مدل تولید شده است.

آنتروپیک قصد دارد یک API تشخیص واترمارک نیز ارائه کند که کلید‌های لازم برای رمزگشایی الگوی ایجادشده را در اختیار سامانه‌های تشخیص قرار می‌دهد. این API می‌تواند بررسی کند که آیا یک قطعه متن به احتمال زیاد در مقطعی توسط کلود تولید شده است یا خیر.

واترمارک لزوما ثابت نمی‌کند کلود متن را از ابتدا نوشته است

آنتروپیک در عین حال تاکید کرده است که فناوری جدید محدودیت‌هایی دارد. مهم‌ترین محدودیت این است که واترمارک نمی‌تواند مشخص کند کلود متن را از ابتدا تولید کرده یا فقط در ویرایش آن نقش داشته است. برای مثال اگر کاربر متنی را در اختیار کلود قرار دهد و از این مدل بخواهد آن را ویرایش کند نسخه ویرایش‌شده نیز ممکن است دارای واترمارک باشد؛ بنابراین نتیجه آزمایش صرفا می‌تواند نشان دهد که کلود احتمالا در بخشی از فرایند تولید یا ویرایش متن دخالت داشته است.

ترجمه متن نیز ممکن است واترمارک دریافت کند. با این حال اگر کلود تنها اصلاحات بسیار جزئی و ویرایش‌های سبک روی یک متن انجام داده باشد یا متن مورد بررسی بیش از حد کوتاه باشد الگوی واترمارک ممکن است به اندازه کافی قوی نباشد و قابل تشخیص نباشد.
آنتروپیک همچنین می‌گوید ویرایش جزئی یک متن تولیدشده توسط کلود لزوما واترمارک آن را از بین نمی‌برد. برای حذف مطمئن این الگو متن باید به‌طور کامل بازنویسی شود.

واترمارک‌گذاری کد دشوارتر است

یکی دیگر از چالش‌های مطرح‌شده، اعمال واترمارک روی کد‌های برنامه‌نویسی است. از آنجا که کد معمولا به خروجی دقیق و مشخص نیاز دارد، فضای کمتری برای انتخاب میان کلمات یا عبارات مختلف وجود دارد.

آنتروپیک اعلام کرده است که کد‌ها در مقایسه با بسیاری از انواع دیگر متن معمولا واترمارک کمتری خواهند داشت. دلیل آن نیز مشخص است: اگر در فرایند تولید کد گزینه‌های جایگزین کمی وجود داشته باشد یا مدل مجبور باشد دقیقا یک خروجی مشخص را تولید کند امکان اعمال الگوی واترمارک کاهش پیدا می‌کند.

این موضوع از منظر حقوقی نیز اهمیت دارد زیرا در برخی نظام‌های حقوقی تعیین میزان نقش انسان در تولید کد می‌تواند بر موضوعاتی مانند مالکیت و قابلیت حمایت از اثر تأثیر بگذارد.

واترمارک رمزنگاری‌شده برای تصاویر کلود

آنتروپیک تنها به متن محدود نمانده و برای تصاویر تولیدشده توسط کلود نیز سازوکار واترمارک در نظر گرفته است. این شرکت اعلام کرده که در متادیتای تصاویر تولیدشده، یک یادداشت دارای امضای رمزنگاری‌شده قرار می‌دهد که مشخص می‌کند تصویر توسط کلود تولید شده است. در نتیجه برخلاف واترمارک متنی که در ساختار انتخاب کلمات پنهان می‌شود شناسایی منشا تصاویر از طریق اطلاعات رمزنگاری‌شده موجود در متادیتا انجام خواهد شد.

اعمال واترمارک روی همه خروجی‌های کلود

آنتروپیک اعلام کرده است که در زمان آغاز اجرای این طرح واترمارک را روی همه خروجی‌های کلود اعمال می‌کند. دلیل این تصمیم آن است که شرکت در حال حاضر راه مطمئنی برای اجرای این تغییرات به تفکیک مناطق جغرافیایی ندارد.

این تغییرات برای خروجی محصولاتی از کلود که از مدل‌های عرضه‌شده پس از ۲ اوت ۲۰۲۶ استفاده می‌کنند اعمال خواهد شد. آنتروپیک همچنین قصد دارد طی ماه‌های آینده قابلیت واترمارک‌گذاری را به مدل‌های قدیمی‌تر کلود نیز اضافه کند.

اقدام آنتروپیک در حالی انجام می‌شود که قوانین جدید اتحادیه اروپا، شرکت‌های ارائه‌دهنده سامانه‌های هوش مصنوعی را به شفافیت بیشتر درباره محتوای تولیدشده توسط این فناوری ملزم می‌کند. بر همین اساس شرکت‌های فعال در حوزه هوش مصنوعی به‌تدریج در حال توسعه روش‌هایی برای علامت‌گذاری و قابل‌تشخیص کردن محتوای تولیدشده توسط مدل‌های خود هستند هرچند روش اجرای این الزام در متن، تصویر، ویدئو و سایر انواع محتوا متفاوت است.

انتهای پیام/

نظر شما