1

شرکت آنتروپیک اعلام کرد که برای رعایت مقررات جدید اتحادیه اروپا در زمینه شفافیت هوش مصنوعی، متن‌های تولیدشده با مدل‌های Claude را به‌صورت نامحسوس واترمارک می‌کند. این واترمارک ظاهری قابل مشاهده ندارد، برای خواننده قابل تشخیص نیست و شامل افزودن نویسه‌های پنهان به متن نیز نمی‌شود. در عوض، آنتروپیک الگویی را در متن ایجاد می‌کند که تنها با استفاده از کلید مربوطه قابل شناسایی و رمزگشایی است.

آنتروپیک توضیح داده که مدل‌های زبانی بزرگ هنگام تولید متن، در هر مرحله یکی از چندین واژه مناسب را انتخاب می‌کنند. این انتخاب معمولاً به‌صورت تصادفی و با توجه به سازگاری واژه با متن انجام می‌شود. در روش جدید، Claude به‌جای استفاده از یک مولد اعداد تصادفی، از یک کلید برای تعیین واژه بعدی استفاده می‌کند و به این ترتیب الگویی ویژه در متن ایجاد می‌شود. آنتروپیک برای توضیح این روش از ارقام عدد پی به‌عنوان نمونه یک کلید استفاده کرده است.

برای مثال، اگر کلید با رقم 2 از دنباله 3.1415926535 آغاز شود، مدل بر اساس این کلید، واژه ششم از فهرست گزینه‌های موجود را انتخاب می‌کند و سپس به‌ترتیب واژه‌های پنجم، سوم و دوباره پنجم را برمی‌گزیند. این روش اقتباسی از فناوری SynthID-Text شرکت Google DeepMind است که جزئیات آن در مقاله‌ای منتشرشده در نشریه Nature تشریح شده است. به گفته آنتروپیک، واترمارک‌گذاری تأثیری بر کیفیت خروجی Claude یا سرعت تولید متن ندارد و به توکن‌های اضافی یا افزایش هزینه تولید نیز نیازمند نیست.

متن‌های تولیدشده با هوش مصنوعی معمولاً نشانه‌هایی سبکی دارند که می‌توانند احتمال استفاده از هوش مصنوعی را آشکار کنند؛ برای مثال، مدل‌ها تمایل دارند از برخی الگوهای جمله‌بندی خاص استفاده کنند. با این حال، چنین نشانه‌هایی صرفاً می‌توانند احتمال دخالت هوش مصنوعی در تولید متن را نشان دهند و مشخص نمی‌کنند که متن با کدام مدل تولید شده است. آنتروپیک قصد دارد رابط برنامه‌نویسی کاربردی (API) ویژه‌ای ارائه کند که با استفاده از کلیدهای مربوط به واترمارک بتواند مشخص کند آیا Claude در تولید متن مورد بررسی نقش داشته است یا خیر.

البته روش واترمارک‌گذاری متنی آنتروپیک محدودیت‌هایی نیز دارد. این فناوری نمی‌تواند تشخیص دهد که Claude متن را از ابتدا تولید کرده یا صرفاً آن را ویرایش کرده است. در نتیجه، اگر کاربر متنی را برای ویرایش در اختیار Claude قرار دهد، احتمال دارد نسخه ویرایش‌شده نیز واترمارک شود. این فناوری در واقع تنها می‌تواند نشان دهد که Claude احتمالاً در مقطعی در فرایند تولید یا ویرایش متن نقش داشته است. ترجمه متن نیز ممکن است مشمول واترمارک شود.

با این حال، اگر Claude صرفاً متن را به‌صورت جزئی ویرایش یا تصحیح کرده باشد، یا متن بیش از حد کوتاه باشد، ممکن است واترمارک به اندازه کافی قابل تشخیص نباشد. همچنین ویرایش جزئی یک متن تولیدشده با Claude لزوماً واترمارک آن را از بین نمی‌برد و برای حذف مطمئن آن، بازنویسی کامل متن ضروری خواهد بود. واترمارک‌گذاری کدهای برنامه‌نویسی نیز نگرانی‌هایی ایجاد کرده است؛ زیرا کد تولیدشده با هوش مصنوعی ممکن است بدون میزان قابل‌توجهی از دخالت انسانی از حمایت‌های حقوقی مشابه برخوردار نباشد.

با این حال، آنتروپیک می‌گوید کد معمولاً در مقایسه با سایر انواع متن، واترمارک کمتری خواهد داشت، زیرا تولید کد اغلب به خروجی دقیق و مشخص نیاز دارد. هرگاه در فرایند تولید، گزینه‌های جایگزین چندانی برای انتخاب وجود نداشته باشد، امکان اعمال واترمارک نیز کاهش می‌یابد. آنتروپیک همچنین تصاویر تولیدشده با Claude را واترمارک خواهد کرد. در این روش، یادداشتی با امضای رمزنگاری‌شده در فراداده تصویر قرار می‌گیرد که نشان می‌دهد تصویر با Claude تولید شده است.

این شرکت اعلام کرده است که در زمان آغاز اجرای این طرح، واترمارک‌گذاری را برای تمامی خروجی‌های Claude اعمال می‌کند، زیرا در حال حاضر راهکار مطمئنی برای اجرای این تغییرات به‌صورت منطقه‌ای در اختیار ندارد. این تغییرات تمام محصولات Claude را که از مدل‌های عرضه‌شده پس از 2 آگوست استفاده می‌کنند، تحت تأثیر قرار خواهد داد و آنتروپیک قصد دارد قابلیت واترمارک‌گذاری را طی ماه‌های آینده به مدل‌های قدیمی‌تر Claude نیز اضافه کند.