شرکت آمریکایی آنتروپیک (Anthropic) جزئیات روشی را منتشر کرده است که با آن می‌توان متن‌های تولیدشده توسط دستیار هوش مصنوعی کلود (Claude) را به‌شکلی پنهان نشانه‌گذاری یا واترمارک کرد. این اقدام به‌منظور سازگاری با قانون تازه شفافیت هوش مصنوعی اتحادیه اروپا صورت می‌گیرد و به کاربران و ناظران اجازه می‌دهد خروجی‌های ماشینی را از نوشته‌های انسانی تشخیص دهند.

واترمارکی که با چشم دیده نمی‌شود

به گزارش خبرگزاری مهر به نقل از انگجت، آنتروپیک تأکید کرده است که این واترمارک‌گذاری شامل عناصر بصری قابل‌مشاهده نیست و خوانندگان عادی هیچ تفاوتی در ظاهر متن احساس نخواهند کرد. همچنین برچسب‌های مخفی نیز به کاراکترهای متن اضافه نمی‌شوند. در عوض، این روش الگویی را در جریان متن ایجاد می‌کند که تنها افرادی با داشتن کلید رمزگشایی قادر به تشخیص آن هستند.

مکانیزم عملکرد بر پایه کلید رمزگشایی

مدل‌های زبانی بزرگ هنگام تولید متن، برای انتخاب هر کلمه بعدی از میان فهرستی از گزینه‌های مناسب، از یک مولد تصادفی استفاده می‌کنند؛ انتخابی که باید با بافت و محتوای متن در حال تولید سازگار باشد. آنتروپیک توضیح می‌دهد که وقتی قابلیت واترمارک فعال باشد، کلود به‌جای مولد تصادفی معمولی، از یک کلید مشخص برای تعیین کلمه بعدی بهره می‌برد.

برای نمونه، این شرکت از ارقام عدد پی (π) به‌عنوان کلید یاد کرده است. فرض کنید کلید از رقم ۲ در دنباله ۳/۱۴۱۵۹۲۶۵۳۵ آغاز شود؛ در این حالت کلمه بعدی، ششمین گزینه از فهرست کلمات ممکن خواهد بود و پس از آن به‌ترتیب گزینه‌های پنجم، سوم و دوباره پنجم انتخاب می‌شوند. به این ترتیب الگویی در متن شکل می‌گیرد که با دانستن کلید، قابل ردیابی و رمزگشایی است.

الگوبرداری از روش گوگل دیپ‌مایند

این رویکرد اقتباسی از روش SynthID-Text شرکت گوگل دیپ‌مایند است؛ روشی که تیم تحقیقاتی آن در مقاله‌ای در مجله علمی Nature تشریح کرده است. به گفته آنتروپیک، واترمارک‌گذاری تأثیری بر کیفیت خروجی کلود ندارد و سرعت تولید متن را نیز کاهش نمی‌دهد.

بدون هزینه اضافی برای تولیدکنندگان

این شرکت همچنین اعلام کرده است که اجرای این قابلیت به توکن‌های اضافی نیاز ندارد و هزینه تولید متن را افزایش نمی‌دهد. به این ترتیب، توسعه‌دهندگان و کاربران می‌توانند بدون پرداخت هزینه‌ای بیشتر، متونی تولید کنند که به‌صورت پنهان قابل ردیابی باشند.

این اقدام آنتروپیک در حالی صورت می‌گیرد که قانونگذاران در اروپا و دیگر مناطق جهان بر شفافیت بیشتر در قبال محتوای تولیدشده توسط هوش مصنوعی تأکید دارند و انتظار می‌رود سایر شرکت‌های فعال در این حوزه نیز به‌زودی ابزارهای مشابهی را معرفی کنند.