آنتروپیک جزئیات بیشتری از واترمارک نامرئی Claude منتشر کرد

آنتروپیک جزئیات بیشتری از واترمارک نامرئی Claude منتشر کرد؛ ویرایش متن هم همیشه آن را حذف نمی‌کند

آنتروپیک جزئیات فنی بیشتری درباره سیستم واترمارک‌گذاری متن‌های تولیدشده توسط Claude منتشر کرده است. این واترمارک برای خواننده قابل مشاهده نیست، اما شرکت می‌گوید ابزارهای مخصوص می‌توانند وجود آن را تشخیص دهند. آنتروپیک همچنین توضیح داده که ویرایش متن، استفاده از Claude برای ویرایش نوشته‌های انسانی و حتی تولید کد چه تأثیری روی این سیستم خواهد داشت.

آنتروپیک در حالی درباره سازوکار واترمارک Claude توضیح داده که تصمیم این شرکت برای علامت‌گذاری محتوای تولیدشده با هوش مصنوعی، طی روزهای اخیر واکنش‌های مختلفی میان کاربران این چت‌بات به همراه داشته است. این تصمیم بخشی از تلاش آنتروپیک برای هماهنگ شدن با الزامات قانون هوش مصنوعی اتحادیه اروپا (EU AI Act) و کد شفافیت این قانون است.

واترمارک Claude دقیقاً چگونه کار می‌کند؟

واترمارک موردنظر آنتروپیک قرار نیست به شکل یک نوشته، لوگو یا علامت قابل مشاهده روی خروجی Claude ظاهر شود. ایده اصلی بسیار ظریف‌تر است.

مدل هنگام تولید متن در بعضی انتخاب‌های کم‌اهمیت، آزادی عمل زیادی دارد. برای مثال، هنگام توصیف یک روز ابری ممکن است از واژه‌هایی مانند «ابری»، «خاکستری» یا معادل‌های دیگری استفاده کند. آنتروپیک می‌تواند از همین انتخاب‌های کوچک برای ایجاد یک الگوی آماری مشخص در متن استفاده کند.

این الگو برای خواننده عادی قابل تشخیص نیست، اما فرد یا سیستمی که کلید تشخیص مربوط به واترمارک را در اختیار داشته باشد، می‌تواند آن را شناسایی کند.

آنتروپیک تأکید کرده که این فرایند نباید کیفیت خروجی Claude را تغییر دهد. به بیان ساده، اگر کاربر یک پاسخ واترمارک‌شده و یک پاسخ بدون واترمارک را کنار هم بگذارد، نباید بتواند صرفاً با خواندن متن تشخیص دهد کدام‌یک علامت‌گذاری شده است. از دید فنی، این نکته مهم است؛ چون واترمارک زمانی ارزش دارد که به قیمت افت محسوس کیفیت پاسخ‌ها تمام نشود.

آنتروپیک از فناوری SynthID-Text استفاده می‌کند

آنتروپیک اعلام کرده سیستم خود را بر پایه روش SynthID-Text توسعه خواهد داد؛ فناوری‌ای که تیم Google DeepMind در سال ۲۰۲۴ برای واترمارک‌گذاری متن‌های تولیدشده توسط مدل‌های هوش مصنوعی معرفی کرد.

این شرکت همچنین قصد دارد یک API برای تشخیص واترمارک ارائه کند. چنین ابزاری می‌تواند در آینده برای سرویس‌هایی که نیاز دارند منشأ محتوای متنی را بررسی کنند، کاربرد داشته باشد. البته نباید واترمارک Claude را با ابزارهای رایج تشخیص متن تولیدشده توسط هوش مصنوعی یکی دانست.

سیستم‌های AI Detector معمولاً به دنبال الگوهای زبانی و آماری در نوشته می‌گردند؛ مثلاً نوع انتخاب واژه‌ها، ساختار جمله‌ها یا الگوهایی که احتمال می‌دهند بیشتر در نوشته‌های تولیدشده توسط مدل‌های زبانی دیده شوند. واترمارک رویکرد متفاوتی دارد و از ابتدا یک نشانه رمزگذاری‌شده را در زمان تولید متن قرار می‌دهد تا بعداً قابل بررسی باشد.

این تفاوت می‌تواند اهمیت زیادی داشته باشد، چون تشخیص بر اساس سبک نوشتار همیشه با عدم قطعیت همراه است، اما واترمارک به یک نشانه از پیش ایجادشده تکیه می‌کند.

آیا با بازنویسی متن می‌توان واترمارک Claude را حذف کرد؟

بله، اما نه لزوماً با یک ویرایش ساده. آنتروپیک می‌گوید ویرایش‌های سبک احتمالاً واترمارک را به‌طور کامل از بین نمی‌برند. اگر کاربر چند جمله را تغییر دهد، تعدادی از کلمات را جابه‌جا کند یا متن را کمی روان‌تر بنویسد، احتمال باقی ماندن بخشی از الگوی واترمارک وجود دارد.

ماجرا زمانی متفاوت می‌شود که متن کاملاً بازنویسی شود و تقریباً تمام کلمات آن تغییر کنند. طبق توضیح آنتروپیک، چنین بازنویسی گسترده‌ای می‌تواند واترمارک را از بین ببرد.

البته خود شرکت به یک نکته جالب اشاره کرده است: اگر تمام متن از نو نوشته شود، دیگر مشخص نیست بتوان چنین نوشته‌ای را همچنان یک متن «تولیدشده توسط هوش مصنوعی» دانست یا نه.

این موضوع یکی از نقاط ضعف طبیعی هر سیستم واترمارک متنی است. برخلاف تصویر یا ویدئو، متن را می‌توان به‌سادگی تغییر داد، بازنویسی کرد یا از یک مدل زبانی دیگر برای بازتولید آن استفاده کرد.

اگر Claude فقط متن انسان را ویرایش کند چه می‌شود؟

یکی از پرسش‌های مهم درباره این فناوری به استفاده‌های ترکیبی مربوط می‌شود. فرض کنید یک کاربر خودش مقاله‌ای نوشته و سپس آن را برای اصلاح نگارشی، روان‌تر شدن جمله‌ها یا ویرایش ساختاری به Claude می‌دهد. آیا نسخه نهایی همچنان واترمارک خواهد داشت؟ آنتروپیک می‌گوید پاسخ به میزان ویرایش و طول متن بستگی دارد.

اگر Claude فقط تغییرات جزئی انجام دهد، بخش عمده متن همچنان توسط انسان نوشته شده است. در چنین شرایطی، فضای زیادی برای اعمال واترمارک روی متن وجود ندارد. اما اگر مدل بخش‌های بزرگی از نوشته را بازنویسی کند، احتمال حضور واترمارک بیشتر می‌شود.

این مسئله برای نویسندگان، دانشجویان و شرکت‌هایی که از Claude به‌عنوان ابزار ویرایش استفاده می‌کنند، اهمیت ویژه‌ای دارد؛ چون مرز میان «متن نوشته‌شده توسط انسان» و «متن تولیدشده توسط AI» در چنین سناریویی دیگر کاملاً مشخص نیست.

واترمارک در کد برنامه‌نویسی ضعیف‌تر خواهد بود

در مورد کد، شرایط کمی متفاوت است. مدل زبانی هنگام نوشتن یک برنامه معمولاً آزادی محدودی برای انتخاب میان گزینه‌های مختلف دارد. یک قطعه کد باید سینتکس مشخصی داشته باشد و در بسیاری از مواقع تنها چند روش منطقی برای انجام یک کار وجود دارد.

در چنین شرایطی، فرصت کمتری برای ایجاد الگوهای واترمارک وجود دارد. آنتروپیک گفته است که میزان واترمارک در کد نسبت به متن معمولی کمتر خواهد بود. با این حال، بخش‌هایی مانند کامنت‌ها یا نام‌گذاری‌هایی که انتخاب‌های بیشتری در آن‌ها وجود دارد، می‌توانند محل اعمال واترمارک باشند.

نکته مهم این است که آنتروپیک می‌گوید این فرایند نباید تأثیر قابل‌توجهی روی خود کد داشته باشد. یعنی واترمارک قرار نیست باعث شود برنامه‌ای که Claude تولید کرده دیگر قابل اجرا نباشد یا منطق آن تغییر کند.

Claude تنها چت‌باتی نیست که به سمت واترمارک می‌رود

آنتروپیک همچنین تأکید کرده که Claude قرار نیست تنها مدل زبانی بزرگ با چنین قابلیتی باشد. به گفته این شرکت، تعدادی از توسعه‌دهندگان بزرگ مدل‌های هوش مصنوعی به همان Code of Practice مرتبط با قانون هوش مصنوعی اتحادیه اروپا متعهد شده‌اند و آن‌ها نیز در حال پیاده‌سازی سیستم‌های واترمارک برای محتوای تولیدشده توسط مدل‌های خود هستند.

این یعنی واترمارک متن احتمالاً به یکی از ویژگی‌های رایج سرویس‌های هوش مصنوعی تبدیل خواهد شد؛ مخصوصاً در اروپا که شرکت‌های فعال در این حوزه با فشار بیشتری برای شفاف‌سازی منشأ محتوای تولیدشده توسط AI روبه‌رو هستند.

از نگاه کاربران، بخش بحث‌برانگیز ماجرا جای دیگری است. واترمارک قرار نیست جلوی تولید متن با Claude را بگیرد و حتی ظاهراً برای خواننده قابل مشاهده نیست. مسئله اصلی این است که یک لایه تشخیص به خروجی مدل اضافه می‌شود که می‌تواند بعداً برای مشخص کردن منشأ آن مورد استفاده قرار بگیرد.

این قابلیت برای مبارزه با جعل محتوا و شفاف‌تر شدن منشأ نوشته‌ها می‌تواند مفید باشد، اما هم‌زمان پرسش‌های تازه‌ای درباره حریم خصوصی، استفاده آموزشی و دانشگاهی، و تفاوت میان «کمک گرفتن از AI» و «تولید کامل محتوا با AI» ایجاد می‌کند.

با توجه به اینکه بازنویسی کامل می‌تواند واترمارک را از بین ببرد، بعید است این فناوری به‌تنهایی بتواند مسئله تشخیص محتوای هوش مصنوعی را برای همیشه حل کند. ارزش اصلی آن احتمالاً در ایجاد یک سیگنال قابل اعتماد برای متن‌هایی خواهد بود که مستقیماً از مدل خارج شده‌اند و دستکاری جدی روی آن‌ها انجام نشده است.

همچنین بخوانید

افشای یک مورد تازه از رفتار خارج از کنترل ایجنت‌های OpenAI در آلمان

افشای یک مورد تازه از رفتار خارج از کنترل ایجنت‌های OpenAI در آلمان

براساس گزارش گروهی از ایجنت‌های هوش مصنوعی OpenAI در ماه مه ۲۰۲۶ کنترل یک وب‌سایت …

رویداد ۹ سپتامبر اپل، آیفون ۱۸ پرو، آیفون تاشو و اپل واچ جدید

رویداد ۹ سپتامبر اپل، آیفون ۱۸ پرو، آیفون تاشو و اپل واچ جدید

اپل چهارشنبه ۹ سپتامبر رویداد معرفی محصولات جدید خود را در اپل پارک برگزار می‌کند؛ …