آنتروپیک جزئیات فنی بیشتری درباره سیستم واترمارکگذاری متنهای تولیدشده توسط Claude منتشر کرده است. این واترمارک برای خواننده قابل مشاهده نیست، اما شرکت میگوید ابزارهای مخصوص میتوانند وجود آن را تشخیص دهند. آنتروپیک همچنین توضیح داده که ویرایش متن، استفاده از Claude برای ویرایش نوشتههای انسانی و حتی تولید کد چه تأثیری روی این سیستم خواهد داشت.
آنتروپیک در حالی درباره سازوکار واترمارک Claude توضیح داده که تصمیم این شرکت برای علامتگذاری محتوای تولیدشده با هوش مصنوعی، طی روزهای اخیر واکنشهای مختلفی میان کاربران این چتبات به همراه داشته است. این تصمیم بخشی از تلاش آنتروپیک برای هماهنگ شدن با الزامات قانون هوش مصنوعی اتحادیه اروپا (EU AI Act) و کد شفافیت این قانون است.
واترمارک Claude دقیقاً چگونه کار میکند؟
واترمارک موردنظر آنتروپیک قرار نیست به شکل یک نوشته، لوگو یا علامت قابل مشاهده روی خروجی Claude ظاهر شود. ایده اصلی بسیار ظریفتر است.
مدل هنگام تولید متن در بعضی انتخابهای کماهمیت، آزادی عمل زیادی دارد. برای مثال، هنگام توصیف یک روز ابری ممکن است از واژههایی مانند «ابری»، «خاکستری» یا معادلهای دیگری استفاده کند. آنتروپیک میتواند از همین انتخابهای کوچک برای ایجاد یک الگوی آماری مشخص در متن استفاده کند.
این الگو برای خواننده عادی قابل تشخیص نیست، اما فرد یا سیستمی که کلید تشخیص مربوط به واترمارک را در اختیار داشته باشد، میتواند آن را شناسایی کند.
آنتروپیک تأکید کرده که این فرایند نباید کیفیت خروجی Claude را تغییر دهد. به بیان ساده، اگر کاربر یک پاسخ واترمارکشده و یک پاسخ بدون واترمارک را کنار هم بگذارد، نباید بتواند صرفاً با خواندن متن تشخیص دهد کدامیک علامتگذاری شده است. از دید فنی، این نکته مهم است؛ چون واترمارک زمانی ارزش دارد که به قیمت افت محسوس کیفیت پاسخها تمام نشود.
آنتروپیک از فناوری SynthID-Text استفاده میکند
آنتروپیک اعلام کرده سیستم خود را بر پایه روش SynthID-Text توسعه خواهد داد؛ فناوریای که تیم Google DeepMind در سال ۲۰۲۴ برای واترمارکگذاری متنهای تولیدشده توسط مدلهای هوش مصنوعی معرفی کرد.
این شرکت همچنین قصد دارد یک API برای تشخیص واترمارک ارائه کند. چنین ابزاری میتواند در آینده برای سرویسهایی که نیاز دارند منشأ محتوای متنی را بررسی کنند، کاربرد داشته باشد. البته نباید واترمارک Claude را با ابزارهای رایج تشخیص متن تولیدشده توسط هوش مصنوعی یکی دانست.
سیستمهای AI Detector معمولاً به دنبال الگوهای زبانی و آماری در نوشته میگردند؛ مثلاً نوع انتخاب واژهها، ساختار جملهها یا الگوهایی که احتمال میدهند بیشتر در نوشتههای تولیدشده توسط مدلهای زبانی دیده شوند. واترمارک رویکرد متفاوتی دارد و از ابتدا یک نشانه رمزگذاریشده را در زمان تولید متن قرار میدهد تا بعداً قابل بررسی باشد.
این تفاوت میتواند اهمیت زیادی داشته باشد، چون تشخیص بر اساس سبک نوشتار همیشه با عدم قطعیت همراه است، اما واترمارک به یک نشانه از پیش ایجادشده تکیه میکند.
آیا با بازنویسی متن میتوان واترمارک Claude را حذف کرد؟
بله، اما نه لزوماً با یک ویرایش ساده. آنتروپیک میگوید ویرایشهای سبک احتمالاً واترمارک را بهطور کامل از بین نمیبرند. اگر کاربر چند جمله را تغییر دهد، تعدادی از کلمات را جابهجا کند یا متن را کمی روانتر بنویسد، احتمال باقی ماندن بخشی از الگوی واترمارک وجود دارد.
ماجرا زمانی متفاوت میشود که متن کاملاً بازنویسی شود و تقریباً تمام کلمات آن تغییر کنند. طبق توضیح آنتروپیک، چنین بازنویسی گستردهای میتواند واترمارک را از بین ببرد.
البته خود شرکت به یک نکته جالب اشاره کرده است: اگر تمام متن از نو نوشته شود، دیگر مشخص نیست بتوان چنین نوشتهای را همچنان یک متن «تولیدشده توسط هوش مصنوعی» دانست یا نه.
این موضوع یکی از نقاط ضعف طبیعی هر سیستم واترمارک متنی است. برخلاف تصویر یا ویدئو، متن را میتوان بهسادگی تغییر داد، بازنویسی کرد یا از یک مدل زبانی دیگر برای بازتولید آن استفاده کرد.
اگر Claude فقط متن انسان را ویرایش کند چه میشود؟
یکی از پرسشهای مهم درباره این فناوری به استفادههای ترکیبی مربوط میشود. فرض کنید یک کاربر خودش مقالهای نوشته و سپس آن را برای اصلاح نگارشی، روانتر شدن جملهها یا ویرایش ساختاری به Claude میدهد. آیا نسخه نهایی همچنان واترمارک خواهد داشت؟ آنتروپیک میگوید پاسخ به میزان ویرایش و طول متن بستگی دارد.
اگر Claude فقط تغییرات جزئی انجام دهد، بخش عمده متن همچنان توسط انسان نوشته شده است. در چنین شرایطی، فضای زیادی برای اعمال واترمارک روی متن وجود ندارد. اما اگر مدل بخشهای بزرگی از نوشته را بازنویسی کند، احتمال حضور واترمارک بیشتر میشود.
این مسئله برای نویسندگان، دانشجویان و شرکتهایی که از Claude بهعنوان ابزار ویرایش استفاده میکنند، اهمیت ویژهای دارد؛ چون مرز میان «متن نوشتهشده توسط انسان» و «متن تولیدشده توسط AI» در چنین سناریویی دیگر کاملاً مشخص نیست.
واترمارک در کد برنامهنویسی ضعیفتر خواهد بود
در مورد کد، شرایط کمی متفاوت است. مدل زبانی هنگام نوشتن یک برنامه معمولاً آزادی محدودی برای انتخاب میان گزینههای مختلف دارد. یک قطعه کد باید سینتکس مشخصی داشته باشد و در بسیاری از مواقع تنها چند روش منطقی برای انجام یک کار وجود دارد.
در چنین شرایطی، فرصت کمتری برای ایجاد الگوهای واترمارک وجود دارد. آنتروپیک گفته است که میزان واترمارک در کد نسبت به متن معمولی کمتر خواهد بود. با این حال، بخشهایی مانند کامنتها یا نامگذاریهایی که انتخابهای بیشتری در آنها وجود دارد، میتوانند محل اعمال واترمارک باشند.
نکته مهم این است که آنتروپیک میگوید این فرایند نباید تأثیر قابلتوجهی روی خود کد داشته باشد. یعنی واترمارک قرار نیست باعث شود برنامهای که Claude تولید کرده دیگر قابل اجرا نباشد یا منطق آن تغییر کند.
Claude تنها چتباتی نیست که به سمت واترمارک میرود
آنتروپیک همچنین تأکید کرده که Claude قرار نیست تنها مدل زبانی بزرگ با چنین قابلیتی باشد. به گفته این شرکت، تعدادی از توسعهدهندگان بزرگ مدلهای هوش مصنوعی به همان Code of Practice مرتبط با قانون هوش مصنوعی اتحادیه اروپا متعهد شدهاند و آنها نیز در حال پیادهسازی سیستمهای واترمارک برای محتوای تولیدشده توسط مدلهای خود هستند.
این یعنی واترمارک متن احتمالاً به یکی از ویژگیهای رایج سرویسهای هوش مصنوعی تبدیل خواهد شد؛ مخصوصاً در اروپا که شرکتهای فعال در این حوزه با فشار بیشتری برای شفافسازی منشأ محتوای تولیدشده توسط AI روبهرو هستند.
از نگاه کاربران، بخش بحثبرانگیز ماجرا جای دیگری است. واترمارک قرار نیست جلوی تولید متن با Claude را بگیرد و حتی ظاهراً برای خواننده قابل مشاهده نیست. مسئله اصلی این است که یک لایه تشخیص به خروجی مدل اضافه میشود که میتواند بعداً برای مشخص کردن منشأ آن مورد استفاده قرار بگیرد.
این قابلیت برای مبارزه با جعل محتوا و شفافتر شدن منشأ نوشتهها میتواند مفید باشد، اما همزمان پرسشهای تازهای درباره حریم خصوصی، استفاده آموزشی و دانشگاهی، و تفاوت میان «کمک گرفتن از AI» و «تولید کامل محتوا با AI» ایجاد میکند.
با توجه به اینکه بازنویسی کامل میتواند واترمارک را از بین ببرد، بعید است این فناوری بهتنهایی بتواند مسئله تشخیص محتوای هوش مصنوعی را برای همیشه حل کند. ارزش اصلی آن احتمالاً در ایجاد یک سیگنال قابل اعتماد برای متنهایی خواهد بود که مستقیماً از مدل خارج شدهاند و دستکاری جدی روی آنها انجام نشده است.
زیلوش آخرین اخبار تکنولوژی 