
شرکت آنتروپیک، سازندهی چتبات هوش مصنوعی کلود (Claude)، روز جمعه در یک پست رسمی به سؤالات اساسی دربارهی سامانهی جدید واترمارکگذاری متن توضیح داد. این اقدام در پی جنجالی صورت گرفت که از اوایل هفته میان کاربران کلود شکل گرفته بود، پس از آنکه آنتروپیک اعلام کرد برای انطباق با «کد شفافیت» قانون هوش مصنوعی اتحادیه اروپا (EU AI Act)، متنهای تولیدشده توسط مدلهایش را نشانگذاری خواهد کرد. این قانون شرکتهای هوش مصنوعی را ملزم میکند از سامانههایی استفاده کنند که امکان شناسایی محتوای تولیدشده توسط AI را فراهم کند.
واترمارک چگونه کار میکند؟
بر اساس توضیح آنتروپیک، وقتی کلود با «انتخابهای کماهمیت» روبهرو میشود، مثلاً انتخاب بین دو واژهی مترادف برای توصیف هوا، میتواند الگویی در پاسخ خود ایجاد کند که برای خواننده کاملاً نامرئی است، اما برای هر کسی که کلید رمزگشایی آن را داشته باشد، قابلشناسایی خواهد بود. به گفتهی این شرکت، واترمارک هیچ تأثیری بر کیفیت خروجی کلود ندارد و از دید یک خوانندهی معمولی، پاسخ واترمارکدار با پاسخ عادی هیچ تفاوتی ندارد.
آنتروپیک اعلام کرده از رویکرد SynthID-Text استفاده میکند؛ فناوریای که تیم گوگل دیپمایند در سال ۲۰۲۴ معرفی کرده بود. این شرکت همچنین قصد دارد یک API اختصاصی برای تشخیص واترمارک منتشر کند. نکتهی مهم اینجاست که این روش کاملاً متفاوت از ابزارهای تشخیص هوش مصنوعی مانند Pangram است که با جستوجوی الگوهای نوشتاری خاص (مثل ساختارهای تکراری جملهبندی) سعی در شناسایی متن تولیدشده توسط AI دارند. آنتروپیک تأکید کرده که شناسایی این الگوهای نوشتاری، اساساً با بررسی واترمارک متفاوت است.

آیا میتوان واترمارک را حذف کرد؟
آنتروپیک میگوید ویرایش سبک متن احتمالاً واترمارک را بهطور کامل حذف نمیکند، اما بازنویسی کامل که در آن تمام کلمات تغییر کنند، میتواند این نشان را از بین ببرد. این شرکت افزوده در چنین حالتی اصلاً جای بحث دارد که آیا هنوز میتوان آن متن را «تولیدشده توسط هوش مصنوعی» نامید یا نه. در مورد متنهایی که صرفاً توسط کلود ویرایش یا بازخوانی شدهاند، آنتروپیک توضیح داده که میزان قابلتشخیصبودن واترمارک به طول متن و شدت ویرایش بستگی دارد. اگر ویرایش سبک باشد، بخش عمدهی کلمات همچنان نوشتهی انسان است و عملاً چیز زیادی برای اتصال واترمارک باقی نمیماند.
وضعیت کدنویسی
بر اساس این پست، کدهای برنامهنویسی کمتر از سایر متنها واترمارک خواهند داشت، زیرا مدل برای تولید کد کارآمد آزادی چندانی برای انتخاب میان گزینههای مختلف ندارد. با این حال، در مواردی که انتخاب دلخواه بین واژهها یا اصطلاحات درون کد وجود دارد، مانند کامنتهای داخل کد، واترمارک همچنان قابل اعمال است، هرچند تأثیر آن بر خودِ کد ناچیز خواهد بود.
واکنش کاربران
این تصمیم با واکنشهای متفاوتی در شبکههای اجتماعی روبهرو شده است. برخی کاربران در Reddit این اقدام را نوعی «توطئه علیه کاربران بیگناه» توصیف کردهاند، در حالی که کاربران دیگری معتقدند تنها کسانی که قصد فریب دیگران را دارند از این ویژگی ناراضی خواهند بود. به گزارش Business Insider، دهها کاربر در پلتفرم X اعلام کردهاند به همین دلیل اشتراک کلود خود را لغو کردهاند. آنتروپیک همچنین یادآور شده که کلود تنها چتبات هوش مصنوعی نخواهد بود که متن واترمارکدار تولید میکند؛ سایر توسعهدهندگان بزرگ مدلهای هوش مصنوعی نیز همین کد رفتاری را امضا کردهاند و واترمارکهای اختصاصی خود را پیادهسازی خواهند کرد.
منبع خبر: techcrunch

شاهین آقامعلی


پاسخ :