OpenAI در حال عرضه واترمارک نامرئی textGrain برای خروجی ChatGPT و Codex است که برای کاربران اتحادیه اروپا فعال خواهد بود. این شرکت میگوید طی چند هفته آینده این قابلیت را روشن میکند تا شرط قانون هوش مصنوعی اتحادیه اروپا درباره امکان برچسبگذاری متنهای تولیدشده بهشکلی قابلخواندن برای ماشینها رعایت شود. توسعهدهندگانی که از API شرکت استفاده میکنند، میتوانند واترمارک را هر زمان که بخواهند فعال یا غیرفعال کنند؛ رویکردی متفاوت با Anthropic که واترمارک را در همه خروجیهای Claude در سراسر جهان اجباری کرده است.
واترمارک چگونه کار میکند و چه محدودیتهایی دارد؟
textGrain الگویی آماری را در انتخاب واژههای مدل میگنجاند؛ روشی شبیه SynthID گوگل که Anthropic در Claude به کار میبرد. بر اساس آزمایشهای داخلی OpenAI، ابزار تشخیص این الگو را در حدود ۹۵٪ از متنهای روانشناسی ۴۰۰ توکنی (تقریباً ۳۰۰ واژهای) پیدا میکند، اما این میزان برای متنهای ریاضی با همین طول حدود ۶۰٪ است. حتی تغییر بخش کوچکی از متن، احتمال تشخیص را کاهش میدهد: جایگزینی ۱۰٪ از واژهها با مترادف، نرخ شناسایی را از حدود ۹۲٪ به ۶۶٪ میرساند و جایگزینی یکچهارم واژهها آن را به حدود ۱۷٪ کاهش میدهد.
دسترسی به ابزار تشخیص
فعلاً OpenAI دسترسی به ابزار تشخیص را تنها از طریق فرایند درخواست، در اختیار پژوهشگران منتخب و سازمانهای تخصصی میگذارد. این ابزار فقط اعلام میکند که آیا واترمارک OpenAI وجود دارد یا نه؛ هویت نویسنده متن یا هیچیک از دستورهای ورودی را فاش نمیکند.
چرا مهم است
کاربران اتحادیه اروپا در خروجی ChatGPT نشانهای پنهان خواهند دید که نهادهای ناظر میتوانند آن را بخوانند؛ این کار به رعایت مقررات جدید برچسبگذاری کمک میکند. توسعهدهندگان میتوانند این نشانه را پنهان کنند و در نتیجه تشخیص متن تولیدشده با هوش مصنوعی برای اشخاص ثالث دشوارتر شود. از آنجا که پس از ویرایش، احتمال تشخیص واترمارک پایین میآید، کاربران همچنان میتوانند با بازنویسی نسبتاً محدود متن آن را از بین ببرند.