OpenAI برنامه مرحلهای خود برای واترمارکگذاری متن را تشریح کرده است؛ برنامهای که مستقیماً به الزامات شفافیت در EU AI Act مربوط میشود. از ۵ اکتبر، مشتریان API در سراسر جهان میتوانند برای برخی مدلها واترمارک متن را بهصورت اختیاری فعال کنند. در هفتههای آینده نیز خروجیهای متنی واجد شرایط ChatGPT و Codex در اتحادیه اروپا به واترمارک نامرئی مجهز میشوند. این قابلیت در زمان عرضه به پیشفرض جهانی تبدیل نمیشود.
فناوری OpenAI با نام textGrain بهجای افزودن نویسه مخفی یا برچسب قابل مشاهده، الگوی آماری انتخاب واژههای مدل را تغییر میدهد. ابزار تشخیص سپس به دنبال همین سیگنال میگردد. OpenAI میگوید قصد دارد فناوری را متنباز کند، اما به دلیل محدودیتهای تشخیص، دسترسی اولیه به ابزار بررسی فقط به پژوهشگران و سازمانهای تخصصی تأییدشده داده میشود.
آزمایشهای خود OpenAI نشان میدهد قابلیت تشخیص به طول و نوع متن وابسته است و با ویرایش کاهش پیدا میکند. جایگزینی بخشی از واژهها با مترادفها در آزمایشهای شرکت افت قابل توجهی در نرخ تشخیص ایجاد کرده است. این اعداد ارزیابی داخلی فروشنده هستند و نباید آنها را تأیید مستقل عملکرد واقعی دانست.
OpenAI همچنین تأکید میکند که وجود واترمارک مالکیت، هویت کاربر، میزان مشارکت انسانی یا صحت متن را ثابت نمیکند. نبود سیگنال قابل تشخیص نیز به معنی انسانی بودن متن نیست. بنابراین واترمارک فقط یکی از لایههای راهبرد گستردهتر منشأ محتواست.
The Verge جزئیات اصلی این عرضه منطقهای را بهطور مستقل تأیید کرده است. برای توسعهدهندگان و شرکتهای فعال در اتحادیه اروپا، منشأ و قابلیت شناسایی متن اکنون به موضوعی عملی در معماری و انطباق تبدیل میشود. میزان پایداری سیگنال پس از بازنویسی، ترجمه و ویرایش انسانی همچنان محدودیت اصلی است.