OpenAI اعلام کرده است که برای رعایت قوانین جدید شفافیت هوش مصنوعی اتحادیه اروپا، به زودی واترمارک دیجیتال نامرئی به متنها و کدهای تولیدشده توسط مدلهای خود در این منطقه اضافه خواهد کرد. این اقدام پس از حرکت مشابه شرکت Anthropic در اوایل سال جاری صورت میگیرد.
این شرکت از سیستمی اختصاصی به نام textGrain استفاده میکند که سیگنالهای آماری نامرئی را به انتخاب کلمات مدل اضافه میکند. این سیگنالها توسط یک ابزار تشخیص قابل شناسایی هستند تا وجود واترمارک را تایید کنند. OpenAI ادعا میکند که این سیستم عملکردی برابر یا بهتر از روشهای دیگر مانند SynthID برای متن دارد، اما هشدار میدهد که عملکرد قوی در شرایط ایدهآل به معنای تشخیص قابل اعتماد در استفاده روزمره نیست.
تشخیص واترمارک در متنهای کوتاه و محتوایی مانند ریاضیات دشوارتر است و نرخ موفقیت حدود ۸۰ درصد گزارش شده است. همچنین ویرایش متن نیز باعث کاهش دقت تشخیص میشود. OpenAI قصد دارد این فناوری را به صورت متنباز منتشر کند تا دیگران بتوانند آن را بهبود دهند.
واترمارک به طور پیشفرض فعال نخواهد بود، مگر برای خروجیهای متنی ChatGPT و Codex در اتحادیه اروپا که مشمول قوانین میشوند. مشتریان همچنین میتوانند برای برخی مدلها به صورت اختیاری این ویژگی را فعال کنند، اما شرکت هنوز مشخص نکرده کدام مدلها برای عموم جهانی در دسترس خواهند بود.
دسترسی به نرمافزار تشخیص واترمارک در ابتدا محدود به پژوهشگران تاییدشده و سازمانهای تخصصی خواهد بود. این ابزار هویت کاربران را فاش نمیکند و هیچ اطلاعاتی درباره دستورات یا گفتگوها ارائه نمیدهد.
ماده ۵۰ قانون هوش مصنوعی اتحادیه اروپا، ارائهدهندگان سیستمهای هوش مصنوعی مولد را ملزم میکند که خروجیهای متنی خود را به گونهای قابل شناسایی و خواندن توسط ماشین علامتگذاری کنند. این قانون شامل شرکتهای جدید و همچنین شرکتهای پیشین مانند OpenAI، Anthropic، مایکروسافت، گوگل و متا میشود که باید تا ۲ دسامبر به آن پایبند باشند.
