متن ChatGPT در اروپا واترمارک نامرئی میگیرد
OpenAI در هفتههای آینده علامتی آماری و نامرئی به متن تولیدشده توسط ChatGPT و Codex در اتحادیه اروپا اضافه میکند؛ فناوریای که قرار است تشخیص ماشینی محتوای تولیدشده با هوش مصنوعی را ممکن کند.
تشخیص اینکه یک متن توسط انسان نوشته شده یا هوش مصنوعی تولید کرده، تا امروز بیشتر بر پایه ابزارهای احتمالی و الگوهای زبانی انجام میشد. رویکرد جدید OpenAI یک گام متفاوت است: بهجای اینکه تشخیص فقط بعد از تولید متن انجام شود، خود مدل هنگام تولید، یک الگوی آماری نامرئی در انتخاب واژهها ایجاد میکند تا بعداً ابزار تشخیص بتواند آن را شناسایی کند.

به گزارش تک مسیر؛ OpenAI اعلام کرده در هفتههای آینده واترمارک نامرئی را به متن تولیدشده توسط ChatGPT و Codex برای کاربران اتحادیه اروپا اضافه میکند؛ اقدامی که در پاسخ به الزامات قانون هوش مصنوعی اتحادیه اروپا (EU AI Act) انجام میشود و هدف آن قابلشناسایی کردن ماشینی محتوای تولیدشده با هوش مصنوعی است.
واترمارک OpenAI چگونه کار میکند؟
فناوری جدید OpenAI که textGrain نام دارد، چیزی به متن اضافه نمیکند که کاربر بتواند ببیند. این سیستم با تغییر بسیار ظریف در الگوی آماری انتخاب واژهها، یک سیگنال در خود متن ایجاد میکند.
سپس یک ابزار تشخیص میتواند با بررسی همین الگو ارزیابی کند که آیا متن حاوی واترمارک OpenAI است یا خیر. به گفته OpenAI، این علامت همراه متن باقی میماند و با کپی و انتقال متن از بین نمیرود.
این تغییر قرار است در ابتدا برای کاربران واجد شرایط ChatGPT و Codex در اتحادیه اروپا و در تمام طرحها اجرا شود. OpenAI فعلاً قصد ندارد واترمارک متن را در سراسر جهان بهصورت پیشفرض فعال کند.
در مقابل، مشتریان API در سراسر جهان از هماکنون میتوانند برای برخی مدلهای واجد شرایط، واترمارک را بهصورت اختیاری فعال کنند و این قابلیت در API بهطور پیشفرض خاموش باقی میماند.
واترمارک به معنی تشخیص قطعی نیست
نکته مهم این است که خود OpenAI هم این فناوری را یک روش قطعی برای اثبات نویسنده متن نمیداند.
در آزمایشهای این شرکت، با جایگزین کردن تنها ۱۰ درصد واژهها با مترادفها، نرخ شناسایی واترمارک در یک نمونه ۴۰۰ توکنی از حدود ۹۲ درصد به ۶۶ درصد کاهش پیدا کرد. با تغییر ۲۵ درصد واژهها، این میزان به حدود ۱۷ درصد رسید.
متنهای کوتاه و برخی محتواها، از جمله متنهای ریاضی، نیز برای تشخیص دشوارتر هستند. بنابراین نبودن واترمارک بهتنهایی ثابت نمیکند متن توسط انسان نوشته شده است؛ ممکن است متن بیش از حد کوتاه، ویرایششده یا متعلق به یک مدل هوش مصنوعی دیگر باشد.
OpenAI در حال حاضر دسترسی به ابزار تشخیص خود را نیز به پژوهشگران تأییدشده و سازمانهای تخصصی محدود کرده تا عملکرد و محدودیتهای آن بیشتر ارزیابی شود. این شرکت گفته قصد دارد فناوری textGrain را در آینده بهصورت متنباز منتشر کند.
میانبر تکمسیر
• عصاره خبر: OpenAI در واکنش به الزامات قانون هوش مصنوعی اتحادیه اروپا، واترمارک نامرئی textGrain را برای متن ChatGPT و Codex در اروپا فعال میکند.
• مسیر اقدام: برای تشخیص محتوای AI فقط به یک ابزار یا نتیجه «AI-generated» اعتماد نکنید؛ ویرایش، کوتاهی متن و حتی نوع محتوا میتواند دقت تشخیص را تغییر دهد.
• ایده تک: مسیر تشخیص محتوای هوش مصنوعی در حال حرکت از «حدس زدن از روی سبک نوشتار» به سمت قرار دادن یک سیگنال قابلخواندن برای ماشین هنگام تولید محتوا است؛ اما این سیگنال هنوز معادل اثبات قطعی نویسنده نیست.
نظرات (۰)
هنوز نظری ثبت نشده — اولین نفر باشید!