فوری سه شنبه ۱۴ مهر ۱۴۰۵
مدار تک
اجرای مرحله‌ای الزامات شفافیت قانون هوش مصنوعی اتحادیه اروپا

متن ChatGPT در اروپا واترمارک نامرئی می‌گیرد

OpenAI در هفته‌های آینده علامتی آماری و نامرئی به متن تولیدشده توسط ChatGPT و Codex در اتحادیه اروپا اضافه می‌کند؛ فناوری‌ای که قرار است تشخیص ماشینی محتوای تولیدشده با هوش مصنوعی را ممکن کند.

تشخیص اینکه یک متن توسط انسان نوشته شده یا هوش مصنوعی تولید کرده، تا امروز بیشتر بر پایه ابزارهای احتمالی و الگوهای زبانی انجام می‌شد. رویکرد جدید OpenAI یک گام متفاوت است: به‌جای اینکه تشخیص فقط بعد از تولید متن انجام شود، خود مدل هنگام تولید، یک الگوی آماری نامرئی در انتخاب واژه‌ها ایجاد می‌کند تا بعداً ابزار تشخیص بتواند آن را شناسایی کند.

متن ChatGPT در اروپا واترمارک نامرئی می‌گیرد

به گزارش تک مسیر؛ OpenAI اعلام کرده در هفته‌های آینده واترمارک نامرئی را به متن تولیدشده توسط ChatGPT و Codex برای کاربران اتحادیه اروپا اضافه می‌کند؛ اقدامی که در پاسخ به الزامات قانون هوش مصنوعی اتحادیه اروپا (EU AI Act) انجام می‌شود و هدف آن قابل‌شناسایی کردن ماشینی محتوای تولیدشده با هوش مصنوعی است.

واترمارک OpenAI چگونه کار می‌کند؟

فناوری جدید OpenAI که textGrain نام دارد، چیزی به متن اضافه نمی‌کند که کاربر بتواند ببیند. این سیستم با تغییر بسیار ظریف در الگوی آماری انتخاب واژه‌ها، یک سیگنال در خود متن ایجاد می‌کند.

سپس یک ابزار تشخیص می‌تواند با بررسی همین الگو ارزیابی کند که آیا متن حاوی واترمارک OpenAI است یا خیر. به گفته OpenAI، این علامت همراه متن باقی می‌ماند و با کپی و انتقال متن از بین نمی‌رود.

این تغییر قرار است در ابتدا برای کاربران واجد شرایط ChatGPT و Codex در اتحادیه اروپا و در تمام طرح‌ها اجرا شود. OpenAI فعلاً قصد ندارد واترمارک متن را در سراسر جهان به‌صورت پیش‌فرض فعال کند.

در مقابل، مشتریان API در سراسر جهان از هم‌اکنون می‌توانند برای برخی مدل‌های واجد شرایط، واترمارک را به‌صورت اختیاری فعال کنند و این قابلیت در API به‌طور پیش‌فرض خاموش باقی می‌ماند.

واترمارک به معنی تشخیص قطعی نیست

نکته مهم این است که خود OpenAI هم این فناوری را یک روش قطعی برای اثبات نویسنده متن نمی‌داند.

در آزمایش‌های این شرکت، با جایگزین کردن تنها ۱۰ درصد واژه‌ها با مترادف‌ها، نرخ شناسایی واترمارک در یک نمونه ۴۰۰ توکنی از حدود ۹۲ درصد به ۶۶ درصد کاهش پیدا کرد. با تغییر ۲۵ درصد واژه‌ها، این میزان به حدود ۱۷ درصد رسید.

متن‌های کوتاه و برخی محتواها، از جمله متن‌های ریاضی، نیز برای تشخیص دشوارتر هستند. بنابراین نبودن واترمارک به‌تنهایی ثابت نمی‌کند متن توسط انسان نوشته شده است؛ ممکن است متن بیش از حد کوتاه، ویرایش‌شده یا متعلق به یک مدل هوش مصنوعی دیگر باشد.

OpenAI در حال حاضر دسترسی به ابزار تشخیص خود را نیز به پژوهشگران تأییدشده و سازمان‌های تخصصی محدود کرده تا عملکرد و محدودیت‌های آن بیشتر ارزیابی شود. این شرکت گفته قصد دارد فناوری textGrain را در آینده به‌صورت متن‌باز منتشر کند.

میان‌بر تک‌مسیر

• عصاره خبر: OpenAI در واکنش به الزامات قانون هوش مصنوعی اتحادیه اروپا، واترمارک نامرئی textGrain را برای متن ChatGPT و Codex در اروپا فعال می‌کند.

• مسیر اقدام: برای تشخیص محتوای AI فقط به یک ابزار یا نتیجه «AI-generated» اعتماد نکنید؛ ویرایش، کوتاهی متن و حتی نوع محتوا می‌تواند دقت تشخیص را تغییر دهد.

• ایده تک: مسیر تشخیص محتوای هوش مصنوعی در حال حرکت از «حدس زدن از روی سبک نوشتار» به سمت قرار دادن یک سیگنال قابل‌خواندن برای ماشین هنگام تولید محتوا است؛ اما این سیگنال هنوز معادل اثبات قطعی نویسنده نیست.

شناسنامهٔ خبر

منبع: OpenAI / TechCrunch
ترجمه و تنظیم: تک‌مسیر
کد خبر: ۱۷۴

نظرات (۰)

هنوز نظری ثبت نشده — اولین نفر باشید!

ثبت نظر جدید