واترمارک نامرئی و متنی ChatGPT و Codex معرفی شد؛ فناوری textGrain چیست؟

آخرین به‌روزرسانی: 14 مهر 1405, 11:34 ق.ظ
نگار سلیمانی 14 مهر 1405 اخبار و رویداد ۱۱ دقیقه زمان مطالعه 0 دیدگاه ( ۰ امتیاز )

واترمارک ChatGPT قرار است نشانه‌ای نامرئی به متن‌های تولیدشده اضافه کند؛ نشانه‌ای که با چشم دیده نمی‌شود، اما ابزار مخصوص می‌تواند آن را تشخیص دهد. شرکت OpenAI در ۵ اکتبر ۲۰۲۶ (۱۳ مهر ۱۴۰۵) از فناوری «textGrain» رونمایی کرد. این فناوری به‌جای درج برچسب قابل‌مشاهده، الگویی آماری در انتخاب کلمات ایجاد می‌کند تا شناسایی منشأ متن امکان‌پذیر شود.

طبق اعلام رسمی OpenAI درباره واترمارک متنی، عرضه اولیه برای خروجی‌های متنی واجد شرایط ChatGPT و Codex در اتحادیه اروپا انجام می‌شود. مشتریان رابط برنامه‌نویسی نیز در سراسر جهان می‌توانند این قابلیت را برای برخی مدل‌ها به‌صورت اختیاری فعال کنند. بااین‌حال، شناسایی واترمارک به‌معنای اثبات قطعی نویسندگی هوش مصنوعی نیست!

  • طی هفته‌های آینده، OpenAI واترمارک نامرئی را به متن‌های پشتیبانی‌شده‌ای که کاربران ChatGPT و Codex در اتحادیه اروپا تولید می‌کنند اضافه خواهد کرد.
  • واترمارک نامرئی برای مشتریان رابط برنامه‌نویسی در سراسر جهان، روی برخی مدل‌ها اختیاری است.
  • منظور از مشتریان رابط برنامه‌نویسی، شرکت‌ها و برنامه‌نویسانی است که مدل‌های OpenAI را از طریق API داخل سایت، اپلیکیشن یا سرویس خودشان استفاده می‌کنند.
  • ابزار تشخیص هنوز عمومی نیست و ابتدا در اختیار پژوهشگران و سازمان‌های تخصصی تأییدشده قرار می‌گیرد.
  • نتیجه تشخیص قطعی نیست؛ متن کوتاه، ترجمه یا ویرایش‌شده ممکن است واترمارکش شناسایی نشود.

واترمارک نامرئی ChatGPT چیست؟

واترمارک نامرئی داخل متن های چت جی پی تی

به زبان ساده:

OpenAI داخل بعضی متن‌های تولیدشده با ChatGPT و Codex یک واترمارک نامرئی قرار می‌دهد.
فناوری textGrain هنگام تولید پاسخ، انتخاب کلمات مدل را کمی تنظیم می‌کند تا یک الگوی آماری نامرئی در متن شکل بگیرد. این واترمارک نوشته، علامت یا متادیتای قابل‌مشاهده نیست.

توضیحات بیشتر:

واترمارک متنی چت جی پی تی، نشانه‌ای آماری در ساختار انتخاب کلمات است که هنگام تولید پاسخ شکل می‌گیرد. خواننده همچنان متن عادی دریافت می‌کند؛ خبری از لوگو، عبارت اضافه یا برچسبی در انتهای پاسخ نیست.

برای درک این ایده، باید بدانیم مدل‌های زبانی پاسخ را مرحله‌به‌مرحله تولید می‌کنند. در هر مرحله، چند گزینه برای ادامه متن وجود دارد و مدل براساس احتمال آن‌ها انتخاب می‌کند. واترمارک‌گذاری این انتخاب را به‌شکلی تنظیم می‌کند که در مجموعه خروجی، یک الگوی قابل‌آزمایش ایجاد شود.

این رویکرد با ابزارهایی که صرفاً از روی سبک نگارش درباره ماشینی‌بودن متن حدس می‌زنند تفاوت دارد. آشکارساز واترمارک به‌دنبال نشانه‌ای می‌گردد که از ابتدا هنگام تولید متن تعبیه شده است. سازوکار این فرایند در گزارش فنی textGrain توضیح داده شده است.

فناوری textGrain چگونه کار می‌کند؟

فناوری textGrain انتخاب توکن‌ها را با اطلاعات حاصل از یک کلید محرمانه و متن قبلی مرتبط می‌کند. «توکن» واحد پردازش متن است و می‌تواند یک کلمه یا بخشی از آن باشد.

در روش معرفی‌شده، توکن‌های ممکن در گروه‌هایی قرار می‌گیرند. سامانه ابتدا یک گروه و سپس توکنی از آن گروه را انتخاب می‌کند؛ احتمال نسبی توکن‌های داخل هر گروه حفظ می‌شود. این طراحی، محاسبات واترمارک‌گذاری را سبک‌تر می‌کند.

یکی از مفاهیم اصلی گزارش، «بودجه کاهش آنتروپی» است. آنتروپی در اینجا به میزان تنوع و تصادفی‌بودن انتخاب‌ها اشاره دارد؛ بودجه تعیین می‌کند برای ایجاد سیگنال واترمارک، چه مقدار از این تنوع می‌تواند کاهش پیدا کند.

آشکارساز با متن و کلید مربوط، الگوی آماری را بازسازی و آزمایش می‌کند. برای این کار نیازی به دسترسی به مدل تولیدکننده یا دانستن بودجه استفاده‌شده هنگام تولید ندارد. تضمین‌های نظری گزارش نیز به فرض‌های مشخص وابسته‌اند و جای ارزیابی عملی را نمی‌گیرند.

تشخیص متن نوشته شده با هوش مصنوعی با ۶ سایت برتر

واترمارک ChatGPT و Codex چه زمانی عرضه می‌شود؟

عرضه این قابلیت مرحله‌ای است و وضعیت محصولات مصرف‌کننده با رابط برنامه‌نویسی تفاوت دارد:

مسیر دسترسیمحدوده عرضهزمان و وضعیت
ChatGPT و Codexاتحادیه اروپاطی هفته‌های پس از اعلام، برای خروجی‌های متنی واجد شرایط در همه طرح‌های اشتراک
رابط برنامه‌نویسی OpenAIسراسر جهاناز زمان اعلام، اختیاری برای برخی مدل‌ها؛ پیش‌فرض خاموش
خدمات شرکای ابریطبق برنامه شرکاOpenAI از همکاری برای عرضه در هفته‌های آینده خبر داده است

آیا الان تمام پاسخ‌های جی‌پی‌تی در همه کشورها و سرویس‌ها واترمارک دارند؟

خیر. طبق اعلام رسمی OpenAI واترمارک متنی در زمان عرضه، پیش‌فرض جهانی ChatGPT و کدکس Codex نمی‌شود. بنابراین نمی‌توان از این خبر نتیجه گرفت که تمام پاسخ‌های جی‌پی‌تی در همه کشورها و سرویس‌ها واترمارک دارند.

دقت تشخیص واترمارک چقدر است؟

طبق گزارش رسمی دقت تشخیص به طول و نوع متن وابسته است. نتایج رسمی، در نرخ هدف مثبت کاذب ۱٪، نشان می‌دهند:

وضعیت آزمایشنرخ تشخیص تقریبی
متن‌های ۲۰۰ توکنی در موضوعاتی مانند روان‌شناسی۸۰٪
متن‌های ۴۰۰ توکنی در موضوعاتی مانند روان‌شناسی۹۵٪
متن ۴۰۰ توکنی در آزمایش جایگزینی واژه‌ها، پیش از تغییر۹۲٪
پس از جایگزینی ۱۰٪ واژه‌ها با مترادف۶۶٪
پس از جایگزینی ۲۵٪ واژه‌ها با مترادف۱۷٪

تشخیص در ریاضیات، به‌دلیل محدودتر بودن انتخاب واژه‌ها، ضعیف‌تر بود. آزمایش جایگزینی واژه‌ها نیز روی پاسخ‌های انگلیسی انجام شده است؛ این اعداد را نباید مستقیماً به متن فارسی تعمیم داد.

آیا textGrain از SynthID بهتر است؟

OpenAI اعلام کرده textGrain در ارزیابی‌های خودش، هم‌سطح یا بهتر از روش‌های بررسی‌شده، از جمله نسخه متنی SynthID، عمل کرده است. این ادعا به همان آزمایش‌ها مربوط می‌شود و تضمین برتری در تمام کاربردهای واقعی نیست.

طبق توضیح رسمی گوگل دیپ‌مایند درباره SynthID، نسخه متنی این فناوری نیز با تنظیم امتیاز احتمال توکن‌ها، واترمارکی نامرئی ایجاد می‌کند. بنابراین هر دو رویکرد به فرایند تولید متن متکی‌اند، هرچند سازوکار فنی آن‌ها یکسان نیست.

آیا واترمارک کیفیت پاسخ‌های جی‌پی‌تی را کاهش می‌دهد؟

OpenAI در ارزیابی مدل آسترا Astra با سطح تفکر حداکثری، تفاوت عملکرد معناداری گزارش نکرده است:

آزمونبدون واترمارکبا واترمارک
شاخص هوش Artificial Analysis۴۹٫۵۷ امتیاز۴۹٫۷۶ امتیاز
AutomationBench۳۴٫۰۹٪۳۴٫۸۶٪
DeepSWE v1.1۷۲٫۸۰٪۷۱٫۶۸٪
Terminal-Bench 4.0۵۳٫۹۰٪۵۶٫۰۶٪
Terminal-Bench Science 0.1۵۶٫۹۰٪۶۰٫۰۰٪
BrowseComp۸۷٫۹۲٪۸۷٫۳۵٪
HealthBench Professional۶۴٫۲۷٪۶۴٫۶۰٪
GPQA Diamond۹۴٫۴۴٪۹۳٫۹۴٪

این جدول گزارش عملکرد همان مدل و تنظیمات آزمایش است؛ نتیجه‌ای عمومی درباره تمام مدل‌ها، زبان‌ها و کاربردها ارائه نمی‌کند.

واترمارک متنی چه چیزی را ثابت نمی‌کند؟

واترمارک سهم انسان، مالکیت، مسئولیت، صحت محتوا یا هویت کاربر را مشخص نمی‌کند. همچنین به حساب، دستور یا گفت‌وگوی شخص اشاره ندارد.

نبود واترمارک، انسانی‌بودن متن را ثابت نمی‌کند. متن ممکن است کوتاه، ویرایش‌شده، ترجمه‌شده، قدیمی یا حاصل مدلی فاقد پشتیبانی باشد. مثبت کاذب یعنی تشخیص نشانه‌ای که وجود ندارد؛ منفی کاذب یعنی ندیدن نشانه‌ای که وجود دارد.

چرا OpenAI واترمارک متنی را در اروپا عرضه می‌کند؟

این اقدام بخشی از پاسخ OpenAI به الزامات شفافیت قانون هوش مصنوعی اتحادیه اروپا است. در صفحه رسمی دستورالعمل شفافیت محتوای تولیدشده با هوش مصنوعی، دو نوع تعهد از یکدیگر تفکیک شده‌اند:

  • ارائه‌دهندگان سامانه‌ها: علامت‌گذاری خروجی‌ها در قالب ماشین‌خوان و فراهم‌کردن امکان تشخیص تولید یا دست‌کاری مصنوعی، با توجه به امکانات و محدودیت‌های فنی.
  • استفاده‌کنندگان سامانه‌ها: افشای برخی کاربردها، از جمله دیپ‌فیک و انتشار متن‌های مرتبط با منافع عمومی، با شرایط و استثناهای مشخص.

در بخش متن‌های مرتبط با منافع عمومی، بررسی انسانی و مسئولیت تحریریه نیز مطرح شده است. بنابراین الزام فنی ارائه‌دهنده را نباید با یک حکم یکسان برای تمام نویسندگان و همه انواع محتوا اشتباه گرفت.

OpenAI پیش‌تر در بیانیه حمایت از شفافیت محتوای هوش مصنوعی در اروپا بر همکاری میان شرکت‌ها، رسانه‌ها، پلتفرم‌ها و نهادهای استاندارد تأکید کرده بود. از نگاه این شرکت، شفافیت محتوا به مجموعه‌ای از روش‌های مکمل نیاز دارد؛ زیرا نشانه‌ها ممکن است هنگام ویرایش، انتقال یا تبدیل محتوا تضعیف شوند.

آیا کاربران عادی می‌توانند واترمارک متن را بررسی کنند؟

خیر. آشکارساز متنی در زمان معرفی، عمومی نیست. دسترسی اولیه پس از درخواست و تأیید، به پژوهشگران و سازمان‌های تخصصی داده می‌شود. OpenAI همچنین از برنامه متن‌بازکردن فناوری خبر داده، اما زمان مشخصی برای آن اعلام نکرده است.

این ابزار فقط برای بررسی متن است یا منشا صوت و تصویر تولید شده با هوش مصنوعی را هم مشخص می‌کند؟

طبق OpenAI Help Center ابزار بررسی منشأ تصویر و صوت OpenAI را نباید با آشکارساز textGrain اشتباه گرفت. براساس راهنمای رسمی نشانه‌های منشأ محتوا، این ابزار فایل‌های تصویری و صوتی پشتیبانی‌شده را برای یافتن نشانه‌های مرتبط با OpenAI بررسی می‌کند. نتیجه آن نیز صحت محتوا یا هویت سازنده را تأیید نمی‌کند.

تفاوت واترمارک متن با نشانه‌های تصویر و صدا چیست؟

OpenAI برای انواع محتوا از روش‌های متفاوت استفاده می‌کند. در تصاویر پشتیبانی‌شده، اطلاعات منشأ مبتنی بر استاندارد C2PA و واترمارک SynthID به‌کار می‌روند؛ صوت پشتیبانی‌شده نیز می‌تواند واترمارک نامحسوس SynthID داشته باشد.

اطلاعات C2PA در قالب فراداده، جزئیاتی درباره منشأ و سابقه فایل ثبت می‌کنند. واترمارک در خود محتوا تعبیه می‌شود و ممکن است پس از حذف فراداده همچنان باقی بماند. textGrain همین مسئله شناسایی منشأ را برای متن، با سیگنال آماری دنبال می‌کند. جزئیات رویکرد چندلایه شرکت در معرفی ابزارهای شناسایی منشأ محتوای OpenAI آمده است.

واترمارک ChatGPT برای تولید محتوا، سئو و دانشگاه چه معنایی دارد؟

برداشت کاربردی از این خبر، افزایش اهمیت مستندسازی فرایند تولید محتواست. برای تیم‌های محتوا، نگه‌داشتن منابع، نسخه‌های پیش‌نویس و سوابق ویرایش کمک می‌کند سهم تحقیق و تصمیم‌های انسانی روشن باشد. وجود یک نشانه آماری به‌تنهایی کیفیت مقاله یا میزان کار نویسنده را توضیح نمی‌دهد.

بهترین هوش مصنوعی برای سئو؛ معرفی ۱۱ ابزار برتر

در سئو نیز این اطلاعیه خبری درباره سازوکار شناسایی منشأ متن است. در آن تغییری در سیاست رتبه‌بندی گوگل اعلام نشده؛ بنابراین نتیجه‌گیری درباره افت رتبه خودکار صفحات واترمارک‌دار، از این خبر قابل‌استخراج نیست.

در محیط دانشگاهی و استخدامی، پیشنهاد عملی این است که نتیجه آشکارساز همراه با شواهد دیگر بررسی شود: پیش‌نویس‌ها، منابع، توضیح نویسنده و مقررات مجموعه. اتکا به یک نتیجه تشخیص برای داوری درباره سهم فرد، با محدودیت‌هایی که OpenAI اعلام کرده سازگار نیست.

کاربرد هوش مصنوعی در سئو؛ از تحقیق کلمات کلیدی تا سئوی فنی

دسترسی به مدل‌های جی‌پی‌تی در هوشا

هوشا دسترسی به مدل‌های جی‌پی‌تی را برای کاربران خود فراهم می‌کند. از چت جی‌پی‌تی فارسی در هوشا می‌توانید برای ایده‌پردازی، نگارش پیش‌نویس، ترجمه، خلاصه‌سازی و پاسخ‌گویی به پرسش‌ها کمک بگیرید.

با این هوش مصنوعی ایرانی رایگان، می‌توانید هوش مصنوعی را به بخشی از فرایند کار و یادگیری خود تبدیل کنید. برای تولید محتوای حرفه‌ای، پاسخ‌های هوش مصنوعی، نقطه شروع مناسبی است؛ اما از یاد نبرید که بررسی منابع، افزودن تجربه و تحلیل اختصاصی و ویرایش نهایی، کیفیت خروجی قابل‌انتشار را می‌سازند.

انتخاب مدل chatgpt 5.6 sol

سوالات متداول این بخش
نظرات کاربران

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

مقالات مشابه
کمیسیون اروپا به دنبال کاهش فشار قوانین هوش مصنوعی بر استارتاپ‌ها
به گزارش رویترز، کمیسیون اروپا در حال بررسی بازخوردهاست تا راهی برای کاهش ف…
رضا باقری ( ۰ امتیاز )
متا هوش مصنوعی خود را به خاورمیانه آورد؛ تجربه‌ای جدید برای کاربران عرب‌زبان
دسترسی کاربران فیس‌بوک، اینستاگرام، واتس‌اپ و مسنجر به چت‌بات هوش مصنوعی مت…
رضا باقری ( ۰ امتیاز )
قابلیت جنجالی گوگل به یوتیوب رسید: AI Overviews خطری برای تولید کنندگان محتوا
شرکت یوتیوب اعلام کرد که در حال راه‌اندازی ویژگی‌های جدیدی مبتنی بر هوش مصن…
رضا باقری ( ۰ امتیاز )