واترمارک ChatGPT قرار است نشانهای نامرئی به متنهای تولیدشده اضافه کند؛ نشانهای که با چشم دیده نمیشود، اما ابزار مخصوص میتواند آن را تشخیص دهد. شرکت OpenAI در ۵ اکتبر ۲۰۲۶ (۱۳ مهر ۱۴۰۵) از فناوری «textGrain» رونمایی کرد. این فناوری بهجای درج برچسب قابلمشاهده، الگویی آماری در انتخاب کلمات ایجاد میکند تا شناسایی منشأ متن امکانپذیر شود.
طبق اعلام رسمی OpenAI درباره واترمارک متنی، عرضه اولیه برای خروجیهای متنی واجد شرایط ChatGPT و Codex در اتحادیه اروپا انجام میشود. مشتریان رابط برنامهنویسی نیز در سراسر جهان میتوانند این قابلیت را برای برخی مدلها بهصورت اختیاری فعال کنند. بااینحال، شناسایی واترمارک بهمعنای اثبات قطعی نویسندگی هوش مصنوعی نیست!
- طی هفتههای آینده، OpenAI واترمارک نامرئی را به متنهای پشتیبانیشدهای که کاربران ChatGPT و Codex در اتحادیه اروپا تولید میکنند اضافه خواهد کرد.
- واترمارک نامرئی برای مشتریان رابط برنامهنویسی در سراسر جهان، روی برخی مدلها اختیاری است.
- منظور از مشتریان رابط برنامهنویسی، شرکتها و برنامهنویسانی است که مدلهای OpenAI را از طریق API داخل سایت، اپلیکیشن یا سرویس خودشان استفاده میکنند.
- ابزار تشخیص هنوز عمومی نیست و ابتدا در اختیار پژوهشگران و سازمانهای تخصصی تأییدشده قرار میگیرد.
- نتیجه تشخیص قطعی نیست؛ متن کوتاه، ترجمه یا ویرایششده ممکن است واترمارکش شناسایی نشود.
واترمارک نامرئی ChatGPT چیست؟
به زبان ساده:
OpenAI داخل بعضی متنهای تولیدشده با ChatGPT و Codex یک واترمارک نامرئی قرار میدهد.
فناوری textGrain هنگام تولید پاسخ، انتخاب کلمات مدل را کمی تنظیم میکند تا یک الگوی آماری نامرئی در متن شکل بگیرد. این واترمارک نوشته، علامت یا متادیتای قابلمشاهده نیست.
توضیحات بیشتر:
واترمارک متنی چت جی پی تی، نشانهای آماری در ساختار انتخاب کلمات است که هنگام تولید پاسخ شکل میگیرد. خواننده همچنان متن عادی دریافت میکند؛ خبری از لوگو، عبارت اضافه یا برچسبی در انتهای پاسخ نیست.
برای درک این ایده، باید بدانیم مدلهای زبانی پاسخ را مرحلهبهمرحله تولید میکنند. در هر مرحله، چند گزینه برای ادامه متن وجود دارد و مدل براساس احتمال آنها انتخاب میکند. واترمارکگذاری این انتخاب را بهشکلی تنظیم میکند که در مجموعه خروجی، یک الگوی قابلآزمایش ایجاد شود.
این رویکرد با ابزارهایی که صرفاً از روی سبک نگارش درباره ماشینیبودن متن حدس میزنند تفاوت دارد. آشکارساز واترمارک بهدنبال نشانهای میگردد که از ابتدا هنگام تولید متن تعبیه شده است. سازوکار این فرایند در گزارش فنی textGrain توضیح داده شده است.
فناوری textGrain چگونه کار میکند؟
فناوری textGrain انتخاب توکنها را با اطلاعات حاصل از یک کلید محرمانه و متن قبلی مرتبط میکند. «توکن» واحد پردازش متن است و میتواند یک کلمه یا بخشی از آن باشد.
در روش معرفیشده، توکنهای ممکن در گروههایی قرار میگیرند. سامانه ابتدا یک گروه و سپس توکنی از آن گروه را انتخاب میکند؛ احتمال نسبی توکنهای داخل هر گروه حفظ میشود. این طراحی، محاسبات واترمارکگذاری را سبکتر میکند.
یکی از مفاهیم اصلی گزارش، «بودجه کاهش آنتروپی» است. آنتروپی در اینجا به میزان تنوع و تصادفیبودن انتخابها اشاره دارد؛ بودجه تعیین میکند برای ایجاد سیگنال واترمارک، چه مقدار از این تنوع میتواند کاهش پیدا کند.
آشکارساز با متن و کلید مربوط، الگوی آماری را بازسازی و آزمایش میکند. برای این کار نیازی به دسترسی به مدل تولیدکننده یا دانستن بودجه استفادهشده هنگام تولید ندارد. تضمینهای نظری گزارش نیز به فرضهای مشخص وابستهاند و جای ارزیابی عملی را نمیگیرند.
تشخیص متن نوشته شده با هوش مصنوعی با ۶ سایت برتر
واترمارک ChatGPT و Codex چه زمانی عرضه میشود؟
عرضه این قابلیت مرحلهای است و وضعیت محصولات مصرفکننده با رابط برنامهنویسی تفاوت دارد:
| مسیر دسترسی | محدوده عرضه | زمان و وضعیت |
|---|---|---|
| ChatGPT و Codex | اتحادیه اروپا | طی هفتههای پس از اعلام، برای خروجیهای متنی واجد شرایط در همه طرحهای اشتراک |
| رابط برنامهنویسی OpenAI | سراسر جهان | از زمان اعلام، اختیاری برای برخی مدلها؛ پیشفرض خاموش |
| خدمات شرکای ابری | طبق برنامه شرکا | OpenAI از همکاری برای عرضه در هفتههای آینده خبر داده است |
آیا الان تمام پاسخهای جیپیتی در همه کشورها و سرویسها واترمارک دارند؟
خیر. طبق اعلام رسمی OpenAI واترمارک متنی در زمان عرضه، پیشفرض جهانی ChatGPT و کدکس Codex نمیشود. بنابراین نمیتوان از این خبر نتیجه گرفت که تمام پاسخهای جیپیتی در همه کشورها و سرویسها واترمارک دارند.
دقت تشخیص واترمارک چقدر است؟
طبق گزارش رسمی دقت تشخیص به طول و نوع متن وابسته است. نتایج رسمی، در نرخ هدف مثبت کاذب ۱٪، نشان میدهند:
| وضعیت آزمایش | نرخ تشخیص تقریبی |
|---|---|
| متنهای ۲۰۰ توکنی در موضوعاتی مانند روانشناسی | ۸۰٪ |
| متنهای ۴۰۰ توکنی در موضوعاتی مانند روانشناسی | ۹۵٪ |
| متن ۴۰۰ توکنی در آزمایش جایگزینی واژهها، پیش از تغییر | ۹۲٪ |
| پس از جایگزینی ۱۰٪ واژهها با مترادف | ۶۶٪ |
| پس از جایگزینی ۲۵٪ واژهها با مترادف | ۱۷٪ |
تشخیص در ریاضیات، بهدلیل محدودتر بودن انتخاب واژهها، ضعیفتر بود. آزمایش جایگزینی واژهها نیز روی پاسخهای انگلیسی انجام شده است؛ این اعداد را نباید مستقیماً به متن فارسی تعمیم داد.
آیا textGrain از SynthID بهتر است؟
OpenAI اعلام کرده textGrain در ارزیابیهای خودش، همسطح یا بهتر از روشهای بررسیشده، از جمله نسخه متنی SynthID، عمل کرده است. این ادعا به همان آزمایشها مربوط میشود و تضمین برتری در تمام کاربردهای واقعی نیست.
طبق توضیح رسمی گوگل دیپمایند درباره SynthID، نسخه متنی این فناوری نیز با تنظیم امتیاز احتمال توکنها، واترمارکی نامرئی ایجاد میکند. بنابراین هر دو رویکرد به فرایند تولید متن متکیاند، هرچند سازوکار فنی آنها یکسان نیست.
آیا واترمارک کیفیت پاسخهای جیپیتی را کاهش میدهد؟
OpenAI در ارزیابی مدل آسترا Astra با سطح تفکر حداکثری، تفاوت عملکرد معناداری گزارش نکرده است:
| آزمون | بدون واترمارک | با واترمارک |
|---|---|---|
| شاخص هوش Artificial Analysis | ۴۹٫۵۷ امتیاز | ۴۹٫۷۶ امتیاز |
| AutomationBench | ۳۴٫۰۹٪ | ۳۴٫۸۶٪ |
| DeepSWE v1.1 | ۷۲٫۸۰٪ | ۷۱٫۶۸٪ |
| Terminal-Bench 4.0 | ۵۳٫۹۰٪ | ۵۶٫۰۶٪ |
| Terminal-Bench Science 0.1 | ۵۶٫۹۰٪ | ۶۰٫۰۰٪ |
| BrowseComp | ۸۷٫۹۲٪ | ۸۷٫۳۵٪ |
| HealthBench Professional | ۶۴٫۲۷٪ | ۶۴٫۶۰٪ |
| GPQA Diamond | ۹۴٫۴۴٪ | ۹۳٫۹۴٪ |
این جدول گزارش عملکرد همان مدل و تنظیمات آزمایش است؛ نتیجهای عمومی درباره تمام مدلها، زبانها و کاربردها ارائه نمیکند.
واترمارک متنی چه چیزی را ثابت نمیکند؟
واترمارک سهم انسان، مالکیت، مسئولیت، صحت محتوا یا هویت کاربر را مشخص نمیکند. همچنین به حساب، دستور یا گفتوگوی شخص اشاره ندارد.
نبود واترمارک، انسانیبودن متن را ثابت نمیکند. متن ممکن است کوتاه، ویرایششده، ترجمهشده، قدیمی یا حاصل مدلی فاقد پشتیبانی باشد. مثبت کاذب یعنی تشخیص نشانهای که وجود ندارد؛ منفی کاذب یعنی ندیدن نشانهای که وجود دارد.
چرا OpenAI واترمارک متنی را در اروپا عرضه میکند؟
این اقدام بخشی از پاسخ OpenAI به الزامات شفافیت قانون هوش مصنوعی اتحادیه اروپا است. در صفحه رسمی دستورالعمل شفافیت محتوای تولیدشده با هوش مصنوعی، دو نوع تعهد از یکدیگر تفکیک شدهاند:
- ارائهدهندگان سامانهها: علامتگذاری خروجیها در قالب ماشینخوان و فراهمکردن امکان تشخیص تولید یا دستکاری مصنوعی، با توجه به امکانات و محدودیتهای فنی.
- استفادهکنندگان سامانهها: افشای برخی کاربردها، از جمله دیپفیک و انتشار متنهای مرتبط با منافع عمومی، با شرایط و استثناهای مشخص.
در بخش متنهای مرتبط با منافع عمومی، بررسی انسانی و مسئولیت تحریریه نیز مطرح شده است. بنابراین الزام فنی ارائهدهنده را نباید با یک حکم یکسان برای تمام نویسندگان و همه انواع محتوا اشتباه گرفت.
OpenAI پیشتر در بیانیه حمایت از شفافیت محتوای هوش مصنوعی در اروپا بر همکاری میان شرکتها، رسانهها، پلتفرمها و نهادهای استاندارد تأکید کرده بود. از نگاه این شرکت، شفافیت محتوا به مجموعهای از روشهای مکمل نیاز دارد؛ زیرا نشانهها ممکن است هنگام ویرایش، انتقال یا تبدیل محتوا تضعیف شوند.
آیا کاربران عادی میتوانند واترمارک متن را بررسی کنند؟
خیر. آشکارساز متنی در زمان معرفی، عمومی نیست. دسترسی اولیه پس از درخواست و تأیید، به پژوهشگران و سازمانهای تخصصی داده میشود. OpenAI همچنین از برنامه متنبازکردن فناوری خبر داده، اما زمان مشخصی برای آن اعلام نکرده است.
این ابزار فقط برای بررسی متن است یا منشا صوت و تصویر تولید شده با هوش مصنوعی را هم مشخص میکند؟
طبق OpenAI Help Center ابزار بررسی منشأ تصویر و صوت OpenAI را نباید با آشکارساز textGrain اشتباه گرفت. براساس راهنمای رسمی نشانههای منشأ محتوا، این ابزار فایلهای تصویری و صوتی پشتیبانیشده را برای یافتن نشانههای مرتبط با OpenAI بررسی میکند. نتیجه آن نیز صحت محتوا یا هویت سازنده را تأیید نمیکند.
تفاوت واترمارک متن با نشانههای تصویر و صدا چیست؟
OpenAI برای انواع محتوا از روشهای متفاوت استفاده میکند. در تصاویر پشتیبانیشده، اطلاعات منشأ مبتنی بر استاندارد C2PA و واترمارک SynthID بهکار میروند؛ صوت پشتیبانیشده نیز میتواند واترمارک نامحسوس SynthID داشته باشد.
اطلاعات C2PA در قالب فراداده، جزئیاتی درباره منشأ و سابقه فایل ثبت میکنند. واترمارک در خود محتوا تعبیه میشود و ممکن است پس از حذف فراداده همچنان باقی بماند. textGrain همین مسئله شناسایی منشأ را برای متن، با سیگنال آماری دنبال میکند. جزئیات رویکرد چندلایه شرکت در معرفی ابزارهای شناسایی منشأ محتوای OpenAI آمده است.
واترمارک ChatGPT برای تولید محتوا، سئو و دانشگاه چه معنایی دارد؟
برداشت کاربردی از این خبر، افزایش اهمیت مستندسازی فرایند تولید محتواست. برای تیمهای محتوا، نگهداشتن منابع، نسخههای پیشنویس و سوابق ویرایش کمک میکند سهم تحقیق و تصمیمهای انسانی روشن باشد. وجود یک نشانه آماری بهتنهایی کیفیت مقاله یا میزان کار نویسنده را توضیح نمیدهد.
بهترین هوش مصنوعی برای سئو؛ معرفی ۱۱ ابزار برتر
در سئو نیز این اطلاعیه خبری درباره سازوکار شناسایی منشأ متن است. در آن تغییری در سیاست رتبهبندی گوگل اعلام نشده؛ بنابراین نتیجهگیری درباره افت رتبه خودکار صفحات واترمارکدار، از این خبر قابلاستخراج نیست.
در محیط دانشگاهی و استخدامی، پیشنهاد عملی این است که نتیجه آشکارساز همراه با شواهد دیگر بررسی شود: پیشنویسها، منابع، توضیح نویسنده و مقررات مجموعه. اتکا به یک نتیجه تشخیص برای داوری درباره سهم فرد، با محدودیتهایی که OpenAI اعلام کرده سازگار نیست.
کاربرد هوش مصنوعی در سئو؛ از تحقیق کلمات کلیدی تا سئوی فنی
دسترسی به مدلهای جیپیتی در هوشا
هوشا دسترسی به مدلهای جیپیتی را برای کاربران خود فراهم میکند. از چت جیپیتی فارسی در هوشا میتوانید برای ایدهپردازی، نگارش پیشنویس، ترجمه، خلاصهسازی و پاسخگویی به پرسشها کمک بگیرید.
با این هوش مصنوعی ایرانی رایگان، میتوانید هوش مصنوعی را به بخشی از فرایند کار و یادگیری خود تبدیل کنید. برای تولید محتوای حرفهای، پاسخهای هوش مصنوعی، نقطه شروع مناسبی است؛ اما از یاد نبرید که بررسی منابع، افزودن تجربه و تحلیل اختصاصی و ویرایش نهایی، کیفیت خروجی قابلانتشار را میسازند.

تبلیغات تصویری ChatGPT هنگام ساخت عکس نمایش داده میشود!
واترمارک نامرئی و متنی ChatGPT و Codex معرفی شد؛ فناوری textGrain چیست؟
هوش مصنوعی لئوناردو چیست؟ قیمت و امکانات + آموزش عملی در ۴ گام
صحبت با هوش مصنوعی؛ آموزش چت و مکالمه صوتی با ChatGPT و هوشا
چت جی پی تی بیزینس چیست؟ امکانات، قیمت و تفاوت با سایر پلنها