فهرست مطالب
اوپنایآی روز دوشنبه ۵ اکتبر ۲۰۲۶ (۱۳ مهر ۱۴۰۵) اعلام کرد که از چند هفتهٔ آینده، متنهایی که ChatGPT و Codex برای کاربران اتحادیهٔ اروپا مینویسند، یک واترمارک نامرئی خواهند داشت. اسم این فناوری textGrain است. چیزی به چشم خواننده نمیآید؛ نه برچسبی و نه علامتی که دیده شود. فقط یک الگوی آماری در انتخاب کلمههاست که ابزار مخصوص اوپنایآی میتواند پیدایش کند.
این تصمیم به خاطر قانون هوش مصنوعی اتحادیهٔ اروپا گرفته شده و فعلاً فقط برای اروپاست. برنامهنویسها در هر کشوری میتوانند از همین حالا آن را در API روشن کنند، ولی بهطور پیشفرض خاموش است. ابزار تشخیص هم فعلاً عمومی نیست. در این مطلب ساده توضیح میدهیم textGrain چیست، چطور کار میکند، چقدر قابل اعتماد است و برای شما چه معنایی دارد.
پاسخ کوتاه: اوپنایآی دقیقاً چه کاری میکند؟
خلاصهٔ اعلام اوپنایآی در چهار جمله:
در اروپا، پیشفرض: طی هفتههای آینده، متنهای «واجد شرایط» ChatGPT و Codex برای کاربران همهٔ پلنها در اتحادیهٔ اروپا واترمارک میگیرند.
بیرون از اروپا، نه: اوپنایآی میگوید واترمارک متن را فعلاً در همهٔ دنیا پیشفرض نمیکند.
در API، اختیاری: از ۵ اکتبر، مشتریهای API در سراسر دنیا میتوانند برای چند مدل مشخص آن را روشن کنند. حالت پیشفرض خاموش است.
ابزار تشخیص، محدود: فقط پژوهشگرها و سازمانهای متخصصی که درخواستشان تأیید شود به آن دسترسی میگیرند.
برای تازهوارد: واترمارک متنی یعنی چه؟
از واترمارک عکس تا واترمارک متن
واترمارک را بیشتر روی عکسها دیدهایم: لوگوی کمرنگی گوشهٔ تصویر که نشان میدهد عکس مال کیست. واترمارکهای جدید هوش مصنوعی معمولاً دیده نمیشوند. در عکس و صدا، نشانهای در خود پیکسلها یا موج صوتی پنهان میشود. اما متن چیزی جز کلمه ندارد؛ نمیشود چیزی را «زیر» کلمهها قایم کرد. برای همین واترمارک متن باید در خود انتخاب کلمهها باشد.
«توکن» چیست و چرا طول متن مهم است؟
مدلهای زبانی متن را تکهتکه مینویسند. به هر تکه «توکن» میگویند؛ چیزی در حد یک کلمه یا بخشی از یک کلمه. هر بار که مدل توکن بعدی را انتخاب میکند، معمولاً چند گزینهٔ مناسب دارد. واترمارک از همین انتخابها ساخته میشود. پس هرچه متن بلندتر باشد، انتخاب بیشتری هست و ردپای واترمارک هم پررنگتر میشود. یک جملهٔ کوتاه تقریباً هیچ ردی ندارد.
textGrain چطور کار میکند؟
یک کلید مخفی و هزاران انتخاب کوچک
فرض کنید مدل وسط جمله است و میتواند بگوید «شروع کرد» یا «آغاز کرد». هر دو درستاند. textGrain با کمک یک کلید مخفی مدل را کمی به سمت یکی از این گزینهها هل میدهد. یک بار این کار هیچ معنایی ندارد، اما وقتی صدها بار تکرار شود، الگویی آماری میسازد. به گزارش TechCrunch، ابزار تشخیص فقط با داشتن خود متن و همان کلید میتواند این الگو را پیدا کند. خواننده هیچ فرقی حس نمیکند.
اوپنایآی یک گزارش فنی هم دربارهٔ این روش منتشر کرده که طبق گزارش TechCrunch با همکاری پژوهشگرانی از دانشگاه پنسیلوانیا و ییل نوشته شده است. این شرکت میگوید گزارش را در هفتههای آینده کاملتر میکند و قصد دارد خود فناوری را هم متنباز (یعنی با کد آزاد و در دسترس همه) منتشر کند. این نسخهٔ متنباز هنوز بیرون نیامده است.
کپی و پیست کردن، واترمارک را پاک نمیکند
به گزارش TechCrunch، چون واترمارک در خود کلمههاست، اگر متن را کپی کنید و در Word یا Google Docs بچسبانید، الگو همراه متن میآید. چیزی که آن را ضعیف میکند، عوض کردن کلمهها است؛ در ادامه عددهایش را میبینید.
واترمارک از کی و برای چه کسانی فعال میشود؟
کاربران ChatGPT و Codex در اتحادیهٔ اروپا
اوپنایآی تاریخ دقیقی نداده و فقط گفته «طی هفتههای آینده». یعنی ممکن است همین امروز هنوز به حساب شما نرسیده باشد. این تغییر برای همهٔ پلنها، از رایگان تا پولی، در نظر گرفته شده است. اگر فارسیزبانی هستید که در آلمان، هلند، سوئد یا کشور دیگری از اتحادیهٔ اروپا زندگی میکنید و ChatGPT را از همانجا استفاده میکنید، این خبر مستقیم به شما مربوط است.
برنامهنویسها و API
API یعنی راهی که برنامهنویسها با آن مدلهای اوپنایآی را داخل اپ و سایت خودشان به کار میبرند. در API، واترمارک از ۵ اکتبر برای همهٔ دنیا قابل استفاده است اما خاموش است و صاحب پروژه باید خودش روشنش کند. به گزارش The New Stack، این کار در سطح پروژه یا کل سازمان انجام میشود، میشود مدلها را جداگانه انتخاب کرد و لازم نیست تکتک درخواستها تغییر کنند. اوپنایآی همچنین میگوید با شرکای ابری کار میکند تا همین امکان در هفتههای آینده برای مدلهایش روی سرویسهای آنها هم فعال شود.
چه چیزهایی هنوز روشن نیست؟
اوپنایآی نگفته دقیقاً کدام مدلها در API از واترمارک پشتیبانی میکنند.
معلوم نیست کاربران ChatGPT در اروپا میتوانند آن را خاموش کنند یا نه.
منظور از خروجی «واجد شرایط» Codex روشن نیست؛ بهخصوص اینکه آیا خود کد برنامه هم واترمارک میگیرد یا فقط متنهای توضیحی.
عددی دربارهٔ متنهای غیرانگلیسی، از جمله فارسی، منتشر نشده است.
چرا فقط اروپا؟ ماجرای قانون هوش مصنوعی اتحادیهٔ اروپا
مادهای که از ۲ اوت اجرا شد
قانون هوش مصنوعی اتحادیهٔ اروپا (EU AI Act) بخشی دربارهٔ شفافیت دارد که از ۲ اوت ۲۰۲۶ (۱۱ مرداد ۱۴۰۵) اجرا شده است. طبق این قانون، شرکتهایی که هوش مصنوعی مولد میسازند باید محتوای تولیدشده را طوری علامت بزنند که ماشینها بتوانند تشخیصش بدهند. به نوشتهٔ Search Engine Journal، کمیسیون اروپا گفته سیستمهایی که پیش از ۲ اوت وارد بازار شده بودند تا ۲ دسامبر (۱۱ آذر) فرصت دارند این شرط را رعایت کنند. همین مهلت توضیح میدهد چرا اوپنایآی کار را مرحلهبهمرحله پیش میبرد.
آییننامهای که شرکتها امضا کردهاند
کنار خود قانون، یک «آییننامهٔ رفتاری» داوطلبانه هم برای شفافیت محتوای هوش مصنوعی وجود دارد. شرکتها با امضای آن نشان میدهند که قانون را رعایت میکنند. طبق گزارش Search Engine Journal، تا پایان ژوئیه حدود ۱۹۰ سازمان آن را امضا کرده بودند. به نوشتهٔ TechCrunch، اوپنایآی، Anthropic، گوگل، متا و مایکروسافت هم جزو شرکتهایی هستند که به آن متعهد شدهاند.
اوپنایآی میگوید محدود کردن واترمارک به اروپا به او فرصت میدهد از استفادهٔ واقعی و بازخورد کاربران یاد بگیرد و بعد دربارهٔ بقیهٔ دنیا تصمیم بگیرد.
این واترمارک چقدر قابل اعتماد است؟ عددهای خود اوپنایآی
نکتهٔ جالب این خبر این است که اوپنایآی نقطهضعفهای روشش را خودش منتشر کرده است. همهٔ آزمایشها با این تنظیم انجام شده که ابزار تشخیص فقط در حدود ۱ درصد موارد، متنِ بدون واترمارک را اشتباهی «واترمارکدار» بداند. این عددها را خود شرکت اعلام کرده و هنوز آزمایش مستقلی رویشان منتشر نشده است.
شرایط آزمایش | درصد متنهایی که واترمارکشان پیدا شد |
|---|---|
متن حدود ۲۰۰ توکنی (مثلاً جواب سؤالهای روانشناسی) | حدود ۸۰ درصد |
متن حدود ۴۰۰ توکنی از همان نوع | حدود ۹۵ درصد |
متنهای ریاضی | به گفتهٔ اوپنایآی «بهطور قابل توجهی کمتر» |
متن ۴۰۰ توکنی بدون ویرایش (آزمایش ویرایش) | حدود ۹۲ درصد |
همان متن، با عوض کردن ۱۰ درصد کلمهها با هممعنیشان | حدود ۶۶ درصد |
همان متن، با عوض کردن ۲۵ درصد کلمهها | حدود ۱۷ درصد |
چرا متن کوتاه و ریاضی سختتر است؟
چون جای انتخاب کمتری دارند. در یک جواب ریاضی، کلمهها و نمادها تا حد زیادی از قبل مشخصاند و مدل نمیتواند خیلی بین گزینهها بچرخد. اوپنایآی دربارهٔ کد برنامه هم همین را گفته: در کد، گزینههای قابل قبول برای کلمهٔ بعدی کمتر از نوشتهٔ معمولی است و واترمارک گذاشتن سختتر میشود. TechCrunch هم به نقل از این شرکت نوشته که متن ترجمهشده سختتر تشخیص داده میشود.
ویرایش چقدر اثر دارد؟
زیاد. همانطور که در جدول میبینید، اگر یکچهارم کلمهها عوض شود، ابزار تشخیص از هر شش متن فقط حدود یکی را میشناسد. یعنی کسی که متن ChatGPT را واقعاً بازنویسی کند، بخش زیادی از این ردپا را از بین میبرد. این آزمایشها روی متنهای انگلیسی انجام شده است.
آیا کیفیت جوابها پایین میآید؟
اوپنایآی میگوید نه. این شرکت مدل Astra، تازهترین مدل پیشرفتهاش، را با واترمارک و بدون آن روی چند آزمون مقایسه کرده و تفاوت معناداری ندیده است. مثلاً در آزمون علمی GPQA Diamond نتیجه ۹۴٫۴۴ درصد بدون واترمارک و ۹۳٫۹۴ درصد با واترمارک بوده و در شاخص Artificial Analysis هم ۴۹٫۵۷ در برابر ۴۹٫۷۶ امتیاز. اختلافها کوچکاند و به هر دو طرف میروند. (اگر ماجرای مدلهای Astra را دنبال میکنید، خبر لغو انتشار GPT-6.1 Astra را هم بخوانید.)
اوپنایآی همچنین میگوید textGrain در آزمایشهای خودش هماندازه یا بهتر از روشهای دیگر، از جمله SynthID گوگل برای متن، عمل کرده است. این هم ارزیابی خود شرکت است. خودش هم تأکید میکند که نتیجهٔ خوب در شرایط ایدئال، تضمینی برای تشخیص درست در استفادهٔ روزمره نیست.
واترمارک چه چیزهایی را نمیگوید؟
این بخش احتمالاً مهمترین قسمت اعلام اوپنایآی است، چون جلوی برداشتهای غلط را میگیرد. به گفتهٔ خود شرکت:
سهم انسان را نشان نمیدهد. فقط میگوید یک سیستم اوپنایآی بخشی از متن را نوشته یا پردازش کرده؛ نمیگوید آدم چقدر فکر، ویرایش یا خلاقیت گذاشته است.
مالکیت و مسئولیت را تعیین نمیکند. نمیگوید متن مال کیست، استفاده از آن قانونی بوده یا نه، یا چه کسی مسئول آن است.
کاربر را شناسایی نمیکند. هیچ شخص، حساب کاربری، پرامپت (دستوری که به مدل دادهاید) یا گفتوگویی به متن وصل نمیشود.
درستی متن را تأیید نمیکند. متن واترمارکدار ممکن است درست یا غلط باشد.
نبودنش، ثابت نمیکند انسان نوشته. متن ممکن است خیلی کوتاه، ویرایششده یا ترجمهشده باشد، از مدلی بیاید که پشتیبانی نمیشود، قدیمیتر از این تغییر باشد یا اصلاً کار هوش مصنوعی شرکت دیگری باشد.
ابزار تشخیص دست چه کسی است؟
فعلاً دست تقریباً هیچکس. اوپنایآی از ۵ اکتبر درخواست دسترسی را باز کرده، اما فقط پژوهشگرها و سازمانهای متخصص تأییدشده، آن هم مورد به مورد، اجازه میگیرند. این ابزار فقط میگوید واترمارک اوپنایآی پیدا شد یا نه؛ اسم کاربر، پرامپت یا گفتوگو را نشان نمیدهد.
دلیل این سختگیری را خود شرکت گفته: خطر جاافتادن واترمارک و خطر «مثبت کاذب»، یعنی وقتی ابزار متنی را که آدم نوشته اشتباهی کار هوش مصنوعی بداند. ۱ درصد خطا شاید کم به نظر برسد، اما اگر یک دانشگاه هزار مقالهٔ دانشجویی را بررسی کند، یعنی حدود ده نفر بیگناه زیر سؤال میروند. پس اگر سایتی همین حالا ادعا کرد میتواند «واترمارک ChatGPT» را در متن شما پیدا کند، بدانید که از ابزار اوپنایآی استفاده نمیکند.
برای عکس و صدا وضع فرق دارد. ابزارهای بررسی عکس و صدای اوپنایآی، یعنی صفحهٔ openai.com/verify و Content Provenance API، همچنان برای سازمانها در دسترس میمانند.
مقایسه با واترمارک Claude
اوپنایآی اولین شرکتی نیست که سراغ واترمارک متن میرود. Anthropic، سازندهٔ Claude، در ماه اوت اعلام کرده بود که متنهای Claude را واترمارک میکند. تفاوت اصلی دو شرکت در دامنه و اختیار است:
موضوع | اوپنایآی (ChatGPT و Codex) | Anthropic (Claude) |
|---|---|---|
محدودهٔ جغرافیایی | فقط اتحادیهٔ اروپا، طی هفتههای آینده | همهٔ دنیا، روی مدلهای پشتیبانیشده |
API | اختیاری و پیشفرض خاموش | به گزارش The New Stack، روی مدل اعمال میشود و راه خاموش کردن مشابهی معرفی نشده |
فناوری | textGrain، ساخت خود اوپنایآی | به گزارش Search Engine Journal، نسخهای از SynthID-Text گوگل دیپمایند |
دسترسی به ابزار تشخیص | پژوهشگرها و سازمانهای متخصص تأییدشده | پیشنمایش خصوصی برای سازمانهای واجد شرایط |
عدد منتشرشده دربارهٔ اثر ویرایش | دارد (۹۲ به ۶۶ و ۱۷ درصد) | عددی در توضیحات شرکت منتشر نشده |
Anthropic گفته بود هنوز راه مطمئنی برای محدود کردن واترمارک به یک منطقه ندارد و برای همین آن را در همهجا فعال کرده است. به گزارش TechCrunch، این تصمیم با اعتراض بعضی کاربران Claude روبهرو شد؛ کسانی که میگفتند دستور، زمینه و تصمیمها را خودشان دادهاند و Claude فقط «ابزار» بوده است. این بحث بخشی از گفتوگوی بزرگتری دربارهٔ استانداردهای ایمنی و شفافیت شرکتهای هوش مصنوعی است.
این خبر برای شما چه معنایی دارد؟
اگر دانشجو یا دانشآموز هستید
اگر در اروپا درس میخوانید، ممکن است بهزودی متنهایی که ChatGPT برایتان مینویسد این نشانه را داشته باشند. اما فعلاً هیچ استاد یا مدرسهای نمیتواند آن را بررسی کند و حتی اگر بتواند، نتیجهاش به گفتهٔ خود اوپنایآی نشان نمیدهد کار فکری را چه کسی انجام داده است. مسئلهٔ اصلی همچنان قوانین کلاس شماست. پیشنویسها و یادداشتهایتان را نگه دارید و اگر از ChatGPT برای یادگیری کمک میگیرید، حالت Study Mode گزینهٔ مناسبتری است تا اینکه جواب آماده بگیرید.
اگر نویسنده، مترجم یا تولیدکنندهٔ محتوا هستید
واترمارک نمیتواند به سؤال «چه کسی این متن را نوشته؟» جواب کامل بدهد. پس بهتر است خودتان روشن کنید از هوش مصنوعی برای چه کاری استفاده میکنید و برای کارفرما یا خواننده شفاف باشید. یادتان باشد که ویرایش و ترجمه این نشانه را ضعیف میکنند، اما هیچ عددی دربارهٔ متن فارسی منتشر نشده و نمیشود با اطمینان گفت در ترجمهٔ فارسی چه اتفاقی برایش میافتد.
اگر برنامهنویس هستید و با API کار میکنید
اختیار با شماست. اگر محصولتان در اروپا کاربر دارد، یا در حوزهای کار میکنید که شفافیت دربارهٔ محتوای هوش مصنوعی برایش مهم است، مثل رسانه یا آموزش، این گزینه را اول روی یک پروژهٔ آزمایشی امتحان کنید. توجه کنید که روشن کردن واترمارک به معنای دسترسی به ابزار تشخیص نیست؛ آن ماجرا جداست.
حریم خصوصی شما چه میشود؟
طبق گفتهٔ اوپنایآی، واترمارک هیچ اطلاعاتی از حساب، پرامپت یا گفتوگوی شما در متن نمیگذارد. اگر نگران دادههایی هستید که ChatGPT دربارهٔ شما نگه میدارد، موضوع مهمتر حافظهٔ آن است؛ در آموزش مدیریت حافظهٔ ChatGPT گفتهایم چطور آن را ببینید و پاک کنید.
پیشزمینه: چرا اوپنایآی تا حالا صبر کرده بود؟
اوپنایآی پیشتر هم یک واترمارک متنی ساخته بود اما منتشرش نکرد. به نوشتهٔ TechCrunch، والاستریت ژورنال در سال ۲۰۲۴ گزارش داده بود که یکی از دلیلها نگرانی از این بود که کاربران سراغ رقیبهایی بروند که واترمارک نمیگذارند. Search Engine Journal هم یادآوری کرده که در نظرسنجی خود اوپنایآی در آن زمان، نزدیک به ۳۰ درصد کاربران گفته بودند اگر واترمارک بیاید کمتر از ChatGPT استفاده میکنند. حالا قانون اروپا عملاً این تصمیم را از دست شرکت گرفته است؛ دستکم برای اروپا.
قدمهای بعدی اوپنایآی
فعال کردن تدریجی واترمارک برای ChatGPT و Codex در اتحادیهٔ اروپا طی هفتههای آینده.
اضافه کردن همین امکان برای مدلهای اوپنایآی روی سرویسهای شرکای ابری.
کاملتر کردن گزارش فنی و انتشار متنباز textGrain؛ تاریخی برای آن اعلام نشده.
بیشتر کردن دسترسی به ابزار تشخیص، به گفتهٔ شرکت «وقتی مطمئن شویم نتیجهها را میشود مسئولانه تفسیر کرد».
اوپنایآی گفته هر بخش از این برنامه را با پیشرفت فناوری، استانداردها و شواهد تازه دوباره بررسی میکند. پس ممکن است همهچیز، از جمله محدودهٔ جغرافیایی، در ماههای آینده تغییر کند.
پرسشهای متداول
آیا همهٔ متنهای ChatGPT از امروز واترمارک دارند؟
نه. واترمارک پیشفرض فقط برای متنهای واجد شرایط ChatGPT و Codex در اتحادیهٔ اروپا است و طی چند هفتهٔ آینده فعال میشود. بیرون از اروپا فقط اپهایی که سازندهشان آن را در API روشن کرده باشد واترمارک میگذارند.
آیا واترمارک نشان میدهد من چه کسی هستم؟
به گفتهٔ اوپنایآی نه. هیچ اسم، حساب، پرامپت یا گفتوگویی در متن ذخیره نمیشود. ابزار تشخیص هم فقط میگوید واترمارک پیدا شد یا نه.
میتوانم بفهمم متنم واترمارک دارد؟
فعلاً نه. ابزار تشخیص عمومی نیست و فقط پژوهشگرها و سازمانهای متخصص تأییدشده به آن دسترسی دارند. سایتهایی که ادعای بررسی واترمارک ChatGPT را دارند از ابزار اوپنایآی استفاده نمیکنند.
کپی کردن متن در Word واترمارک را پاک میکند؟
نه. به گزارش TechCrunch، واترمارک در خود انتخاب کلمههاست و با کپی کردن همراه متن میماند. اما عوض کردن کلمهها آن را ضعیف میکند؛ با تغییر یکچهارم کلمهها، تشخیص در آزمایش اوپنایآی به حدود ۱۷ درصد رسید.
متن فارسی هم واترمارک میگیرد؟
اوپنایآی دربارهٔ زبانها جزئیاتی نداده و عددهای منتشرشده مربوط به متن انگلیسی است. پس دربارهٔ اینکه واترمارک در متن فارسی چقدر قابل تشخیص است، هنوز اطلاع دقیقی وجود ندارد.
آیا واترمارک کیفیت جوابها را پایین میآورد؟
طبق آزمایشهای خود اوپنایآی روی مدل Astra، تفاوت معناداری دیده نشده است. هنوز آزمایش مستقلی در این باره منتشر نشده.
چرا Claude واترمارک را در همهٔ دنیا فعال کرده ولی ChatGPT فقط در اروپا؟
Anthropic گفته هنوز راه مطمئنی برای محدود کردن واترمارک به یک منطقه ندارد. اوپنایآی ترجیح داده اول در جایی که قانون الزامش کرده شروع کند و از بازخوردها یاد بگیرد.




