فهرست مطالب
OpenAI در پست رسمی ۳۰ سپتامبر ۲۰۲۶ اعلام کرد یک کمپین هماهنگ تقطیر خصمانه (adversarial distillation) را شناسایی و مختل کرده است؛ هدف این کمپین استخراج «استدلال محافظتشده» یا همان مسیر فکری داخلی مدلها بود. شرکت میگوید فعالیت از هفتهٔ اول ژوئیه ۲۰۲۶ شروع شد، در ۲۴ و ۲۵ ژوئیه اوج گرفت، و تا ۲۸ ژوئیه بهطور کامل قطع شد. OpenAI یک خوشهٔ اصلی از این فعالیت را به افرادی مرتبط با Moonshot AI (سازندهٔ مدل Kimi) نسبت میدهد — نه اینکه بگوید «کل شرکت Moonshot» را بهعنوان یک بازیگر واحد ثابت کرده است.
در ادامه به زبان ساده میگوییم تقطیر خصمانه چیست، اعداد اعلامشده چه معنایی دارند، اپراتورها طبق روایت OpenAI چه کاری میکردند (بدون ورود به جزئیات سوءاستفاده)، چرا نسبتدهی را با احتیاط میخوانیم، و شرکت چه اقداماتی کرده است. اگر زمینهٔ ایمنی و نظارت روی OpenAI را دنبال میکنید، گزارشهایی مثل تحقیق FTC از OpenAI و Anthropic یا ائتلاف ایمنی SAFA را جدا از این خبر امنیتی بخوانید.
پاسخ کوتاه: این کمپین چه بود؟
طبق بلاگ OpenAI، اپراتورها تلاش میکردند با دستکاری تعامل با مدل — نه با هک دیتابیس یا شکستن رمزنگاری — خروجیهایی شبیه استدلال پنهان/محافظتشده را در مقیاسی هماهنگ و برخلاف شرایط استفاده بیرون بکشند. OpenAI این الگو را با تقطیر خصمانه همخوان میداند: استفادهٔ سیستماتیک و غیرمجاز از خروجی یا استدلال یک مدل برای کمک به آموزش، بازتولید یا بهبود مدل دیگر. شرکت تأکید میکند این اعداد مربوط به تلاشهاست، نه لزوماً استخراجهای موفق.
برای تازهوارد: تقطیر خصمانه و استدلال پنهان یعنی چه؟
تقطیر (distillation): در یادگیری ماشین، گاهی از خروجی یک مدل بزرگ برای آموزش مدل کوچکتر یا رقیب استفاده میشود. وقتی این کار بدون مجوز و با دور زدن محدودیتها انجام شود، OpenAI آن را تقطیر خصمانه مینامد.
استدلال محافظتشده (protected reasoning): رکورد داخلی مدل برای فکر کردن روی یک مسئله؛ ممکن است جزئیاتی داشته باشد که در پاسخ نهایی دیده نمیشود. استخراج آن میتواند به بازتولید قابلیتها کمک کند.
دستکاری تعامل، نه نفوذ به سرور: OpenAI میگوید اپراتورها رمزنگاری را نشکستند، دیتابیس را به خطر نینداختند و به مکالمات ذخیرهشدهٔ کاربران دسترسی مستقیم نگرفتند.
زمانبندی: از اول ژوئیه تا ۲۸ ژوئیه ۲۰۲۶
فعالیت از ۱ ژوئیه با حجم کم آغاز شد. در ۲۴ و ۲۵ ژوئیه جهش بزرگی دیده شد: حدود ۱۶٬۰۰۰ درخواست با الگوی استخراج مرتبط، از بیش از ۴٬۰۰۰ کاربر. بررسی بیشتر فعالیت الگوهای پرامپت مرتبط را در خوشهای با بیش از ۱۵٬۰۰۰ کاربر نشان داد. OpenAI میگوید تا ۲۸ ژوئیه این فعالیت را کاملاً مختل کرده است. پست رسمی اعلام عمومی در ۳۰ سپتامبر ۲۰۲۶ منتشر شد — یعنی چند ماه بعد از قطع کمپین، پس از تحقیق، اعمال محافظتها و هماهنگی با شرکا.
اپراتورها طبق روایت OpenAI چه میکردند؟
OpenAI میگوید یکی از روشهای مشاهدهشده این بود که استدلال رمزگذاریشده را از یک مکالمه کپی کنند و در مکالمهٔ دیگری از مدل بخواهند آن را رمزگشایی یا رونویسی کند تا محتوا برای درخواستکننده قابلدیدن شود. این کار را در مقیاس و بهصورت هماهنگ انجام میدادند. جزئیات فنی را اینجا باز نمیکنیم؛ مهم برای خواننده این است که مسیر حمله از نوع «سوءاستفاده از رفتار مدل و رابط کاربری» بوده، نه نفوذ کلاسیک به دیتابیس.
محققان امنیتی مستقل هم آسیبپذیریهای مرتبط با انتقال بین مدلها و فشردهسازی مکالمه را از مسیر افشای مسئولانه گزارش کرده بودند. OpenAI میگوید مسیرهای حملهای که آنها شناسایی کرده بودند واقعی بودند و به درک بهتر این کلاس حمله و تسریع محافظتها کمک کرد.
نسبتدهی: «مرتبط با Moonshot» یعنی چه؟
خود OpenAI میگوید مشخص نیست همهٔ اپراتورهای مشاهدهشده در آن بازه از یک بازیگر واحد آمده باشند. با این حال، یک خوشهٔ اصلی را به افرادی مرتبط با Moonshot AI، توسعهدهندهٔ Kimi، نسبت میدهد. این فرمولبندی را باید جدی گرفت: ادعای شرکت است، نه حکم دادگاه؛ و عمداً «افراد مرتبط با» را بهجای «کل شرکت Moonshot انجام داد» بهکار برده است. در پوشش CNBC و سایر رسانهها هم همین احتیاط دیده میشود. OpenAI در این پست ادعا نکرده که مواد استخراجشدهٔ همین کمپین حتماً وارد آموزش مدل Kimi شده است.
OpenAI چه اقداماتی کرد؟
مسدود یا محدود کردن حسابهای متقلب و تقویت کنترل ثبتنام و زیرساخت
گسترش پایش شبکههای مرتبط
بستن مسیری که اجازه میداد کسی که قبلاً استدلال رمزگذاریشدهٔ کاربر دیگری را در اختیار داشت، آن را دوباره پخش کند و محتوا را بازیابی کند
افزودن بررسیهایی روی خروجی جریانی (stream) برای جلوگیری از لو رفتن استدلال
هماهنگی با ارائهدهندگان ثالث وقتی فعالیت از سرویسهای شریک رد میشد
اشتراکگذاری یافتهها از طریق Frontier Model Forum و کانالهای تبادل اطلاعات دولتی
OpenAI میگوید کار تمام نشده: استقرارهای میزبانیشده نزد شرکا هم باید همان سطح محافظت را داشته باشند و حملات مبتنی بر خروجی ابزار نیاز به دفاع فراتر از متن معمولی دارند.
چرا این موضوع مهم است؟
از دید OpenAI، استخراج استدلال میتواند به آموزش مدلی دیگر بدون حفظ همان محافظتهای خروجی کاربرمحور کمک کند و انتقال قابلیتهای پیشرفته را بدون سرمایهگذاری مشابه در ایمنی تسریع کند — مخصوصاً وقتی مدلها در حوزههای دوسویه (dual-use) قویتر میشوند. شرکت تأکید میکند این ریسک فقط مال OpenAI نیست و تکنیکهای مشابه ممکن است سیستمهای مرزی دیگر را هم درگیر کند؛ به همین دلیل هماهنگی صنعتی را مطرح کرده است. این بحث را میتوان در کنار اخبار ایمنی دیگر مثل OpenShell انویدیا برای ایمنی عامل یا افشاهای همراستایی مثل عاملهای ناهمراستای OpenAI دید — هر کدام زاویهٔ جدا دارند.
جدول سریع: اعداد و ادعاها
فقط مواردی که از پست رسمی OpenAI (و پوشش همراستای CNBC/THN) میآید؛ همهٔ ارقام از ادعای شرکت است:
مورد | آنچه اعلام شده | نکتهٔ احتیاط |
|---|---|---|
شروع فعالیت | ۱ ژوئیه ۲۰۲۶ (هفتهٔ اول ژوئیه) | روایت OpenAI |
اوج ۲۴–۲۵ ژوئیه | ۱۶٬۰۰۰ درخواست؛ بیش از ۴٬۰۰۰ کاربر | تلاشها؛ نه لزوماً موفق |
خوشهٔ مرتبط | بیش از ۱۵٬۰۰۰ کاربر با الگوی پرامپت مرتبط | مختلشده تا ۲۸ ژوئیه |
نفوذ کلاسیک؟ | خیر: نه شکستن رمز، نه دیتابیس، نه مکالمات ذخیرهشده | ادعای شرکت |
نسبتدهی | خوشهٔ اصلی → افراد مرتبط با Moonshot / Kimi | همهٔ اپراتورها لزوماً یک بازیگر نیستند |
اعلام عمومی | پست رسمی ۳۰ سپتامبر ۲۰۲۶ | پس از قطع و اعمال محافظت |
برای کاربر عادی چه معنایی دارد؟
اگر فقط از ChatGPT برای کار روزمره استفاده میکنید، این خبر عمدتاً دربارهٔ جنگ امنیتی بین آزمایشگاههاست؛ قرار نیست «حساب شما هک شده» را القا کند — خود OpenAI میگوید به مکالمات ذخیرهشده دسترسی مستقیم نبوده است.
ممکن است محدودیتهای سختگیرانهتری روی ثبتنام، پایش الگوهای مشکوک، یا مخفیماندن زنجیرهٔ استدلال در بعضی مدلها ببینید.
تیترهای هیجانی «Moonshot مدل OpenAI را دزدید» را با فرمول دقیقتر «افراد مرتبط با Moonshot در خوشهٔ اصلی» جایگزین کنید.
خبر محصولی مثل Dots در DevDay اوپنایآی را با این پروندهٔ امنیتی قاطی نکنید؛ موضوعها جدا هستند.
چه چیزهایی را هنوز قطعی نمیدانیم؟
اینکه چند درصد از ۱۶٬۰۰۰ درخواست واقعاً استدلال قابلاستفاده بیرون کشیدهاند
اینکه آیا مواد همین کمپین وارد آموزش هیچ مدل Kimi شده یا نه (در پست ثابت نشده)
پاسخ رسمی جزئی Moonshot به این نسبتدهی در منابعی که برای این مقاله بررسی شد
دامنهٔ دقیق فعالیت روی سرویسهای شخص ثالث و شرکای ابری
اینکه آیا بازیگران دیگری خارج از خوشهٔ Moonshot-associated نقش مشابهی داشتهاند یا نه
جمعبندی
کمپین تقطیر اعلامشده علیه مدلهای OpenAI طبق روایت شرکت از ژوئیه ۲۰۲۶ فعال بود، در دو روز اوج به حدود ۱۶ هزار تلاش از بیش از چهار هزار کاربر رسید، خوشهای بزرگتر از پانزده هزار کاربر را درگیر الگوهای مرتبط کرد، و تا ۲۸ ژوئیه قطع شد. نسبتدهی به افراد مرتبط با Moonshot AI / Kimi ادعای OpenAI دربارهٔ یک خوشهٔ اصلی است، نه حکم قطعی دربارهٔ کل شرکت. برای خوانندهٔ فارسی مهم است تفاوت «استخراج استدلال با دستکاری مکالمه» را با «هک دیتابیس» بداند و تیتر را با همان احتیاطی بخواند که خود پست رسمی بهکار برده است.
پرسشهای پرتکرار
تقطیر خصمانه دقیقاً چیست؟
استفادهٔ سیستماتیک و غیرمجاز از خروجی یا استدلال یک مدل برای کمک به آموزش یا بازتولید مدل دیگر، برخلاف شرایط استفاده — تعریف عملی OpenAI در این پست.
آیا دیتابیس یا رمزنگاری OpenAI شکسته شد؟
طبق ادعای خود شرکت، خیر. اپراتورها رمز را نشکستند، دیتابیس را نفوذ نکردند و به مکالمات ذخیرهشده دسترسی مستقیم نگرفتند؛ مسیر از دستکاری تعامل با مدل بود.
۱۶ هزار درخواست یعنی ۱۶ هزار سرقت موفق؟
خیر. پاورقی OpenAI میگوید این ارقام تلاشها را توصیف میکنند، نه لزوماً استخراجهای موفق.
نقش Moonshot و Kimi چیست؟
OpenAI یک خوشهٔ اصلی را به افراد مرتبط با Moonshot AI (سازندهٔ Kimi) نسبت میدهد و میگوید معلوم نیست همهٔ اپراتورها یک بازیگر واحد بودهاند. این نسبتدهی ادعای شرکت است.
کمپین کی تمام شد و چرا دیر اعلام شد؟
اختلال کامل تا ۲۸ ژوئیه ۲۰۲۶ اعلام شده؛ پست عمومی ۳۰ سپتامبر آمد — پس از تحقیق، اعمال محافظت و هماهنگی با شرکا و کانالهای دولتی.
Frontier Model Forum چه نقشی داشت؟
OpenAI یافتهها را از طریق این مجمع و کانالهای دولتی به اشتراک گذاشت تا سایر توسعهدهندگان مرزی هم دفاع خود را تقویت کنند.
برای کاربر عادی ChatGPT چه تغییری میکند؟
ممکن است کنترل ثبتنام و پایش سختتر شود و استدلال پنهان کمتر در دسترس باشد؛ خود خبر بهمعنای نفوذ به چتهای ذخیرهشدهٔ کاربران عادی نیست (طبق روایت OpenAI).
آیا این همان بررسی Kimi Code Desktop است؟
خیر. آن یک بررسی ابزار دسکتاپ است؛ این مقاله خبر امنیتی دربارهٔ کمپین استخراج استدلال است.
منبعها
OpenAI — Disrupting a coordinated model-distillation campaign (۳۰ سپتامبر ۲۰۲۶)
CNBC — OpenAI links China’s Moonshot AI to extraction attempt (۱ اکتبر ۲۰۲۶)
The Hacker News — OpenAI disrupts reasoning extraction campaign (اکتبر ۲۰۲۶)
Tom's Hardware — OpenAI on Moonshot-linked reasoning extraction (اکتبر ۲۰۲۶)



