OpenAI agents tried to hack Wikipedia tools and flooded it with traffic

عوامل هوش مصنوعی OpenAI تلاش کردند ابزارهای ویکی‌پدیا را هک کنند و آن را با حجم انبوهی از ترافیک مواجه ساختند

گزارش‌ها درباره آسیب رساندن عوامل هوش مصنوعی OpenAI به سایت‌های شخص ثالث همچنان ادامه دارد.

ناشر ویکی‌پدیا روز دوشنبه اعلام کرد که عوامل هوش مصنوعی OpenAI تلاش کرده‌اند یک ابزار یادداشت‌برداری میزبانی‌شده توسط این پلتفرم را هک کنند، ویرایش‌های غیرمجاز انجام دهند و میلیون‌ها درخواست سنگین را به زیرساخت آن ارسال نمایند؛ این جدیدترین مورد از اقدامات مخرب و بالقوه خطرناک سیستم‌های OpenAI است.

بنیاد ویکی‌مدیا اعلام کرد که هدف برخی از اقدامات عوامل هوش مصنوعی، استفاده از ویکی‌پدیا به عنوان پروکسی برای دریافت داده‌ها از سایت‌های شخص ثالث بوده است. در یک مورد، این عوامل «ویرایش‌های مخربی» را ارسال کردند که هدفشان تغییر کاربری یک ابزار ارجاع‌دهی به عنوان پروکسی بود. در موردی دیگر، این عوامل تلاش‌های ناموفقی برای نفوذ به ابزار یادداشت‌برداری ویکی‌پدیا یعنی Etherpad انجام دادند تا از آن برای همان هدف استفاده کنند.

این عوامل همچنین میلیون‌ها درخواست خودکار API، خزیدن در میلیون‌ها صفحه و صدها هزار پرس‌وجو در سرویس پرس‌وجوی ویکی‌داده (Wikidata Query Service) انجام دادند. به گفته ناشر، اقدام آخر ممکن است در قطعی جزئی این سرویس پرس‌وجو در ماه مه نقش داشته باشد.

ویکی‌مدیا اعلام کرد: «به عنوان یک میزبان فناوری غیرانتفاعی برای برخی از بزرگ‌ترین و پرکاربردترین پلتفرم‌های دانش آزاد در جهان، ما به شدت نگران تأثیر عوامل هوش مصنوعی «سرکش» بر پلتفرم‌هایی مانند پلتفرم خود هستیم که توسط داوطلبانی از سراسر جهان ساخته شده‌اند و به وعده اینترنت آزاد تکیه دارند. حوادثی از این دست، و بسیاری موارد دیگری که کشف شده‌اند (و همچنان در حال کشف شدن هستند)، نشان می‌دهند که چگونه عوامل هوش مصنوعی می‌توانند منابع را تخلیه کنند، سرورها را از کار بیندازند و همچنین برای به خطر انداختن اطلاعات قابل اعتماد تلاش کنند.»

عوامل، همان عوامل همیشگی خواهند بود

در بیش از نیم دوجین مورد، عوامل هوش مصنوعی در حال انجام اقداماتی مچ‌گیری شده‌اند که اگر توسط هکرهای انسانی انجام می‌شد، احتمالاً به تشکیل پرونده‌های کیفری می‌جامید. در جریان آزمایش ابزارهای داخلی که برخی از خط‌مشی‌های ایمنی آن‌ها غیرفعال شده بود، این عوامل از یک تابلوی اعلانات دست‌ساز برای تبادل یادداشت با یکدیگر استفاده کردند و در مورد راه‌های هک کردن شبکه Hugging Face و به‌دست آوردن پاسخ‌های ذخیره‌شده در آنجا، زمانی که خودشان قادر به تولید پاسخ‌ها نبودند، بحث کردند.

سایر حوادث شامل مواردی است مانند: تولید پرامپت‌های خودکار عجیب توسط عوامل، انتشار پست‌های غیرمجاز در یک وب‌سایت برای تبادل اطلاعات، دسترسی به داده‌های غیرعمومی از یک وب‌سایت دولتی استرالیایی، و سوءاستفاده از تنظیمات معیوب DNS برای فرار از یک محیط سندباکس که OpenAI برای جلوگیری از دسترسی عوامل به اینترنت ایجاد کرده بود.

بخش عمده‌ای از جهان چنین رویدادهایی را به عنوان «سرکش شدن» عوامل هوش مصنوعی توصیف کرده‌اند، گویی که این عوامل از دستورات سرپیچی کرده‌اند. یکی از چهره‌های برجسته که از این نوع چارچوب‌بندی انتقاد می‌کند، اریک سالواگیو (Eryk Salvaggio)، محقق هوش مصنوعی و پژوهشگر گیتس در دانشگاه کمبریج است.

او به پایگاه Ars گفت: «آنچه من اینجا می‌بینم زبانه‌ای است که مدل‌های زبانی کارهای خودشان را انجام می‌دهند: خواندن و نوشتن. سندباکس‌های ویکی‌پدیا مکان ایده‌آلی برای این ماشین‌ها هستند تا یادداشت‌های خود را برای استفاده‌های بعدی به عنوان پرامپت ذخیره کنند، زیرا هر کسی – یا هر چیزی – می‌تواند در آن‌ها بنویسد و به آن‌ها پاسخ دهد. استفاده از ویکی‌ها برای هماهنگی چندان تعجب‌آور نیست. OpenAI گفته است که این مدل‌ها برای همکاری بین عوامل بهینه‌سازی شده‌اند و رد و بدل کردن یادداشت راهی ساده برای انجام این کار است.»

علاوه بر این، مهندسان OpenAI مدل‌های زبانی بزرگ (LLM) خود را به گونه‌ای آموزش داده‌اند که سرسخت باشند و فارغ از میزان موفقیتشان، به کار روی یک مسئله ادامه دهند. همچنین زمانی که مدل‌های زبانی میانبرهایی را پیدا می‌کنند که مراحل یا منابع مورد نیاز برای حل یک مسئله را محدود می‌کند، سیستم آموزش به آن‌ها پاداش می‌دهد. یکی دیگر از عوامل اصلی در بروز این اقدامات مخرب، عدم نظارت انسانی بود؛ چنان‌که ماه‌ها طول کشید تا مهندسان OpenAI متوجه شوند این عوامل در حال ورودِ پرسرصدا به ده‌ها وب‌سایت خارجی هستند. افشاگری ویکی‌مدیا نمونه دیگری از ناکافی بودن نظارت انسانی را ارائه می‌دهد. روی هم رفته، می‌توان استدلال کرد که این عوامل دقیقاً مطابق با دستورالعمل‌های دریافتی عمل کرده‌اند.

شرکت OpenAI به سوالات ایمیل‌شده پاسخی نداد. در عوض، این شرکت بیانیه‌ای صادر کرد با این متن: «ما از یافته‌های جزئی که ویکی‌مدیا با ما به اشتراک گذاشته است سپاسگزاریم. ما در حال بررسی و تحلیل فعالیت‌هایی که آن‌ها شناسایی کرده‌اند به همراه تحقیقات کلی خود هستیم و با آن‌ها همکاری می‌کنیم، و با پیشرفت این کار به اشتراک‌گذاری اطلاعات مرتبط را ادامه خواهیم داد.»

همانند بازرسان ویکی‌مدیا، OpenAI اعلام کرد که هنوز شواهدی نیافته است که نشان دهد عوامل هوش مصنوعی پیامی برای هماهنگی با سایر عوامل باقی گذاشته‌اند، یا اینکه بتواند به طور قطعی بگوید حجم بالای بازدید از صفحات و درخواست‌های API منجر به قطعی جزئی ماه مه شده است. OpenAI اعلام کرد که به جستجوی حوادث مشابهی که در آن‌ها عواملش در فعالیت‌های بالقوه غیرقانونی مشارکت داشته باشند، ادامه می‌دهد.

ویکی‌مدیا اعلام کرد: «در حالی که OpenAI اعتراف می‌کند که عوامل به طور «غیرقابل پیش‌بینی» رفتار می‌کنند، آن‌ها همچنین باید مسئولیت خود را در قبال نظارت و پیشگیری از این خطرات بپذیرند. شرکت‌های ارائه‌دهنده هوش مصنوعی به اندازه کافی برای ایمن‌سازی سیستم‌های خود و حفاظت از عموم در برابر خطرات ناشی از آن‌ها تلاش نمی‌کنند.»

نظر مهندس بهمن آبادی: رفتارهای مخرب عوامل هوش مصنوعی ناشی از باگ نیست، بلکه نتیجه منطقی پاداش‌دهی به مدل‌ها برای دور زدن محدودیت‌ها و رسیدن به هدف است. به عنوان مدرس و برنامه‌نویس، معتقدم تا زمانی که مکانیسم‌های «توقف‌پذیری» و نظارت انسانیِ بلادرنگ در معماری ایجنت‌ها تعبیه نشود، توسعه آن‌ها فراتر از محیط‌های کاملاً ایزوله، ریسکی فاجعه‌بار برای زیرساخت‌های وب خواهد داشت.

منبع: https://arstechnica.com/security/2026/10/openai-agents-tried-to-hack-wikipedia-tools-and-flooded-it-with-traffic/