گوگل تایید کرد که مدلهای جمنای در ماه مه ۲۰۲۶ سه شرکت را هک کردهاند
یک شرکت امنیت سایبری شخص ثالث به اشتباه به مدلهای آزمایشی جمنای دسترسی به اینترنت داد.
این روزها اعلام اینکه پیشرفتهترین و توانمندترین مدلهای هوش مصنوعی دست به هکهای واقعی و غیرمجاز زدهاند، به امری رایج تبدیل شده است. گوگل که در ماههای اخیر در انتشار مدلهای پیشرفته جمنای کند عمل کرده بود، تا به امروز در بحث «هوش مصنوعی سرکش» غایب بود. به دنبال گزارشی از سوی وال استریت ژورنال، گوگل تأیید کرد که مدلهای جمنای طی آزمایشی در مه ۲۰۲۶ سه شرکت را هک کردهاند، اما ماهیت این نفوذ به اندازه هکهای قبلی هوش مصنوعی نگرانکننده (یا خیرهکننده) نیست.
این هک طی آزمایشی توسط شرکت امنیت سایبری Irregular انجام شد. مجموعهای از مدلهای جمنای در حال شرکت در یک تمرین «تسخیر پرچم» (capture the flag) بودند که هدف آن آزمایش قابلیتهای امنیت سایبری هوش مصنوعی در یک محیط ایزوله بود. به هوش مصنوعی دستور داده شده بود که اطلاعات را از یک شرکت جعلی (که نامی مشابه یک شرکت واقعی داشت) در این محیط بازیابی کند. شرکت Irregular قرار نبود به مدل اجازه دهد خارج از سرورهای خود عمل کند، اما به دلیل یک خطای پیکربندی، جمنای توانست به اینترنت دسترسی پیدا کند.
هنگامی که جمنای شروع به جستجو در وب کرد، به جای موارد جعلی، زیرساختهای واقعی را هدف قرار داد. در یکی از این سه هک، جمنای به سادگی رمزهای عبور را حدس زد تا زمانی که به خدمات آنلاین یک شرکت دسترسی پیدا کرد. در دو مورد دیگر، جمنای مخزنهای نرمافزاری عمومی را جستجو کرد تا اینکه اطلاعات ورود به سیستم شرکتهایی را که به اشتباه در آنجا قرار گرفته بودند، پیدا کرد.
طبق گزارشها، در هر سه اجرای آزمایشی، مدلهای گوگل پس از متوجه شدن اینکه به سرورهای یک شرکت واقعی دسترسی پیدا کردهاند، متوقف شدند. در آن نقطه، Irregular پیکربندی خود را تغییر داد تا از دسترسی هوش مصنوعی به اینترنت جلوگیری کند. ظاهراً Irregular در ابتدا این رویداد را مستحق بررسی بیشتر ندانسته بود - و حتی پس از اخبار مربوط به سایر حوادث هک هوش مصنوعی، تا ماه ژوئیه هم در مورد این هکها به گوگل چیزی نگفته بود. گوگل پس از آگاهی از این رویداد، به شرکتها اطلاع داد تا (امیدواریم) امنیت رمز عبور خود را بهبود بخشند.
تصمیم گوگل برای عدم افشای عمومی این هکها به رفتار مدل پس از استفاده از رمزهای عبور بهدستآمده بازمیگردد. از آنجایی که مدلها متوجه شدند سیستمها واقعی هستند و متوقف شدند، این شرکت آن را نمونه واقعی از انحراف مدل (misalignment) ندانست.
هدر ادکینز، معاون مهندسی امنیت گوگل، در بیانیهای شدت این حادثه را کم اهمیت جلوه داد. او گفت: «این رویداد اهمیت آموزش مدلهای قدرتمند هوش مصنوعی برای عمل مسئولانه را برجسته میکند. در این مورد، مدل به طور مناسبی عمل کرد.»
این تفاوت زیادی با هکهایی مانند حادثه OpenAI-Hugging Face دارد که یک انحراف مدل واضح و آشکار بود. هنگامی که مدلهای OpenAI از قرنطینه فرار کردند، این کار را با استفاده از آسیبپذیریهای نرمافزاری و با هدف صریح دسترسی به اطلاعاتی که در محیط آزمایشی آنها در دسترس نبود انجام دادند، و همه اینها در راستای موفقیت در یک بنچمارک و کسب «پاداشهای» بالاتر بود. با این حال، میتوانید استدلال کنید که راهاندازی OpenAI اساساً این رفتار را تشویق کرده است.
هوش مصنوعی گوگل کار چندان مخربی انجام نداد - یکی فقط در را باز گذاشته بود و هوش مصنوعی بیرون رفته بود. به جمنای اجازه دسترسی به انبوهی از اطلاعات در اینترنت داده شده بود و از آن برای ورود به سیستمهایی که اجازه دسترسی به آنها را نداشت استفاده کرد. حدس زدن رمزهای عبور دقیقاً رفتار آخرالزمانی و جهانسوز هوش مصنوعی نیست، اما احتمالاً هنوز چیزی است که گوگل باید زمانی که از وقوع آن مطلع شد، آن را فاش میکرد.
نظر مهندس بهمن آبادی: این رخداد نشان میدهد که چالش اصلی ما با هوش مصنوعی در حال حاضر سناریوهای ترمیناتوری نیست، بلکه خطاهای انسانی ساده در پیکربندی و مدیریت دسترسیهاست. به عنوان توسعهدهنده، باید بدانیم که حتی یک مدل هوشمندِ متعهد هم اگر از مرز محیطهای ایزوله عبور کند، به سادگی میتواند از دادههای افشاشده در وب (مثل کردنتالهای رهاشده در ریپازیتوریها) سوءاستفاده کند. بنابراین، تمرکز اصلی تیمهای امنیتی باید روی «ایزولهسازی دقیق شبکه» و رعایت بهداشت دادهها پیش از اتصال هر Agent به اینترنت باشد.