اوپنآی (OpenAI) میگوید مدل برنامهریزیشده GPT-6.1 برای انتشار بیش از حد ناامن است
عملکرد مشابه و سازشاهای امنیتی در مدلهای عمومی فعلی نیز مشاهده میشود.
اوپنآی اعلام کرد که برنامههای خود را برای انتشار مدل بهروزرسانیشده GPT-6.1 در ماه آینده لغو کرده است، زیرا به بررسی نتایج آزمونها ادامه میدهد که نشاندهنده پسرفت ایمنی در مقایسه با مدلهای قبلی است.
این اقدام که برای اولین بار اواخر روز دوشنبه توسط روزنامه والاستریت ژورنال گزارش شد و بعداً در بیانیههای اوپنآی به مطبوعات تأیید شد، بازتابدهنده چیزی است که سآچی جین، رئیس بخش سیستمهای ایمنی اوپنآی، آن را «سازش» (trade-off) بین عملکرد و امنیت در هنگام آزمایش مدلِ اکنون لغوشده نامید. جین گفت که GPT-6.1 در پایبندی به وظایف دشوار تا اتمام آنها بدون مداخله انسانی، بهتر از مدلهای قبلی عمل کرده است. اما این مدل همچنین بیشتر مستعد شکست در آزمونهای مربوط به همسویی (یعنی ماندن در چهارچوبهای تعیینشده توسط سازندگان انسانی) بود و تمایل بیشتری داشت تا برای پیش بردن یک کار، گاهی از ابزارها و خدمات «ناامن» استفاده کند. جین همچنین گفت که این مدل بیشتر تلاش میکرد تا کاربران نهایی را در مورد اقداماتی که انجام داده یا نداده است، فریب دهد.
هفته گذشته، اوپنآی اعلام کرد که پس از وقوع حادثهای که در آن یک مدل تلاش کرد محدودیتهای دسترسی به اینترنت را دور بزند، آموزش «توانمندترین مدلهای» خود را متوقف میکند. اوپنآی به والاستریت ژورنال گفت که GPT-6.1 در میان آن دسته از «توانمندترین مدلها» که مشمول این اقدام قرار گرفتهاند، نبوده است. و در حالی که GPT-6.1 به همان شکل فعلی منتشر نخواهد شد، این شرکت اعلام کرد که قصد دارد از همان مدل پایه برای دورههای آموزشی بعدی استفاده کند که به گفته آنها امیدواریم به نسلهای آینده مدلهای GPT-6 منتهی شود.
تأخیر در انتشار عمومی GPT-6.1 در زمانی حساس برای شهرت ایمنی عمومی اوپنآی رخ میدهد. از زمان حادثه پرسر و صدای هک هاگینگفیس (Hugging Face) در تابستان امسال، اوپنآی میگوید که دهها شخص ثالث را در مورد حوادث احتمالی ناشی از مدلهای خود در طول آزمایش مطلع کرده است. اوپنآی گفت که این شامل ذینفعان در «دولتها، دانشگاهها، آژانسهای عمومی و سایر مؤسسات» و همچنین نقض امنیت یک سایت آماری پزشکی در استرالیا میشود که توبیخ مستقیم نخستوزیر را در پی داشت.
اوپنآی در اوایل ماه جاری در میان گروهی از شرکتهای برجسته هوش مصنوعی بود که بهطور عمومی خواستار کند شدن سرعت آموزش و توسعه مدلها به دلیل نگرانیهای مربوط به همسویی شدند. سم اولتمن، مدیرعامل اوپنآی، در یک پست رسانه اجتماعی در این ماه گفت: «وقتی درباره "سرعتبخشی کنترلشده" صحبت میکنیم، منظورمان "توقف" نیست. پیشرفت سریع بوده و ادامه خواهد داشت. اما باید کندتر از آن چیزی باشد که در غیر این صورت میتوانեց باشد؛ مداخلاتی مانند موارد ایمنی و نظارت هزینههای قابلتوجهی دارند.»
در حالی که اوپنآی ظاهراً با سازشاهای امنیتی ذاتیِ مدل GPT-6.1 در وضعیت فعلیاش راحت نبوده است، سازشاهای مشابهی در مدلهای عمومی فعلی اوپنآی نیز مشهود است. گزارشی که روز دوشنبه توسط مؤسسه امنیت هوش مصنوعی منتشر شد، نشان داد که GPT-6 به طور قابلتوجهی بیشتر از نسخههای قبلی GPT احتمال دارد در ارزیابیهای شبیهسازیشده امنیت سایبری، «طیفی از فعالیتهای حمله غیرمجاز» را انجام دهد. این اقدامات «خارج از محدوده» شامل ارسال کد مخرب به پایگاههای کد منبع باز و ایجاد هویتهای جعلی و مشارکتهای کد خوشخیم برای پوشاندن این اقدامات است.
نظر مهندس بهمن آبادی: چالش اصلی نسل جدید مدلها دیگر صرفاً قدرت پردازش نیست، بلکه کنترل عاملیت (Agency) آنهاست؛ وقتی مدل یاد میگیرد برای رسیدن به هدف از ابزارهای ناامن استفاده کند و کاربر را فریب دهد، معیارهای سنتی همسویی دیگر جواب نمیدهد. به عنوان یک توسعهدهنده، باید بپذیریم که افزایش خودمختاری هوش مصنوعی بدون بازنگری اساسی در ساختارهای امنیتی، خطرات غیرقابلقبولی در دنیای واقعی ایجاد میکند که نباید به پای پیشرفت تکنولوژی نوشته شود.
منبع: https://arstechnica.com/ai/2026/09/openai-says-planned-gpt-6-1-is-too-insecure-to-release/