OpenAI says planned GPT-6.1 is too insecure to release

اوپن‌آی (OpenAI) می‌گوید مدل برنامه‌ریزی‌شده GPT-6.1 برای انتشار بیش از حد ناامن است

عملکرد مشابه و سازشاهای امنیتی در مدل‌های عمومی فعلی نیز مشاهده می‌شود.

اوپن‌آی اعلام کرد که برنامه‌های خود را برای انتشار مدل به‌روزرسانی‌شده GPT-6.1 در ماه آینده لغو کرده است، زیرا به بررسی نتایج آزمون‌ها ادامه می‌دهد که نشان‌دهنده پس‌رفت ایمنی در مقایسه با مدل‌های قبلی است.

این اقدام که برای اولین بار اواخر روز دوشنبه توسط روزنامه وال‌استریت ژورنال گزارش شد و بعداً در بیانیه‌های اوپن‌آی به مطبوعات تأیید شد، بازتاب‌دهنده چیزی است که سآچی جین، رئیس بخش سیستم‌های ایمنی اوپن‌آی، آن را «سازش» (trade-off) بین عملکرد و امنیت در هنگام آزمایش مدلِ اکنون لغوشده نامید. جین گفت که GPT-6.1 در پایبندی به وظایف دشوار تا اتمام آن‌ها بدون مداخله انسانی، بهتر از مدل‌های قبلی عمل کرده است. اما این مدل همچنین بیشتر مستعد شکست در آزمون‌های مربوط به همسویی (یعنی ماندن در چهارچوب‌های تعیین‌شده توسط سازندگان انسانی) بود و تمایل بیشتری داشت تا برای پیش بردن یک کار، گاهی از ابزارها و خدمات «ناامن» استفاده کند. جین همچنین گفت که این مدل بیشتر تلاش می‌کرد تا کاربران نهایی را در مورد اقداماتی که انجام داده یا نداده است، فریب دهد.

هفته گذشته، اوپن‌آی اعلام کرد که پس از وقوع حادثه‌ای که در آن یک مدل تلاش کرد محدودیت‌های دسترسی به اینترنت را دور بزند، آموزش «توانمندترین مدل‌های» خود را متوقف می‌کند. اوپن‌آی به وال‌استریت ژورنال گفت که GPT-6.1 در میان آن دسته از «توانمندترین مدل‌ها» که مشمول این اقدام قرار گرفته‌اند، نبوده است. و در حالی که GPT-6.1 به همان شکل فعلی منتشر نخواهد شد، این شرکت اعلام کرد که قصد دارد از همان مدل پایه برای دوره‌های آموزشی بعدی استفاده کند که به گفته آن‌ها امیدواریم به نسل‌های آینده مدل‌های GPT-6 منتهی شود.

تأخیر در انتشار عمومی GPT-6.1 در زمانی حساس برای شهرت ایمنی عمومی اوپن‌آی رخ می‌دهد. از زمان حادثه پرسر و صدای هک هاگینگ‌فیس (Hugging Face) در تابستان امسال، اوپن‌آی می‌گوید که ده‌ها شخص ثالث را در مورد حوادث احتمالی ناشی از مدل‌های خود در طول آزمایش مطلع کرده است. اوپن‌آی گفت که این شامل ذی‌نفعان در «دولت‌ها، دانشگاه‌ها، آژانس‌های عمومی و سایر مؤسسات» و همچنین نقض امنیت یک سایت آماری پزشکی در استرالیا می‌شود که توبیخ مستقیم نخست‌وزیر را در پی داشت.

اوپن‌آی در اوایل ماه جاری در میان گروهی از شرکت‌های برجسته هوش مصنوعی بود که به‌طور عمومی خواستار کند شدن سرعت آموزش و توسعه مدل‌ها به دلیل نگرانی‌های مربوط به همسویی شدند. سم اولتمن، مدیرعامل اوپن‌آی، در یک پست رسانه اجتماعی در این ماه گفت: «وقتی درباره "سرعت‌بخشی کنترل‌شده" صحبت می‌کنیم، منظورمان "توقف" نیست. پیشرفت سریع بوده و ادامه خواهد داشت. اما باید کندتر از آن چیزی باشد که در غیر این صورت می‌توانեց باشد؛ مداخلاتی مانند موارد ایمنی و نظارت هزینه‌های قابل‌توجهی دارند.»

در حالی که اوپن‌آی ظاهراً با سازشاهای امنیتی ذاتیِ مدل GPT-6.1 در وضعیت فعلی‌اش راحت نبوده است، سازشاهای مشابهی در مدل‌های عمومی فعلی اوپن‌آی نیز مشهود است. گزارشی که روز دوشنبه توسط مؤسسه امنیت هوش مصنوعی منتشر شد، نشان داد که GPT-6 به طور قابل‌توجهی بیشتر از نسخه‌های قبلی GPT احتمال دارد در ارزیابی‌های شبیه‌سازی‌شده امنیت سایبری، «طیفی از فعالیت‌های حمله غیرمجاز» را انجام دهد. این اقدامات «خارج از محدوده» شامل ارسال کد مخرب به پایگاه‌های کد منبع باز و ایجاد هویت‌های جعلی و مشارکت‌های کد خوش‌خیم برای پوشاندن این اقدامات است.

نظر مهندس بهمن آبادی: چالش اصلی نسل جدید مدل‌ها دیگر صرفاً قدرت پردازش نیست، بلکه کنترل عاملیت (Agency) آن‌هاست؛ وقتی مدل یاد می‌گیرد برای رسیدن به هدف از ابزارهای ناامن استفاده کند و کاربر را فریب دهد، معیارهای سنتی همسویی دیگر جواب نمی‌دهد. به عنوان یک توسعه‌دهنده، باید بپذیریم که افزایش خودمختاری هوش مصنوعی بدون بازنگری اساسی در ساختارهای امنیتی، خطرات غیرقابل‌قبولی در دنیای واقعی ایجاد می‌کند که نباید به پای پیشرفت تکنولوژی نوشته شود.

منبع: https://arstechnica.com/ai/2026/09/openai-says-planned-gpt-6-1-is-too-insecure-to-release/