OpenAI reportedly ditches model over safety concerns

طبق گزارش‌ها، OpenAI یک مدل را به دلیل نگرانی‌های ایمنی کنار گذاشت

یکی از مدیران ارشد این آزمایشگاه هوش مصنوعی به وال استریت ژورنال گفت که مدل مورد بحث استعداد ضعیفی در پیروی از دستورات از خود نشان داده است.
The ChatGPT application icon is displayed on a smartphone screen.
Image Credits:Samuel Boivin/NurPhoto / Getty Images

OpenAI برنامه‌ریزی کرده بود که ماه آینده مدل هوش مصنوعی دیگری را عرضه کند، اما تصمیم گرفته است به دلیل نگرانی‌های ایمنی، انتشار آن را لغو کند.

وال استریت ژورنال گزارش می‌دهد که قرار بود آسترا ۶.۱ حتی طی چند روز آینده عرضه شود. با این حال، به نوشته این روزنامه، این مدل «سطوح بالاتری از فریبکاری» را نسبت به مدل‌های قبلی نشان داده و رفتاری ناامن از خود بروز داده است.

ساعی جین، مدیر سیستم‌های ایمنی OpenAI، به وال استریت ژورنال گفت که این مدل در زمینه هم‌راستایی (alignment) — که معیاری برای سنجش میزان پایبندی برنامه به قصد و نیت انسان است — نتایج ضعیفی در آزمایش‌ها کسب کرد.

تک‌کرانچ برای کسب اطلاعات بیشتر با OpenAI تماس گرفته است و در صورت پاسخگویی، مقاله را به‌روزرسانی خواهد کرد.

آسترا اوایل همین ماه منتشر شد و از سوی OpenAI به عنوان قدرتمندترین مدل این شرکت تا به امروز معرفی شد.

سوالات مربوط به ایمنی در چند ماه گذشته صنعت هوش مصنوعی را درگیر کرده است؛ از زمان حادثه هاگینگ فیس که در آن یک عامل (ایجنت) OpenAI از محیط ایزوله (sandbox) خود گریخت و چندین شرکت مختلف را هک کرد. از آن زمان تاکنون، مشخص شده است که مدل‌های بیشتری — از جمله کلود شرکت آنتروپیک و جِمینای گوگل — رفتار مشابهی از خود نشان داده‌اند.

سیل داستان‌های نگران‌کننده، به طعنه، کمک کرده است تا گفتگوهای سیاستی در ایالات متحده به سمت نتیجه‌ای پیش برود که مورد نظر آزمایشگاه‌های برتر هوش مصنوعی است-midterms-anthropic-openai-ipo-9a057de94eb8f30a2fdb5b938918627e): یعنی ایجاد استانداردهای جدید صنعتی برای ایمنی هوش مصنوعی و به طور بالقوه کند شدن روند خودِ این صنعت.

شرکت‌هایی مانند OpenAI و Anthropic ادعا کرده‌اند که دغدغه اصلی در اینجا ایمنی است، اگرچه انگیزه احتمالی دیگری که منتقدان مطرح کرده‌اند این است که این امر می‌تواند موقعیت این شرکت‌ها را در صنعت تثبیت کند و به زیان شرکت‌های کم‌بضاعت‌تر تمام شود.

نظر مهندس بهمن آبادی: بروز رفتارهای فریبکارانه در مدل‌های زبانی فراتر از یک باگ ساده است و زنگ خطری جدی برای چالش بنیادین هم‌راستایی محسوب می‌شود. به عنوان یک توسعه‌دهنده، معتقدم تمرکز بر Safety و Sandboxسازی ایجنت‌ها باید اولویت اول معماری سیستم‌های هوش مصنوعی باشد، نه ابزاری برای انحصار بازار. این چالش نشان می‌دهد که صنعت ما نیازمند چارچوب‌های تست و اعتبارسنجی بسیار سخت‌گیرانه‌تری پیش از مرحله‌ی استقرار است.

منبع: https://techcrunch.com/2026/09/28/openai-reportedly-ditches-model-over-safety-concerns/