گوگل از مدل هوش مصنوعی Gemini 4 Argon رونمایی کرد، اما فعلاً نمیتوانید از آن استفاده کنید
دیگر خبری از Gemini 3.5 Pro نخواهد بود.
گوگل وعده داده بود Gemini 3.5 Pro را در ماه ژوئن عرضه کند، اما تابستان را صرف معرفی مدلهای کوچکتر Flash کرد. اکنون گوگل آماده است تا با Gemini 4 Argon بار دیگر وارد عرصه رقابت پیشرفته شود. این شرکت ادعا میکند که این هوش مصنوعی جدید عملکردی پیشرو در صنعت در زمینههای برنامهنویسی، کارهای دانشمحور و امنیت سایبری ارائه میدهد، اما هنوز اجازه استفاده از آن را ندارید.
در حالی که بیشتر ما باید برای آزمایش Gemini 4 صبر کنیم، گوگل میگوید مهندسان داخل این شرکت در حال حاضر به طور گسترده از مدل جدید استفاده میکنند. طبق گزارشها، مدل Argon از «دادههای تلهمتری کل ناوگان» برای کمک به گوگل جهت صرفهجویی ۳۰۰ ترابایتی حافظه در سراسر مراکز داده خود استفاده کرده است. در همین حال، ایجنتهای Argon روی انتقال کدهای C/C++ به Rust در سراسر گوگل کار کردهاند؛ از جمله هزاران خط کد در کتابخانههای اصلی re2 و libgav1 و بیش از ۸۰۰ هزار خط کد در هسته Fuchsia OS Zircon.
گوگل همچنین با انبوهی از بنچمارکها برای اثبات ادعاهای خود وارد میدان شده است. در بنچمارک مهندسی نرمافزار DeepSWE v1.1، مدل Gemini 4 Argon به امتیاز ۷۷.۹ درصد دست یافت که بالاتر از GPT-6 Astra، Fable 5.1 و Opus 5.5 است. گوگل با اشاره به امتیاز پیشرو در صنعت Argon در آزمون تحلیل اقتصادی Vals Index، قدرت مشابهی را در طیف وسیعی از وظایف بلندمدت وعده میدهد.
این مدل همچنان در مرحله آزمایش محدود قرار دارد، اما گوگل قیمتگذاری API آن را اعلام کرده است. برای مدتزمانی محدود، Argon نرخهایی معادل ۲ دلار به ازای هر میلیون توکن ورودی و ۱۰ دلار به ازای هر میلیون توکن خروجی ارائه خواهد داد و توکنهای ورودی کَششده با تخفیف ۹۵ درصدی عرضه میشوند. این شرکت همچنین تأیید کرده است که Gemini 4 Argon از محدودیت خروجی بسیار بیشترِ ۱ میلیون توکن پشتیبانی خواهد کرد. این میزان در مقایسه با ۶۴,۰۰۰ توکن در مدلهای قبلی جمنای افزایش یافته است. گوگل میگوید این امر به کاربران اجازه میدهد وظایف دشوارتر را در یک مرحله انجام دهند.
تمرکز اصلی Gemini 4 در حال حاضر بر روی دفاع سایبری است. گوگل میگوید مدلهایی در این مقیاس نیازمند انتشار مرحلهای هستند، بنابراین کار را با گروه کوچکی از آزمایشکنندگان مورد اعتماد آغاز میکند. شرکای برنامه Fairwind این شرکت میتوانند برای بهرهبرداری از قابلیتهای دفاع سایبری این مدل دسترسی داشته باشند. ظاهراً شرکت Wiz در حال حاضر از Argon استفاده میکند و از آن برای کشف یک آسیبپذیری بحرانی بهره برده است که میتوانست اطلاعات شخصی را در یک سیستم مورداستفاده در بیمارستانهای سراسر جهان در معرض خطر قرار دهد. گوگل ادعا میکند که سایر مدلهای پیشرفته متوجه این نقص نشدهاند، اما جزئیات بیشتری ارائه نکرد.
پس از چندین رویداد هک پرحاشیه در طول تابستان، نگرانیهای زیادی درباره عدم همراستایی مدلها (Model Misalignment) وجود دارد. گوگل ادعا میکند که Argon را با سیستمهایی طراحی کرده است که روند استدلال (Chain-of-thought) مدل را زیر نظر دارند و در صورت خروج مدل از چارچوبهای تعیینشده، میتوانند آن را متوقف کنند. گوگل میگوید به همین دلیل است که شفافیت در استدلال در توسعه مدلهای پیشرفته اهمیت دارد.
مدل Gemini 4 Argon در نهایت برای مشتریان سازمانی و مصرفکنندگان عادی در دسترس قرار خواهد گرفت، اما گوگل هیچ وعده زمانی دقیقی ارائه ندهد. با این حال، میدانیم که پس از اتمام آزمایشهای امنیت سایبری، دسترسی عمومی با کاربران پولی API و مشترکان گوگل AI Ultra آغاز خواهد شد.
نظر مهندس بهمن آبادی: پرش گوگل به سمت مدلهای مجهز به زنجیره استدلال نظارتشده و ظرفیت خروجی یک میلیون توکن، نشان میدهد که آینده ابزارهای توسعه، حل مسائل بزرگ در یک کانتکست واحد و اتوماسیون مهاجرت کدهای قدیمی (مثل C به Rust) است. به عنوان یک مدرس و برنامهنویس، معتقدم تمرکز بر این مدلها یعنی باید بهزودی مهارت پرامپتنویسی ساختاری و معماری سیستمهای متصل به ایجنتها را جایگزین کدنویسی خطبهخط کنیم. با وجود قیمتگذاری رقابتی API، چالش اصلی ما نه دسترسی به هوش مصنوعی، بلکه یادگیری نحوه مدیریت خروجیهای حجیم و امنسازی کدهای تولیدشده توسط آنها خواهد بود.