گوگل از مدل هوش مصنوعی جدید خود با نام Gemini 4 Argon رونمایی کرد؛ مدلی پیشرفته که برای استدلال عمیق در فرایندهای پیچیده و طولانی طراحی شده و در حوزههایی مانند مهندسی نرمافزار، فعالیتهای سازمانی در حوزه حقوق و مالی و دفاع سایبری عملکرد پیشرفتهای ارائه میدهد. این مدل بهدلیل قابلیتهای پیشرفته خود فعلاً با برنامه Fairwind در اختیار گروهی از مدافعان سایبری مورداعتماد قرار میگیرد.
گوگل میگوید عرضه قابلیتهایی در این سطح نیازمند رویکردی مرحلهای است. این شرکت در فرایند داوطلبانه دولت آمریکا برای اجازه دسترسی پیش از عرضه به مدلها مشارکت دارد و همزمان اجازه دسترسی به Argon را بهتدریج گسترش میدهد. گوگل نیز پیش از عرضه عمومی مدل، نظر آزمایشکنندگان اولیه را برای بهبود سازوکارهای ایمنی آن جمعآوری خواهد کرد.
جمینای ۴ آرگون در زمان عرضه با قیمت اولیه ۲ دلار بهازای هر یک میلیون توکن لاگینی و ۱۰ دلار بهازای هر یک میلیون توکن لاگآوتی عرضه میشود. قیمت توکنهای لاگینی ثبتشده نیز ۹۵ درصد کمتر از قیمت عادی توکن لاگینی است.
جمینای ۴ آرگون در فرایندهای داخلی گوگل
گوگل میگوید Gemini 4 Argon پیشتر در فرایندهای داخلی این شرکت به کار گرفته شده و هزاران کارمند از عملکرد آن در وظایف تخصصی برنامهنویسی، تحقیقات عمیقتر و نگارش باکیفیت متون استفاده کردهاند. به گفته گوگل، این مدل به تیمها کمک کرده سریعتر توسعه دهند و بهرهوری مهندسی را افزایش دهند.
در یکی از نمونهها، آرگون به پژوهشگران رایانش کوانتومی برای بهینهسازی منابع زمانی و مکانی که گلوگاه برخی یوزردهای مهم هستند، کمک کرده است. گوگل میگوید این مدل در یک نمونه طی چند دقیقه عملکردی ۴۰ درصد بهتر از معیار منتشرشده ثبت کرده است.
گروهی از عاملهای Argon نیز دادههای مربوط به عملکرد مراکز داده گوگل را تحلیل و بهصورت خودکار بهینهسازیهای حافظه را شناسایی و اعمال کردهاند. اجرای این تغییرات بیش از ۳۰۰ ترابایت حافظه را آزاد کرده و گوگل میزان صرفهجویی نهایی را بین ۵۰۰ ترابایت تا یک پتابایت برآورد میکند.
ایجنتهای جمینای ۴ آرگون نیز در پروژه انتقال کد برنامههای C و ++C به Rust در بخشهای مختلف گوگل فعالیت دارند. این پروژه از دهها هزار خط کد برنامه در لایبرریهایی مانند re2 و libgav1 تا بیش از ۸۰۰ هزار خط در هسته Zircon سیستمعامل Fuchsia را شامل میشود.
در پروژه libgav1، عاملهای آرگون با اجرای چندین مرحله آزمایش مبتنی بر حساب یوزری، ۳۲ هزار خط کد برنامه SIMD را جایگزین کردند. نتیجه، یک رمزگشای ویدیوی ایمن از نظر حافظه است که بدون تغییر لاگآوتی ویدیو، ۲.۷ برابر سریعتر از ورژن Rust قبلی اجرا میشود و به عملکرد ورژن بهینهشده ++C نزدیکتر است.
سقف یک میلیون توکن برای استدلال طولانیتر
گوگل برای کمک از قابلیتهای مدل Argon در یوزردهای طولانی و پیچیده، سقف توکن لاگآوتی مدل را از ۶۴ هزار به یک میلیون توکن افزایش داده است. این ظرفیت به مدل اجازه میدهد در یک فرایند واحد صدها هزار توکن تولید کند و برای حل مسائل دشوار، استدلال عمیقتری داشته باشد.
عملکرد Gemini 4 Argon در برنامهنویسی و فعالیتهای سازمانی
قابلیتهای Argon در برنامهنویسی، استدلال و پردازش چندوجهی، در کنار توانایی اجرای وظایف طولانی و چندمرحلهای، آن را برای طیف گستردهای از فرایندهای سازمانی مناسب کرده است. مهندسان گوگل از این مدل برای کارهایی مانند اشکالزدایی، مهاجرت کد برنامهبیسهای بزرگ و طراحی الگوریتم استفاده میکنند.
جمینای ۴ آرگون در معیار DeepSWE v1.1 که عملکرد مدلها را در وظایف واقعی و طولانیمدت مهندسی نرمافزار ارزیابی میکند، به امتیاز ۷۷.۹ درصد رسیده است. گوگل نیز میگوید این مدل در شاخص Vals برای سنجش اثر اقتصادی در حوزههای مالی، برنامهنویسی، حقوقی و مالیاتی، عملکرد پیشرو دارد.

آرگون در ارزیابیهایی مانند Vals Finance Agent v2 و Harvey’s Legal Agent Benchmark نیز عملکرد پیشرو داشته است. در AutomationBench، معیار Zapier برای سنجش اجرای سرتاسری وظایف اصلی کسبوکار، این مدل با امتیاز ۵۱.۳ درصد در رتبه اول قرار گرفته است.
مدل جدید گوگل در وظایف دانشمحور مبتنی بر درک بصری نیز عملکرد بالایی دارد و میتواند نمودارهای حرفهای را تحلیل، جزئیات را از ویدیوهای طولانی استخراج و براساس مجموعهای از اسناد اقدام کند. Argon در معیار LVBench برای سنجش درک ویدیوهای طولانی، امتیاز ۹۱.۷ درصد به دست آورده است.
تمرکز ویژه بر دفاع سایبری
گوگل Gemini 4 Argon را برای دفاع سایبری نیز آموزش داده است. این مدل میتواند بهصورت خودکار آسیبپذیریهای حیاتی نرمافزاری را پیدا، اعتبارسنجی و برطرف کند. گوگل اعلام کرده است آرگون را برای مدافعان مورداعتماد و تیمهای داخلی خود بدون محدودیتهای سایبری عرضه میکند تا بتوانند از قابلیتهای کامل آن در دفاع سایبری استفاده کنند.

Argon در معیار CWE-bench v1 برای سنجش توانایی مدل در برطرفکردن آسیبپذیریهای ایمنیی، با امتیاز ۶۸ درصد همراه با GPT-6 Astra و گراک ۴.۷ مشترکاً در رتبه نخست قرار گرفته است. گوگل میگوید این عملکرد ادامه دادن پیشرفت ۳٫۸ Flash Cyber در ورژن قبلی این معیار، یعنی CWE-bench v0، محسوب میشود.
جمینای ۴ آرگون نیز در کشف آسیبپذیریها نسبت به ۳٫۸ Flash Cyber پیشرفت کرده است. در معیار جامع داخلی گوگل، این مدل طیف گستردهای از آسیبپذیریها را در کد برنامهبیسهای پیچیده و در ۲۰ زبان برنامهنویسی شناسایی کرد. در معیار آزمایش نفوذ جعبهسیاه داخلی Wiz نیز Argon در شناسایی سطح حمله، آسیبپذیریها و تولید شواهد اثبات مفهوم عملکرد بهتری نسبت به ۳٫۸ Flash Cyber داشت.

گوگل پیش از عرضه عمومی سازوکارهای ایمنی جمینای ۴ را تقویت میکند
گوگل پیش از عرضه گسترده Gemini 4 Argon، روی تقویت سازوکارهای ایمنی این مدل در چهار حوزه تمرکز کرده است.
برای مقابله با سوءاستفاده، Argon طوری طراحی شده که درخواستهای آسیبزا برای استفاده در حملات سایبری یا حملات شیمیایی، زیستی، رادیولوژیکی و هستهای (CBRN) را رد کند و در عین حال امکان انجام پژوهشهای علمی مشروع و دویوزردی را حفظ کند.
Argon نیز به گفته گوگل مقاومترین مدل این شرکت در برابر حملات تزریق غیرمستقیم پرامپت است؛ حملاتی که در آن دستورها یا زمینههای مخرب برای تغییر رفتار مدل استفاده میشوند. گوگل با استفاده از تیم قرمز خودکار و آموزش خصمانه، مقاومت Argon را در معیار Gray Swan برای سنجش تزریق غیرمستقیم پرامپت بهبود داده است.

گوگل برای جلوگیری از لاگآوت جمینای ۴ آرگون از محدوده تعیینشده و انجام وظایفی فراتر از قصد یوزر نیز سازوکارهایی برای نظارت بر زنجیره استدلال و اقدامات مدل مستقر کرده است. این سازوکارها در صورت لزوم اجرای مدل را متوقف میکنند.
گوگل میگوید از سامانهای مشابه برای نظارت بر فرایندهای آموزشی خود و فرستادن هشدار به تیم واکنش به حوادث استفاده کرده است. این شرکت برای جلوگیری از تغییر رفتار Argon با هدف دور زدن نظارت، یافتههای حاصل از این فرایند را به آموزش مدل بازنگردانده است.
نیز با افزایش قابلیت مدلهای پیشرفته، گوگل محیطهای ایزوله خود را برای آموزشها و ارزیابیهای پرخطر تقویت میکند. این شرکت قصد دارد بهترین روشهای حفظ ایمنی ایجنتها را با شرکای خود به اشتراک بگذارد.
عرضه Gemini 4 Argon در آینده نزدیک
گوگل جمینای ۴ آرگون را با قابلیتهای پیشرفته در برنامهنویسی، فعالیتهای مبتنی بر دانش، دفاع سایبری و نگارش خلاقانه توسعه داده است. این مدل ابتدا برای مشتریان پولی رابط برنامهنویسی و مشترکان Google AI Ultra عرضه خواهد شد و سپس در اختیار توسعهدهندگان، سازمانها و یوزران عادی قرار میگیرد. هنوز تاریخ دقیقی برای عرضه این مدل قدرتمند اعلام نشده است.












