1

در حالی که OpenAI و Anthropic به‌طور منظم مدل‌های پیشرفته در سطح مرزی را عرضه می‌کنند، گوگل از زمانی که مدل‌های سری Gemini 3 نتوانستند نتایجی را که شرکت انتظار داشت ارائه دهند، نسبتاً کم‌سروصدا بوده است. امروز گوگل از Gemini 4 Argon، جدیدترین مدل هوش مصنوعی پیشرفته خود، رونمایی کرد که برای انجام وظایف پیچیده و طولانی‌مدت در حوزه توسعه نرم‌افزار، کارهای دانشی سازمانی و امنیت سایبری طراحی شده است. متأسفانه برای دسترسی گسترده‌تر باید منتظر ماند.

گوگل در ابتدا Argon را از طریق برنامه Fairwind در اختیار گروهی منتخب از مدافعان امنیت سایبری قرار می‌دهد تا آزمایش‌های ایمنی بیشتری را تکمیل کند. یکی از بزرگ‌ترین تغییرات Gemini 4 Argon، سقف خروجی آن است. گوگل حداکثر خروجی را از 64,000 توکن به 1 میلیون توکن افزایش داده است. گوگل اعلام کرده این تغییر فضای کافی در اختیار مدل قرار می‌دهد تا مسیرهای استدلالی بسیار طولانی‌تری را طی کند و وظایف پیچیده را بدون نیاز به تقسیم آن‌ها به چند اجرای جداگانه به پایان برساند.

Gemini 4 Argon در آزمون DeepSWE v1.1 که وظایف مهندسی نرم‌افزار بلندمدت را ارزیابی می‌کند، امتیاز 77.9 درصد را به دست آورده است. این مدل همچنین در AutomationBench شرکت Zapier امتیاز 51.3 درصد و در LVBench برای درک ویدیوهای طولانی امتیاز 91.7 درصد کسب کرده است. گوگل می‌گوید Argon در Vals Index نیز پیشتاز است؛ شاخصی که عملکرد هوش مصنوعی را در کارهای اقتصادی مهم، از جمله وظایف حوزه مالی، حقوقی، مالیاتی و توسعه نرم‌افزار ارزیابی می‌کند.

در مجموع، Gemini 4 Argon در چندین معیار کلیدی هوش مصنوعی عملکرد بهتری از GPT-6 Astra شرکت OpenAI و Claude Opus 5.5 شرکت Anthropic داشته است. مقایسه معیارهای عملکرد را می‌توانید در ادامه مشاهده کنید. گوگل ادعا می‌کند که در حال حاضر به‌طور گسترده از Argon در داخل شرکت استفاده می‌کند. بنا بر گزارش‌ها، هزاران کارمند این شرکت در حال آزمایش آن برای کدنویسی، پژوهش و نگارش بوده‌اند.

این شرکت چندین نمونه از جمله بهینه‌سازی الگوریتم‌های کوانتومی، بهینه‌سازی حافظه مراکز داده و مهاجرت‌های گسترده کد از C و C++ به Rust را نیز برجسته کرده است. Google تأکید کرده است که Argon در کاربردهای امنیت سایبری نیز عملکرد بهتری دارد، زیرا این مدل می‌تواند آسیب‌پذیری‌های نرم‌افزاری را به‌صورت خودکار شناسایی، اعتبارسنجی و برطرف کند. تیم Wiz خود Google نیز از طریق برنامه Scan for Good در حال استفاده از Argon است.

در آزمون CWE-bench v1 که توانایی یک مدل برای برطرف کردن آسیب‌پذیری‌های نرم‌افزاری را اندازه‌گیری می‌کند، Argon امتیاز 68 درصد را به دست آورده و در جایگاه نخست مشترک قرار گرفته است. گوگل برای رقابت بهتر با OpenAI و Anthropic، قیمت‌گذاری نسبتاً تهاجمی را در پیش گرفته است. Gemini 4 Argon در ابتدا با قیمت 2 دلار به‌ازای هر 1 میلیون توکن ورودی و 10 دلار به‌ازای هر 1 میلیون توکن خروجی عرضه خواهد شد و برای توکن‌های ورودی ذخیره‌شده نیز 95 درصد تخفیف در نظر گرفته می‌شود.

پس از پایان دوره معرفی، قیمت‌ها دو برابر خواهند شد و به 4 دلار به‌ازای هر 1 میلیون توکن ورودی و 20 دلار به‌ازای هر 1 میلیون توکن خروجی خواهند رسید. گوگل می‌گوید عرضه گسترده‌تر ابتدا با مشتریان پولی API و مشترکان Google AI Ultra آغاز خواهد شد و پس از آن، دسترسی برای توسعه‌دهندگان، سازمان‌ها و مصرف‌کنندگان گسترده‌تر خواهد شد.