جمنای ۳.۸ گوگل؛ انقلاب در کدنویسی و دفاع سایبری

گوگل در تازه‌ترین به‌روزرسانی خانواده هوش مصنوعی خود، دو مدل جدید جمنای ۳.۸ فلش (Gemini 3.8 Flash) و جمنای ۳.۸ فلش سایبر (Gemini 3.8 Flash Cyber) را به‌صورت رسمی معرفی کرد. این انتشار که سومین نسخه فلش در بازه شش‌هفته‌ای اخیر محسوب می‌شود، با حفظ همان سطح قیمت نسل پیشین، جهش چشمگیری در توانمندی‌های استدلالی، برنامه‌نویسی و امنیت سایبری به ارمغان آورده است.

فلش ۳.۸؛ سریع‌تر فکر می‌کند، ارزان‌تر کار می‌کند

مدل ۳.۸ فلش با هدف اجرای پروژه‌های طولانی‌مدت کدنویسی و عامل‌های هوشمند خودمختار طراحی شده است. به ادعای گوگل، این مدل در آزمون‌های تخصصی نظیر DeepSWE v1.1 از بسیاری از مدل‌های بزرگ‌تر و گران‌تر پیشی گرفته و در بنچمارک‌های مالی و حقوقی (Vals Finance Agent V2 و Harvey’s Legal Agent Benchmark) نیز رکوردهای نسل ۳.۷ را شکسته است. نمره ۵۴.۹ درصدی در آزمون HLE-Verified، نشان‌دهنده تسلط این مدل بر استدلال چندمرحله‌ای در حوزه‌های علوم پایه، انسانی و حرفه‌ای است.

جمنای ۳.۸

نکته جالب در معماری این مدل، رویکرد «تلاش بیشتر» است؛ به این معنا که در مواجهه با مسائل پیچیده، گام‌های منطقی بیشتری طی می‌کند و ابزارها را به‌صورت مکرر فراخوانی می‌نماید. البته برای تیم‌هایی که اولویتشان صرفه‌جویی در مصرف توکن است، همچنان امکان استفاده از سطوح پایین‌تر پردازش و حتی مدل ۳.۷ فلش فراهم باقی مانده است.

تعرفه استفاده: هر یک میلیون توکن ورودی ۰.۷۵ دلار و هر یک میلیون توکن خروجی ۳.۷۵ دلار؛ دقیقاً هم‌تراز با نسل قبلی.

فلش سایبر؛ سپر هوشمند دفاع سایبری

نسخه تخصصی سایبر، با رویکردی کاملاً تدافعی و از مسیر برنامه Fairwind گوگل عرضه شده است. این مدل در بنچمارک CyberGym برای شناسایی آسیب‌پذیری‌ها، از نسل ۳.۵ فلش سایبر و حتی مدل‌های مرزی بزرگ‌تر عملکرد بهتری ثبت کرده و در ارزیابی داخلی روی ۲۰ زبان برنامه‌نویسی، نرخ موفقیتی بالاتر از ۷۰ درصد به دست آورده است.

جمنای ۳.۸

در حوزه وصله‌نویسی خودکار (CWE-Bench)، فلش سایبر با نمره ۴۷.۲ درصد در آزمون pass@1، فاصله‌ای ناچیز با بهترین مدل موجود (۴۷.۸ درصد) دارد؛ اما با هزینه‌ای به‌مراتب کمتر.

تأثیر عملی بر امنیت محصولات گوگل

گوگل هم‌اکنون از فلش سایبر برای ایمن‌سازی زیرساخت‌های داخلی خود بهره می‌برد و نتایج قابل‌توجهی به دست آمده است:

  • مرورگر کروم: تولید ۲.۶ برابر وصله صحیح بیشتر نسبت به قوی‌ترین مدل‌های تجاری موجود.
  • پلتفرم Wiz: افزایش ۷.۵ تا ۹.۷ درصدی نرخ یادآوری در تست نفوذ، هم‌زمان با کاهش ۲.۳ تا ۵.۲ برابری هزینه.
  • تیم تحقیقات آسیب‌پذیری ابری: کشف یک حفره امنیتی بنیادین در کمتر از ۲ ساعت؛ فرآیندی که به‌طور معمول ماه‌ها زمان می‌برد.

جمنای ۳.۸

همچنین مدل‌های جمنای ۳.۸ در برابر حملات تزریق پرامپت (Prompt Injection) مقاوم‌تر شده‌اند و بر اساس ارزیابی Gray Swan، محافظت بهتری از کاربران در برابر فرمان‌های مخرب ارائه می‌دهند.

مسیر دسترسی توسعه‌دهندگان و سازمان‌ها

مدل ۳.۸ فلش از طریق Google Antigravity، Gemini API در AI Studio و Android Studio و همچنین ابزار طراحی رابط Stitch در دسترس توسعه‌دهندگان قرار گرفته است. سازمان‌ها می‌توانند از طریق Gemini Enterprise و کاربران عادی از طریق اپلیکیشن جمنای، حالت AI Mode در جست‌وجو و Gemini in Google Sheets به این مدل دسترسی داشته باشند.

جمنای ۳.۸

دسترسی به نسخه سایبر اما محدودتر است و صرفاً به نهادهای دولتی مورد اعتماد، زیرساخت‌های حیاتی و نگه‌دارندگان نرم‌افزار از طریق برنامه Fairwind ارائه می‌شود.