חזרה לכל המאמרים
    Gemini 4 Argon: מודל AI חדש, אבל מי מקבל גישה?
    AI SecurityAI SafetyGeminiGoogleAI Agents

    Gemini 4 Argon: מודל AI חדש, אבל מי מקבל גישה?

    Y

    Yoni Fraimorice

    שיתוף:

    ל-Google יש מודל חזית חדש. זה לא אומר שאפשר לבנות איתו מוצר כבר היום.

    ב-30 בספטמבר Google הכריזה על Gemini 4 Argon, עם טענות מרשימות על כתיבת קוד, מחקר והגנת סייבר. אבל המשתמשים הראשונים הם קבוצה נבחרת של צוותי הגנת סייבר מהימנים, לא כל מי שמחזיק מפתח API.

    זה הפרט הכי שימושי בהשקה. מודל יכול לעשות עבודה מרשימה בתוך Google ועדיין לא להיות מוצר שהצוות שלכם יכול להשתמש בו. יכולת, גישה ובטיחות הן שאלות נפרדות. ההשקה של Argon מבהירה את הפער הזה.

    מי מקבל גישה ראשון?

    נכון ל-1 באוקטובר, מסלול הגישה הראשון שעליו הוכרז הוא תוכנית Fairwind של Google. החברה הציגה אותה עבור לקוחות Google Cloud מהימנים, גופי ממשל ושותפי אבטחת סייבר.

    זו לא גרסת תצוגה מקדימה לכלל המפתחים. לפי התוכנית, ארגונים רשאים לתת גישה ל-Argon רק לצוותים פנימיים של אבטחת סייבר, תגובה לתקריות או בדיקות חדירה. הם חייבים לעקוב אחר הגישה והשימוש של העובדים, ולהפעיל בקרות שכוללות אימות רב-שלבי עמיד בפני דיוג.

    בהשקה הרחבה יותר, Google מציינת לקוחות API משלמים ומנויי Google AI Ultra כקבוצות הראשונות. בהכרזה אין תאריך קבוע להשקה הציבורית. לכן, חשבון בתשלום אינו הבטחה לגישה ל-Argon כבר היום.

    יש גם פרט חשוב לגבי המודל שאנשי ההגנה יקבלו: Google אומרת שתשחרר את Argon ללא מגבלות ההגנה בתחום הסייבר לצוותי הגנה מהימנים ולצוותים הפנימיים שלה.

    זה לא אומר שאין בקרות בכלל. Fairwind מגבילה מי רשאי להשתמש במודל ואיך מנהלים את הגישה. ההבדל חשוב: הגבלה על זהות המשתמשים היא אמצעי הגנה שונה מהגבלה על מה שהמודל יסכים לעשות.

    תוצאות חזקות אינן תוכנית השקה

    Google מדווחת על ציון של 77.9% ב-DeepSWE v1.1, מבחן למשימות הנדסת תוכנה ארוכות. היא מתארת גם עבודה פנימית על שימוש בזיכרון, אלגוריתמים קוונטיים והעברת קוד מ-C/C++ ל-Rust.

    אלה תוצאות ש-Google מדווחת עליהן, לא ראיה שאותם שיפורים יופיעו בקוד שלכם. אפילו Google אומרת ששכתובי הקוד הגדולים שלה עוברים בדיקות אוטומטיות, סקירה אנושית ובדיקות נוספות לפני מעבר לייצור.

    התמחור נשמע ברור: מחיר היכרות של 2 דולר למיליון טוקני קלט ו-10 דולר למיליון טוקני פלט. הערת שוליים אומרת שהמחירים יעלו בהמשך ל-4 ול-20 דולר. ההכרזה לא קובעת מועד לשינוי.

    Google גם מעלה את מגבלת הפלט למיליון טוקנים. זו מגבלת פלט, לא טענה שכל בקשה תשתמש בכולה. יותר מקום למשימה ארוכה יכול לעזור, אבל הוא גם מחייב מפתחים לקבוע מגבלות הוצאה ונקודה ברורה שבה עוצרים.

    מחיר ומגבלת טוקנים גדולה לא עונים על השאלה אם הארגון שלכם זכאי לגישה, מתי תוכלו להפעיל את המודל, או באיזו אמינות תהליך העבודה שלכם ירוץ.

    מה Google אומרת על בטיחות

    ההכרזה מתארת ארבעה תחומי עבודה לפני פתיחת הגישה הרחבה:

    תחוםהגישה ש-Google מציגה
    שימוש לרעהסירוב לבקשות מזיקות ושיפור הניטור של הפעילות הפנימית במודל
    הזרקת הנחיותאימון ובדיקות נגד הוראות זדוניות שמוסתרות בתוכן חיצוני
    פעולות שחורגות מכוונת המשתמשניטור החשיבה והפעולות, ועצירת הריצה כשצריך
    סביבות מאובטחותבידוד ואטימה של סביבות בדיקה לפני אימונים או הערכות בסיכון גבוה

    Google אומרת שצוותי בדיקה התקפיים פנימיים וחיצוניים בדקו את אמצעי ההגנה שלה. היא גם מכנה את Argon המודל העמיד ביותר שלה עד כה בפני הזרקת הנחיות עקיפה, ומפנה למבחן של Gray Swan. אלה טענות בטיחות שמיוחסות לחברה, לא ממצאים שלי מבדיקת Argon.

    החברה משתתפת גם בתהליך הוולונטרי של ממשלת ארה״ב למתן גישה למודלים לפני השקה. השתתפות אינה תוצאת מעבר שפורסמה. ההכרזה לא מציגה הערכת בטיחות ממשלתית שהושלמה.

    השאלה הקשה היא אם הבקרות האלה מחזיקות כשסוכן נתקל במצב לא צפוי. ניטור שיכול לעצור ריצה הוא כלי שימושי, אבל עדיין צריך לדעת מה הוא מפספס, באיזו תדירות הוא עוצר עבודה תקינה, ואיזו תצורה נבדקה.

    יש ראיות חיצוניות, אבל חשוב לקרוא מה הן בודקות

    לא יהיה נכון לומר שאין ראיות מעבר לבלוג של Google.

    טבלת התוצאות של CWE-bench v1 מציגה את Argon עם 68% במדד pass@1 לפי בדיקות אוטומטיות, בשוויון עם GPT-6 Astra ו-Grok 4.7. ‏Argon פועל שם בתוך Antigravity: סביבת ההפעלה שמספקת כלים ומנהלת את עבודת הסוכן.

    זו ראיה חיצונית שימושית ליכולת מסוימת. המבחן נותן לסוכנים מאגרי קוד לבדיקה ולתיקון. הבדיקות האוטומטיות שלו דורשות שהחולשה תיחסם ושהבדיקות הקיימות עדיין יעברו. הוא לא מאשר שהסוכן יתנגד לשימוש לרעה או יישאר בתוך ההרשאות שלו בסביבה אחרת.

    באותה מידה, עיתונות עצמאית אינה ביקורת עצמאית של המודל. הדיווח של CNBC תומך בסיפור על הגישה המוגבלת וכולל דברים של מובילת מוצר המודלים ב-Google. הוא לא מציג הערכת בטיחות התקפית ש-CNBC ביצעה בעצמה.

    עוד פרט שקל לפספס: Google מתארת שימוש של Wiz ב-Argon למציאת חולשה חמורה בתוכנה בתחום הבריאות. זו עשויה להיות עבודה מעשית חשובה, אבל Wiz אינה בודקת חיצונית עצמאית: Google השלימה את רכישתה במרץ.

    לכן יש כאן סוגים שונים של ראיות, לא היעדר ראיות: מבחן יכולת חיצוני, שימושים שהחברה מדווחת עליהם ותיאורים שלה לגבי עבודת הבטיחות. אסור שאחד מהם יהפוך בלי הסבר לאישור בטיחות גורף.

    מה מפתחים יכולים לעשות בזמן ההמתנה

    דמיינו צוות קטן שרוצה ש-Argon יבדוק את האפליקציה שלו בכל לילה ויציע תיקונים עד הבוקר. זה תהליך עבודה עתידי אפשרי, לא משהו שההכרזה הופכת לזמין לכל צוות.

    אני הייתי מכין את התהליך בלי לבנות תוכנית עבודה שתלויה ב-Argon:

    1. לוודא זכאות. שאלו אם הצוות והשימוש שלכם מתאימים ל-Fairwind. אל תניחו שגישה רגילה ל-API מספיקה.
    2. להגדיר ניסיון מצומצם. השתמשו בעותק מבודד של מאגר קוד מאושר, בלי פרטי גישה למערכות ייצור. דרשו סקירה לפני מיזוג כל שינוי.
    3. למדוד תוצאות שימושיות. עקבו אחר תיקונים תקינים, בדיקות שנשברו, זמן סקירה, ריצות שנכשלו ועלות כוללת, כולל ניסיונות חוזרים.
    4. לבקש את ראיות הבטיחות הנכונות. בקשו את גרסת המודל, אמצעי ההגנה הפעילים, תנאי הבדיקה, שיעורי הכשל וממצאי הבודקים החיצוניים.

    אלה המלצות הפריסה שלי, לא תיאור של הדרישות של Google. הן שימושיות גם עם כל מודל שכבר זמין לכם היום.

    השקה מוגבלת היא החלטה, לא פסק דין

    להתחלה עם צוותי הגנת סייבר יש מטרה סבירה: לעזור לאנשים לתקן תוכנה לפני שתוקפים מנצלים אותה. גישה מצומצמת יכולה גם לתת ל-Google משוב לפני שהיא משרתת מגוון רחב בהרבה של משתמשים.

    אבל היא מגבילה גם את מי שיכול לשחזר את התוצאות שבכותרות. מפתחים מחוץ לקבוצה הזאת עדיין לא יכולים לבחון את Argon בתנאים שלהם.

    התגובה הנכונה אינה ״Google הוכיחה שהוא בטוח״ וגם לא ״גישה מוגבלת מוכיחה שהוא מסוכן״. ל-Argon יש ראיות מבטיחות ליכולת. גישה רחבה ותשתית ראיות ציבורית ברורה לגבי הבטיחות הן אבני דרך אחרות.

    עד שהן יגיעו, התייחסו להכרזה כאל מודל שכדאי לעקוב אחריו, לא כאל רכיב שאפשר להבטיח ללקוחות.

    מקורות

    תמונת פתיחה: מרכז הנתונים של Google בדה דאלס, אורגון, צילום של Tony Webster, ברישיון CC BY 2.0. התמונה הוקטנה ונחתכה לגודל 1920 × 1080 פיקסלים ונשמרה מקומית. זהו צילום ארכיון מ-2015 שממחיש את התשתית של Google, ולא מזהה היכן Argon פועל.

    שיתוף: