חזרה לכל המאמרים
    אמודיי בשולחן של טראמפ: גישה לנשיא אינה הסכם בטיחות
    בטיחות AIAnthropicמדיניות AIביקורת AIממשל

    אמודיי בשולחן של טראמפ: גישה לנשיא אינה הסכם בטיחות

    Y

    Yoni Fraimorice

    שיתוף:

    דריו אמודיי רוצה שתעשיית ה-AI תאט את ההתקדמות של המערכות החזקות ביותר שלה. דונלד טראמפ אומר שאמריקה חייבת להמשיך לנוע מהר כדי לנצח את סין.

    ארוחת הערב הפרטית בבית הלבן שעליה דווח מביאה את המחלוקת הזאת לשולחן אחד. CNBC דיווחה שארוחת הערב האישית הראשונה בין השניים נקבעה ליום ראשון, 27 בספטמבר, אחרי שאמודיי נעדר מארוחה ממלכתית קודמת בגלל התנגשות בלוחות הזמנים.

    הדיווחים המצוטטים כאן מבססים את ההזמנה ואת העמדות הפומביות, לא הסכם בטיחות שהושג במשא ומתן. לכן השאלה השימושית אינה האם הארוחה היא כניעה או ניצחון. היא איזו הגנה ממשית יכולה לצאת מהשיחה, ואיך אפשר יהיה לבדוק אותה?

    המחלוקת אמיתית, אבל אינה מוחלטת

    ב-14 בספטמבר טראמפ כינה את החששות מפני AI שמשתלט על העולם ומשמיד את האנושות ״תרמית״, לפי דיווח של Associated Press. הוא גם טען שנשיאותו מספקת את מעקות הבטיחות הנדרשים.

    הרטוריקה הזאת משאירה מעט מקום לאזהרה הפומבית של אמודיי מפני אובדן שליטה בסוכנים שהולכים ומתחזקים.

    אבל ״טראמפ מתנגד לבטיחות״ הוא תיאור פשטני מדי של המדיניות בפועל. הצו הנשיאותי שלו מ-2 ביוני תומך בחיזוק הגנת הסייבר, בהגנה מפני גניבת מודלים ובהערכה ממשלתית של יכולות סייבר מתקדמות.

    הצו קורא למסגרת וולונטרית שתציע לממשלה גישה למודלים הנכללים בה למשך עד 30 יום לפני שחרורם לשותפים מהימנים אחרים. הוא שולל במפורש פרשנות של הסעיף כסמכות לחייב רישוי או אישור מוקדם של מודלים.

    כך נפתח פתח צר: להגן על מערכות ויכולות אמריקאיות, במקום להתחיל בבקשה להאטה רחבה. השפה שונה; חלק מהבקרות המועילות יכולות להיות משותפות.

    אמודיי אינו מציע עצירה מוחלטת

    במאמרו ״We Must Pace the Frontier״, אמודיי מבחין בין ויסות הקצב לבין עצירת אימון מודלים או התקדמות טכנית. הטענה שלו היא ששיפור הבטיחות והפיקוח צריך זמן כדי להדביק את צמיחת היכולות.

    להצעה שלו שלושה שלבים: שילוב בודקים עצמאיים בתוך המעבדות, תיאום בין מדינות דמוקרטיות ומעבדות החזית שלהן, ותיאום בינלאומי רחב יותר כשאפשר לאמת עמידה בהתחייבויות.

    Anthropic מתחייבת באופן חד-צדדי לשלב הראשון. השלבים האחרים דורשים שיתוף פעולה. אמודיי מכיר גם בסיכון שבאובדן היתרון האמריקאי מול סין.

    כלומר, יש בסיס משותף מסוים סביב הביטחון הלאומי. השאלה הקשה היא מה קורה כשממצא בטיחותי מחייב דחייה. אם המהירות מנצחת בכל מחלוקת, הבדיקה הופכת לטקס במקום לבקרה.

    מה הוא יכול לבקש באופן מציאותי?

    אלה מטרות אפשריות למשא ומתן, לא תוצאות מדווחות של הארוחה.

    1. להפוך הערכות וולונטריות לתהליך שימושי

    הצו מיוני כבר נותן לסוכנויות ולמעבדות בסיס לשיתוף פעולה. אמודיי יכול לבקש צוותים טכניים מוגדרים, גישה מוגנת לבודקים, שיטות בדיקה מוסכמות ותגובות כתובות לממצאים חמורים.

    עבור סוכן, ״בטוח מספיק״ צריך לכלול יותר מציוני ביצועים. האם הוא יכול לעקוף את סביבת הבידוד שלו? האם הניטור מזהה פעולות לא מורשות? האם המפעילים יכולים לבטל פרטי גישה ולעצור סוכני משנה? האם העלאת נתוני אימון חסומה מחוץ ליעדים מאושרים?

    לבדיקה צריכה להיות תוצאה מעשית. מעבדה יכולה להתחייב שלא לשחרר את היכולת הרלוונטית עד שממצא קריטי יטופל וייבדק מחדש. רוכשים ממשלתיים יכולים לבקש הבטחות דומות בחוזים, בכפוף לדין החל.

    זה מצומצם יותר מעצירת אימון ארצית, ומוחשי יותר מהבטחה ״לעבוד יחד״.

    2. להסכים על דיווח תקריות ותשתית מאובטחת

    סדר היום של הממשל בתחום הגנת הסייבר משאיר מקום לקטגוריות תקריות משותפות, אנשי קשר ישירים באבטחה, שימור ראיות ותיקונים מתואמים.

    הסכם שימושי יגדיר אילו כשלים של סוכנים דורשים הודעה, מי מקבל אותה ומתי. הוא יפריד בין ראיות טכניות פרטיות לבין תקצירים לציבור, כדי ששקיפות לא תחשוף מערכות פגיעות.

    הוא צריך לכסות גם כשלים בזמן אימון והערכה פנימיים, ולא רק תקיפות שמבצעים לקוחות. סוכן יכול לגרום נזק עוד לפני השקת המודל.

    גם מימון בדיקות הגנתיות או הגנה על משקלי מודלים עשויים להיות הישגים מעשיים. אבל הם לא יפתרו כשלעצמם את בעיית ההתאמה לכוונות אנושיות ולא יבססו האטה.

    3. ליצור מסלול חוקי לדיון בתקנים משותפים

    המאמר של אמודיי מבקש סיוע ממשלתי בשאלות של דיני תחרות סביב תיאום. זה חשוב, משום שמעבדות מתחרות אינן יכולות להתייחס ל״בטיחות״ כהיתר להסכים על היקפי פעילות, מחירים או מועדי השקה.

    בקשה אמינה תהיה מוגדרת היטב: מבני בדיקות משותפים, הגדרות של תקריות וספי בטיחות שנבדקים באופן עצמאי. כל הגנה משפטית רחבה יותר תדרוש בסיס חוקי תקף ובחינה של הרשויות המתאימות.

    שיחה ידידותית עם הנשיא אינה פטור מדיני תחרות. גם תהליך קביעת תקנים לא צריך להפוך למועדון פרטי שמדיר מתחרים קטנים.

    ל-Anthropic יש כוח מיקוח, וגם סיבות להתפשר

    Anthropic מביאה מודלים בעלי ערך, מומחיות טכנית וניסיון במדידת התנהגות סוכנים. לבכירים שמחפשים מערכות חזקות יש סיבות להשאיר ערוץ תקשורת פתוח.

    לחברה יש גם לחץ מסחרי ומשפטי. CNBC דיווחה שבית משפט לערעורים אישר ב-25 בספטמבר את סיווגה של Anthropic כסיכון לשרשרת האספקה בידי הפנטגון. המחלוקת באה בעקבות אי-הסכמה על שימוש צבאי, ובכלל זה המגבלות של Anthropic בנוגע לנשק אוטונומי לחלוטין ולמעקב המוני בתוך ארצות הברית.

    ההקשר הזה חשוב. שיפור ביחסים עם הממשלה עשוי להועיל לעסקיה של Anthropic. נאיבי להתעלם מהתמריץ הזה, אבל גם שגוי להניח שהוא מוכיח עסקה שלא פורסמה.

    המבחן הוא האם פשרה מסחרית משנה את התחייבויות הבטיחות, והאם השינויים האלה גלויים.

    איך שומרים על המותג שמציב בטיחות במקום הראשון

    סירוב לכל פגישה לא יגן על משתמשים. חברות צריכות לדבר גם עם ממשלות שחולקות עליהן. השתתפות אינה הבעת תמיכה.

    אבל גישה למקבלי החלטות עלולה להפוך לתחליף לאחריות. Anthropic צריכה להפוך את הבטחותיה לניתנות לבדיקה בשלוש דרכים.

    להשאיר התחייבויות חד-צדדיות ככאלה. הצעת הבודקים של אמודיי צריכה להתקדם גם אם טראמפ דוחה האטה מתואמת. המאמר מבטיח לבודקים גישה הדומה לזו של עובדים וזכות לפרסם ממצאים לא מחמיאים, עם הגנות מוגבלות למידע רגיש. צריך לשאול מתי הגישה מתחילה ואילו חריגים נשארו.

    לפרסם ראיות, לא רק עמדות. הצעת המדידה של Anthropic עוסקת במחקר שמוביל AI, בכיסוי הניטור ובזמן עד בדיקה, ובהקצאת משאבי חישוב. היא גם מכירה במגבלות, כולל השימוש במודלים של החברה כשופטים. מדידות קבועות שנבדקות עצמאית יהיו בעלות משקל רב יותר מתצלום של ארוחת ערב.

    להסביר שינויים ומחלוקות. דיווח לציבור צריך להבחין בין הצעה, התחייבות של חברה וכלל ממשלתי שאומץ. אם מגבלות מדיניות משתנות, צריך להסביר מה השתנה ולמה. אין להציג יחסים חמים יותר כהוכחה לכך שהסיכונים הטכניים נעלמו.

    לשפוט את התוצאה לפי מה שאפשר לבדוק

    תוצאה אפשריתמה יהפוך אותה למשמעותית
    גישה טובה יותר לבכיריםערוץ טכני מוגדר עם תאריכי מעקב
    יותר הערכות של מודליםגישה עצמאית, ממצאים כתובים ותוצאות מעשיות
    תקני בטיחות משותפיםהיקף ברור, השתתפות רחבה ובדיקה משפטית
    מוניטין בטיחות חזק יותרהתחייבויות שממשיכות לחול גם כשהן מעכבות עסקים

    ההישג המציאותי ביותר עשוי להיות חבילה קטנה של התחייבויות לאבטחה, להערכה ולדיווח, ולא הצטרפות של הנשיא לתנועת ההאטה.

    גם זה יהיה משמעותי. אבל Anthropic לא יכולה לשמר את זהותה כחברה שמציבה בטיחות במקום הראשון רק באמצעות קרבה לשלטון. היא תשמור עליה אם תעמוד בהבטחות גם כשזה לא נוח, תאפשר לאנשים מבחוץ לבדוק אותן ותאמר בבירור היכן ההסכמה מסתיימת.

    מקורות

    תמונת הנושא: דריו אמודיי בכנס TechCrunch Disrupt 2023, קרדיט TechCrunch, ברישיון CC BY 2.0. התמונה הוקטנה לרוחב 1920 פיקסלים ונשמרה במאגר. זהו צילום ארכיון מכנס, לא צילום של ארוחת הערב בבית הלבן.

    שיתוף: