yonifra

    על אבטחת AI, סוכני AI והטכנולוגיה שמשנה את הדרך שבה אנחנו בונים תוכנה.

    נושאים בולטים:
    OpenAI ביטלה השקה. זו עדיין לא בדיקת בטיחות עצמאית.

    OpenAI ויתרה על השקת GPT-6.1 Astra בעקבות כשלי בטיחות. אילו ראיות צריכות לעצור השקת סוכן, ולמה עצירה מרצון עדיין דורשת בדיקה חיצונית?

    אמודיי בשולחן של טראמפ: גישה לנשיא אינה הסכם בטיחות

    דריו אמודיי רוצה להאט את פיתוח מודלי החזית. טראמפ רוצה לנצח במרוץ. ארוחת הערב שעליה דווח מעלה שאלה: האם התחייבויות אבטחה מעשיות יכולות לגשר על הפער, והאם Anthropic תשמור על הבטחותיה?

    OpenAI עצרה. מה צריך לדרוש לפני שחוזרים לאמן?

    OpenAI עצרה. מה צריך לדרוש לפני שחוזרים לאמן?

    Yoni Fraimorice

    ההאטה באימון של OpenAI הגיעה בעקבות פריצה אמיתית של סוכנים ועלייה ביכולות סייבר. הלקח אינו שתיאוריית הבטיחות נכשלה, אלא שצריך כללי עצירה תפעוליים וראיות לפני חידוש העבודה.

    הבדיקה של OpenAI ממשיכה להתרחב. האם הניטור של הסוכנים הדביק את הקצב?

    OpenAI הודיעה לעשרות ארגונים על פעילות סוכנים במסגרת בדיקה מתרחבת. מספר גדל עשוי להעיד על גילוי טוב יותר, לא על תקיפות חדשות—אבל המעבדות עדיין חייבות לספק ראיות בזמן ולהראות התקדמות מדידה.

    טאמבלר רידג׳: הדיווח על ChatGPT שמרחיב את השאלה מעבר לאזהרה שלא נמסרה

    דיווח חדש טוען ש-ChatGPT סיפק סיוע מזיק במשך חודשים לפני הירי בטאמבלר רידג׳. מה משתנה בתביעת חובת האזהרה, ואיך מזהים הסלמה בלי להפוך שיחות פרטיות למעקב המוני?

    סוכן OpenAI שלא הסכים לקבל "לא" כתשובה

    סוכן OpenAI שלא הסכים לקבל "לא" כתשובה

    Yoni Fraimorice

    סוכן מחקר של OpenAI עקף חסימות, נכנס לפורטל הסטטיסטיקה של Medicare באוסטרליה וכתב קבצים לשרת ממשלתי. הנזק היה מוגבל. כשל הניטור לא.

    Jev: מודל ה-AI שאף פעם לא כותב מילה

    Jev: מודל ה-AI שאף פעם לא כותב מילה

    Yoni Fraimorice

    Jev של TypeSafe AI לא מנהל שיחה. הוא מחזיר החלטות מוקלדות עם הסתברויות מכוילות, ב-0.042 דולר למיליון טוקנים. כך הוא עובד, זו הסיבה שהוא כל כך זול, וכך משתמשים בו בבטחה.

    כש-ChatGPT מזהה איום: איזו חובת התרעה צריכה להיות לחברות AI?

    בריטיש קולומביה טוענת ש-OpenAI החמיצה הזדמנות להזהיר את המשטרה לפני הירי בטאמבלר רידג׳. המקרה מראה למה זיהוי איומים ב-AI דורש הסלמה אנושית, גבולות פרטיות ואחריות ברורה.

    האם מעבדות AI יכולות להסכים להאט? דיני התחרות נכנסו לדיון הבטיחות

    תביעה חדשה טוענת ש-Anthropic, OpenAI, SpaceXAI ו-Google הפכו תיאום בטיחות להסכם האטה בלתי חוקי. התיק עשוי לשנות כל ניסיון לרגולציה עצמית בתעשייה.

    Gemini הגיעה לחברות אמיתיות: תשתיות בדיקת AI צריכות תקן אבטחה

    סוכני Gemini נכנסו למערכות של שלוש חברות במהלך בדיקת סייבר של Irregular. החשיפה הרביעית מראה למה בדיקות מודלי חזית צריכות גבולות טכניים קשיחים.

    Claude עזר לפרוץ ל-OpenAI: מה תקרית Hacktron משנה

    Claude עזר לפרוץ ל-OpenAI: מה תקרית Hacktron משנה

    Yoni Fraimorice

    Hacktron חיברה חולשת תמונה ב-libheif, תקלה ב-SSO וגישה דרך Codex בתוך פחות מ-72 שעות. האזהרה האמיתית היא השינוי בכלכלת התקיפה.

    שש תקריות חוסר ההתאמה של OpenAI: מה מפתחי סוכנים צריכים ללמוד

    OpenAI חשפה סוכנים שהסתירו טעויות, השתמשו במפתחות שדלפו ועקפו מגבלות תקשורת. כך שש התקריות משפיעות על מערכות אמיתיות.

    חוק FRONTIER: מה מבקרי AI עצמאיים חייבים לבדוק

    חוק FRONTIER: מה מבקרי AI עצמאיים חייבים לבדוק

    Yoni Fraimorice

    OpenAI תומכת בפיקוח עצמאי מחייב על AI. אילו בדיקות נדרשות כדי לזהות הסקה מוטה ופעילות מסוכנת של קבוצות סוכנים, ומה גם ביקורת כזו לא תוכל להוכיח?

    איך מודלי AI עובדים — ואיך אפשר להטעות אותם

    איך מודלי AI עובדים — ואיך אפשר להטעות אותם

    Yoni Fraimorice

    מדריך חזותי לטוקנים, אימון, מנגנון הקשב וסוכני AI, עם הסבר מעשי על הזרקת הנחיות, עקיפת מגבלות בטיחות והרעלת נתונים.

    המודל אמר שזו סימולציה. ואז הוא פרסם נוזקה ב-PyPI.

    המודל אמר שזו סימולציה. ואז הוא פרסם נוזקה ב-PyPI.

    Yoni Fraimorice

    דוח הבטיחות של Anthropic על Claude Mythos 5 מראה מה קורה כשמערכת הניטור סומכת על ההסברים של המודל עצמו.

    תקרית Hugging Face: כשסוכני AI ניסו לרמות במבחן והגיעו למערכות ייצור

    סוכני OpenAI הפכו שירות חבילות משותף ללוח הודעות, יצאו מרשת הבדיקה והגיעו למערכות הייצור של Hugging Face.

    שיטת ראלף ויגאם: לפתח בעזרת AI, שוב ושוב, עד שזה עובד

    שיטת ראלף ויגאם: לפתח בעזרת AI, שוב ושוב, עד שזה עובד

    Yoni Fraimorice

    לא חייבים להגיע לפתרון מושלם בניסיון הראשון. כך משתמשים בלולאות של ראלף ויגאם כדי לתת ל-Claude לעבוד באופן עצמאי עד להשלמת המשימה.

    שורת פקודה או סביבת פיתוח? העתיד של פיתוח בעזרת סוכני AI

    שורת פקודה או סביבת פיתוח? העתיד של פיתוח בעזרת סוכני AI

    Yoni Fraimorice

    האם הטרמינל חוזר למרכז הבמה? השוואה בין כלי AI בתוך סביבת הפיתוח לבין סוכנים שפועלים משורת הפקודה, כמו Claude Code.

    פרדוקס הבינה המלאכותית: כותבים פחות קוד, אבל מבינים יותר?

    פרדוקס הבינה המלאכותית: כותבים פחות קוד, אבל מבינים יותר?

    Yoni Fraimorice

    האם הבינה המלאכותית הופכת אותנו למפתחים טובים יותר, או רק מקלה עלינו להתאמץ פחות? על השפעת מודלי השפה על מפתחים בתחילת הדרך ועל מפתחים מנוסים.

    עידן חדש ליזמים

    עידן חדש ליזמים

    Yoni Fraimorice

    על השינויים הטכנולוגיים שפותחים הזדמנויות חדשות ליזמים ומשנים את הדרך שבה הופכים רעיון למציאות.

    איך לנהל פרויקטים אישיים לצד העבודה והמשפחה

    איך לנהל פרויקטים אישיים לצד העבודה והמשפחה

    Yoni Fraimorice

    לא פשוט לעבוד על פרויקטים אישיים כשמגדלים שלושה ילדים ועובדים במשרה מלאה, אבל זה בהחלט אפשרי.