הוא פלט תוכן מזיק ב-80 אחוז מהמקרים בלי שאף אחד בכלל תקף אותו
מערכת AI פרצה את המודל של Meta ב-85 אחוז מהניסיונות. בלי קוד. בלי כלי תקיפה מיוחדים. תוך שלוש שעות.
רגע, זה עוד לא החלק המטורף.
החלק המטורף הוא שגם בלי שום ניסיון פריצה, בלי jailbreak, בלי prompt injection מתוחכם – פשוט לשאול יפה – המודל פלט תוכן מזיק ב-80 אחוז מהמקרים. כלומר, 80 אחוז הצלחה בלי אפילו לנסות.
בואו נעצור פה שנייה.
כולם משחררים, אף אחד לא בודק
אנחנו חיים בתקופה שבה כל חברה שנייה רצה לדחוף AI agent לתוך המוצר. כל סטארטאפ מוסיף “AI-powered” לכותרת באתר. כל CTO מספר לבורד שהם כבר משלבים בינה מלאכותית.
אבל מי בדק את ה-attack surface? מי עשה red teaming למודל לפני שהוא הגיע לפרודקשן? מי בכלל יודע מה המודל הזה מסוגל להגיד כשמישהו לוחץ עליו נכון?
התשובה: כמעט אף אחד.
אני עוסק באבטחת אפליקציות כבר יותר מ-15 שנה. ראיתי את אותו הסיפור שוב ושוב: טכנולוגיה חדשה נכנסת, כולם רצים לאמץ, אף אחד לא בודק, מישהו נפרץ, ופתאום כולם מומחים. זה קרה עם web applications. זה קרה עם mobile. זה קרה עם cloud. ועכשיו זה קורה עם AI agents.
ההבדל היחיד הפעם
ה-attack surface הוא שפה טבעית. לא צריך לדעת לכתוב exploit. לא צריך Burp Suite. לא צריך שנים של ניסיון. צריך רק לדעת לנסח משפט.
זה אומר שכל אחד יכול לתקוף. המתמחה, הלקוח, המתחרה, הילד בן 14. כל מי שיודע להקליד.
והנה מה שמפחיד אותי באמת: חברות שמות AI agents עם גישה למידע רגיש, לפעולות פיננסיות, לנתוני לקוחות. בלי שום שכבת הגנה רצינית. בלי בדיקות חוסן. בלי הבנה בסיסית של מה יכול להשתבש.
זו לא שאלה של אם. זו שאלה של מתי.
אז מה עושים?
לפני שמשלבים AI agent בפרודקשן – עושים לו red teaming כמו שעושים pentest לאפליקציה. בודקים prompt injection. בודקים data leakage. בודקים מה קורה כשמישהו מנסה לגרום למודל לחרוג מהגבולות. לא סומכים על ה-guardrails של הספק.
פוסט זה פורסם לראשונה בלינקדאין בתאריך 2026-05-27. — ארז מטולה
