פגיעות בסיסית במודלים לשוניים לפי MIT Technology Review
מאמר של MIT Technology Review חושף פגיעות בסיסית במודלים לשוניים גדולים (LLMs), אשר מאפשרת תקיפות שאינן נתפסות על ידי מנגנוני האבטחה הקיימים.
מה זה מודלים לשוניים גדולים?
מודלים לשוניים גדולים (LLMs) הם מערכות בינה מלאכותית מתקדמות אשר מאומנות על כמויות עצומות של טקסטים במטרה לייצר שפה טבעית. מערכות אלו נמצאות בשימוש נרחב במגוון תחומים כגון שירותים ממשלתיים, צבאיים, קניות מקוונות ובריאות.
הפגיעות הבסיסית במודלים
לפי מחקר שהוצג בכנס ICML, ישנה פגיעות בסיסית במבנה המודלים הלשוניים הגדולים. הפגיעות נובעת מכך שהמודלים מתקשים להבחין בין מקורות ההוראות שהם מקבלים. החוקרים הצליחו לנצל פגיעות זו כדי לגרום למודלים להפיק מידע שהם אמורים להימנע ממנו, כמו הוראות לייצור סמים או לטרפוד מערכות ניווט.
טכניקות התקיפה
החוקרים משתמשים בטכניקה הנקראת 'זיוף שרשרת מחשבה', שמצליחה להטעות את המודל לחשוב שההוראות נובעות ממנו עצמו. לדוגמה, הם הצליחו לגרום ל-LLM להפיק מידע רגיש על ידי שינוי תוכן התגיות שמסמנות את תפקיד הטקסט.
התמודדות עם הבעיה
כדי להתמודד עם בעיות אבטחה, חברות שוכרות 'צוותים אדומים' שמנסים לשבור את הגנות המודלים. עם זאת, החוקרים מציינים כי אין רשימת איסורים מלאה ושהמודלים עדיין פגיעים לתקיפות חדשות שלא נצפו בעבר.
השלכות לעסקים קטנים ובינוניים
אצל עסקים קטנים ובינוניים בישראל, השימוש במודלים לשוניים גדולים עלול להוות סיכון אם לא ננקטים צעדים מתאימים לאבטחת המידע. חשוב להיות מודעים לפגיעות ולפעול בהתאם כדי להגן על המידע הרגיש של העסק.
פתרונות אפשריים
אחת ההמלצות היא לא לסמוך באופן עיוור על מודלים לשוניים ולעשות שימוש מבוקר בהם. כמו כן, חשוב להמשיך ולפתח טכנולוגיות אבטחה מתקדמות יותר כדי להתמודד עם איומים חדשים.
המאמר הזה מבוסס על דיווח של MIT Technology Review.
מבוסס על MIT Technology Review: https://www.technologyreview.com/2026/07/30/1140927/a-fundamental-flaw-leaves-llms-vulnerable-to-attack/