2026-08-26 · 4 דק' קריאה

האם הבינה המלאכותית מתאמנת על המידע שלי?

אז מתאמנים על המידע שלי או לא?

אין תשובה אחת — יש מדרג. ככלל: בגרסאות צרכניות חינמיות או אישיות, שיחות עשויות לשמש לשיפור המודלים, לעיתים כברירת מחדל שניתן לכבות; במנויים עסקיים (Enterprise, Team, Workspace וכדומה) מקובלת התחייבות חוזית שלא לאמן על נתוני הלקוח. הפרטים שונים בין ספקים ומשתנים עם הזמן — הכלל היחיד שתמיד נכון: בדקו את מדיניות השימוש בנתונים העדכנית של הספק שלכם.

למה אימון הוא לא הסיכון היחיד?

גם כשספק לא מתאמן על הנתונים, המידע עדיין יצא מהמחשב שלכם. חשוב להבין את כל נתיבי החשיפה:

  • שמירה — שיחות נשמרות בהיסטוריה בצד הספק, לעיתים גם לצרכי ניטור שימוש לרעה.
  • סקירה אנושית — בחלק מהמקרים שיחות עשויות להיסקר על ידי בני אדם, למשל לאכיפת מדיניות.
  • תקלות ודליפות — כל מאגר אצל צד שלישי הוא יעד פוטנציאלי לתקיפה או באג.
  • טעויות משתמש — שיתוף שיחה בקישור, חשבון פרטי במקום ארגוני, מכשיר משותף.
  • שינויי מדיניות — מה שנכון היום עשוי להשתנות; המידע שכבר נשלח נשאר שם.

איך בודקים מה הספק שלי עושה עם הנתונים?

  1. אתרו את מסמך ה-Privacy Policy או ה-Data Usage של הספק — בגרסה העדכנית, לא כתבה מלפני שנה.
  2. חפשו תשובות לשלוש שאלות: האם משתמשים בשיחות לאימון? כמה זמן נשמר המידע? מי רשאי לעיין בו?
  3. בדקו מה חל על סוג החשבון שלכם — צרכני ועסקי הם עולמות שונים, כפי שהרחבנו במאמר על ChatGPT Enterprise.
  4. בדקו אילו הגדרות opt-out קיימות בחשבון — והפעילו אותן במידת הצורך.
  5. קבעו תזכורת לבדיקה חוזרת: מדיניות של ספקי AI מתעדכנת בתדירות גבוהה.

מה הדרך שלא תלויה במדיניות של אף ספק?

לא לשלוח את מה שאסור שידלוף. מדיניות היא הבטחה; ארכיטקטורה היא עובדה. מסמך שעבר אנונימיזציה — שמות הוחלפו ב-tokens עקביים כמו PERSON_001, מספרי זהות וטלפונים הוסרו, ה-metadata נוקה — אפשר להזין לכל כלי: גם אם הספק יתאמן עליו, ייסקר, או אפילו ידלוף, אין בו זהות של אף אדם.

זה גם השיקוף המשפטי: מידע אנונימי אינו 'מידע אישי' לפי חוק הגנת הפרטיות ולפי ה-GDPR — ולכן ההזנה שלו כלל אינה עיבוד מידע אישי, בלי תלות בשאלה מה הספק עושה בצד השני.

שאלות נפוצות

האם ChatGPT מתאמן על השיחות שלי?

בחשבונות צרכניים ייתכן שימוש בשיחות לשיפור המודלים, בהתאם להגדרות; במנויים עסקיים מקובלת התחייבות שלא. המדיניות מתעדכנת — התשובה המחייבת נמצאת רק בתנאים העדכניים של הספק.

אם כיביתי את האימון בהגדרות, אני מוגן?

זה מצמצם נתיב סיכון אחד, אבל המידע עדיין נשלח, נשמר ועשוי להיסקר — ותקלות אצל הספק לא תלויות בהגדרות שלכם. הגנה מלאה יש רק למה שלא נשלח.

האם מודל יכול 'לפלוט' מידע שהוזן לו על ידי משתמש אחר?

כשמידע נכלל בחומרי אימון, קיים סיכון עקרוני שהוא ישתקף בתשובות עתידיות. זו בדיוק הסיבה שמידע מזהה לא אמור להגיע לאימון מלכתחילה — ולמה אנונימיזציה לפני ההזנה חשובה.

האם הזנת מידע לצ'אט AI היא הפרה של חוק הגנת הפרטיות?

הזנת מידע אישי לכלי חיצוני היא עיבוד והעברה שמחייבים בסיס חוקי ואמצעי אבטחה. מידע אנונימי, לעומת זאת, אינו מידע אישי — ולכן הזנתו אינה כפופה לחובות אלה.

איך אדע שהאנונימיזציה עצמה לא דולפת?

בדקו איפה היא רצה: כלי שמעלה את המסמך לשרת שלו רק מעביר את הבעיה לספק אחר. עיבוד מקומי בדפדפן משאיר את הקובץ המקורי ואת מפת ההחלפות אצלכם בלבד.