2026-08-26 · 4 דק' קריאה

קבצי אקסל עם ת"ז, טלפונים ושכר מול AI: איך מנתחים בלי לחשוף

למה "זה רק מספרים" היא טעות מסוכנת?

כי החוק לא מבחין בין אותיות למספרים אלא בין מזהה ללא-מזהה. מספר ת"ז מזהה אדם טוב יותר משמו — שמות חוזרים, ת"ז לא.

  • ת"ז — מזהה חד-ערכי של אדם. עמודה כזו היא מידע אישי גם כשכל שאר הקובץ "נקי".
  • טלפון נייד — מוביל ישירות לאדם; בצירוף אפליקציות הודעות גם לשמו ולתמונתו.
  • שכר וחשבון בנק — מידע בעל רגישות מיוחדת; שכר לצד תפקיד ומחלקה מזהה גם בלי שם.
  • צירופים עקיפים — תאריך לידה + יישוב + מחלקה מצמצמים לאדם אחד בקלות מפתיעה.

מה מסתתר בקובץ אקסל מעבר לתאים שרואים?

קובץ Excel הוא הרבה יותר ממה שמוצג במסך — וכל השכבות הנסתרות עוברות יחד איתו בהדבקה או בשיתוף.

  • גיליונות מוסתרים — טאב שהוסתר לפני שנים עם נתוני הגלם המלאים.
  • עמודות ושורות מכווצות — "מחקתי את העמודה הרגישה" הוא לפעמים רק Hide.
  • Metadata — שם המחבר, נתיב הקובץ והערות בתאים.
  • נוסחאות וטווחים — נוסחה שמפנה לקובץ אחר חושפת את שמו ומיקומו.

מה החוק אומר על גיליון עם נתוני אנשים?

גיליון עם שורה לאדם הוא מאגר מידע לפי חוק הגנת הפרטיות, ותקנות אבטחת מידע מחייבות לשלוט בגישה אליו ובהעברותיו. הדבקת הגיליון בכלי AI חיצוני היא העברה לצד שלישי שדורשת בסיס חוקי — ואחרי תיקון 13, האכיפה על העברות כאלה רק התהדקה. מידע אנונימי, לעומת זאת, מחוץ לתחולת החוק.

איך מנתחים קובץ אקסל עם AI — בבטחה?

  1. צמצמו את הקובץ לשאלה — רק העמודות והתקופה שהניתוח צריך. פחות נתונים, פחות חשיפה.
  2. גלו את הנסתר — בטלו הסתרות של גיליונות ועמודות ובדקו מה באמת יש בקובץ.
  3. החליפו מזהים בטוקנים עקביים — ת"ז, שמות, טלפונים וחשבונות הופכים ל-PERSON_001 וכדומה; אותו אדם שומר על אותו טוקן בכל הגיליונות.
  4. נקו Metadata והערות — מחבר, נתיבים והערות תאים.
  5. הזינו את הגרסה הנקייה ל-AI — סיכומים, ממוצעים, מגמות וחריגים מחושבים בדיוק כמו קודם.

הניתוח לא ייפגע בלי המזהים?

לא. ניתוח כמותי עובד על ערכים ועל הקשרים ביניהם — לא על זהות בעליהם. ממוצע שכר לפי מחלקה, התפלגות גילאים, איתור כפילויות וחריגים: כולם עובדים כשהמזהה הוא טוקן עקבי. זה אותו עיקרון כמו בניתוח רשימות לקוחות — הדפוס נשאר, הזהות נשארת בבית. עוד על השיטה: אנונימיזציה של מסמכים.

שאלות נפוצות

עמודת ת"ז בלי שמות — זה עדיין מידע אישי?

כן, לחלוטין. מספר ת"ז מזהה אדם אחד ויחיד, ולכן הוא מידע אישי בפני עצמו — נוכחות עמודת שמות אינה תנאי.

מותר להדביק טבלת שכר ב-ChatGPT כדי לחשב ממוצעים?

לא כשהיא כוללת מזהים — שכר הוא מידע בעל רגישות מיוחדת. אחרי החלפת השמות והת"ז בטוקנים, החישוב נעשה על מידע שאינו אישי ומותר.

מחקתי את העמודות הרגישות — הקובץ בטוח?

רק אם באמת מחקתם: עמודות מוסתרות, גיליונות מוסתרים ו-Metadata שורדים 'מחיקה' ויזואלית. בדקו הסתרות ונקו את מאפייני הקובץ לפני כל שיתוף.

האם ממוצעים וסיכומים שכבר חושבו הם מידע אישי?

סיכום סטטיסטי על קבוצה גדולה לרוב אינו מזהה. אבל היזהרו בקבוצות קטנות: 'ממוצע שכר במחלקה של שני עובדים' חושף בפועל את שכרם. כלל אצבע: אם אפשר לגזור מהסיכום ערך של אדם בודד — הוא עדיין מידע אישי.

איך שומרים על יכולת הניתוח אחרי אנונימיזציה?

עקביות ושמירת מבנה: כל אדם מקבל טוקן קבוע בכל הגיליונות, והעמודות הכמותיות נשארות כמו שהן. סכומים, ממוצעים והצלבות עובדים בדיוק כמו קודם.