2026-08-26 · 4 דק' קריאה

Metadata במסמכים: מה הקובץ שלכם מספר בלי שתדעו

איזו metadata מסתתרת במסמך טיפוסי?

יותר משנדמה. קובץ Word או PDF ממוצע נושא כמה שכבות של מידע סמוי, וכל אחת מהן יכולה לחשוף פרטים רגישים בפני כל מי שמקבל את הקובץ — לקוח, צד שכנגד, או שירות ענן שהקובץ הועלה אליו.

  • מאפייני מסמך — שם המחבר, שם הארגון, כותרות ומילות מפתח שהוזנו פעם ונשכחו.
  • Track Changes — שינויים עוקבים שלא אושרו: כל מה שנמחק, נוסח מחדש או 'הועלם' — עדיין שם, כולל מי שינה ומתי.
  • הערות (Comments) — הדיון הפנימי בין העורכים: 'הלקוח לא יסכים לזה', 'לבדוק מול משפטית'.
  • גרסאות ותוכן משוחזר — חלק מהפורמטים שומרים גרסאות קודמות או שאריות של תוכן שנמחק.
  • נתיבים ומערכות — נתיב הקובץ, שמות שרתים ותיקיות ('C:\Users\jmiller\לקוחות\תביעה_נגד_X').
  • מידע מוטמע — טבלת Excel שהוטמעה במצגת עשויה להכיל את הגיליון המלא, לא רק את מה שמוצג.

למה metadata מסוכנת דווקא במסמכים רגישים?

כי היא חושפת בדיוק את מה שהעריכה נועדה להסתיר. מסמך משא ומתן מסגיר בהערות את גבולות הגמישות שלכם; חוות דעת חושפת ב-Track Changes את הניסוחים שהוחלפו והושמטו; וקובץ שנשלח כ'אנונימי' מסגיר בשדה המחבר את שם כותבו. ההיסטוריה של המסמך מספרת לפעמים יותר מהמסמך עצמו — למי שיודע איפה להסתכל.

זה גם הכשל המשלים של השחרה כושלת: גם כשהטקסט הגלוי הוסר כראוי, ה-metadata ממשיכה לספר את הסיפור. עבור עורכי דין ובעלי מקצוע החבים חיסיון, הערות ושינויים שדלפו הם הפרת סודיות לכל דבר.

מה קורה ל-metadata כשמזינים מסמך לכלי AI?

כשמעלים קובץ שלם לכלי AI, הכלי מקבל את הקובץ — על כל שכבותיו. גם אם המשימה היא 'סכם את המסמך', מה שנמסר כולל את ההערות, השינויים והמאפיינים. לכן אנונימיזציה אמיתית חייבת לכלול ניקוי metadata, ולא רק החלפת שמות בטקסט הגלוי.

איך מנקים metadata לפני שיתוף?

  1. אשרו או דחו את כל השינויים — Track Changes פתוח הוא היסטוריה חיה; סגרו אותו לפני הייצוא.
  2. מחקו את כל ההערות — כולל הערות שסומנו כ'פתורות'.
  3. נקו מאפייני מסמך — בכלי הבדיקה המובנה של התוכנה (למשל Inspect Document ב-Word) או בכלי ייעודי.
  4. ייצאו קובץ חדש — ייצוא נקי (למשל ל-PDF חדש) מנתק את רוב השכבות ההיסטוריות; ודאו שההגדרות לא מעתיקות את המאפיינים.
  5. בדקו את התוצאה — פתחו את הקובץ הסופי ובחנו את מאפייניו כאילו אתם הצד המקבל.

שאלות נפוצות

האם מחיקת טקסט מהמסמך מוחקת אותו גם מה-metadata?

לא. טקסט שנמחק עשוי להישאר ב-Track Changes, בהערות ובגרסאות קודמות השמורות בקובץ. רק אישור כל השינויים, מחיקת ההערות וניקוי המאפיינים מסירים אותו באמת.

האם המרה ל-PDF מנקה את ה-metadata?

חלקית בלבד. ייצוא ל-PDF מנתק בדרך כלל את ה-Track Changes וההערות של קובץ המקור, אבל ה-PDF עצמו מקבל מאפיינים משלו (מחבר, תוכנה, תאריכים) ולעיתים יורש שדות מהמקור. תמיד בודקים את הקובץ הסופי.

איך רואים את ה-metadata של קובץ?

במאפייני הקובץ (Properties) במערכת ההפעלה או בתוכנת העריכה, ובכלי הבדיקה המובנים — למשל Inspect Document ב-Word, שמאתר מאפיינים, הערות ותוכן מוסתר.

האם metadata נחשבת מידע אישי לפי החוק?

כשהיא כוללת פרטים על אדם מזוהה — שם מחבר, מי כתב הערה, מי ביצע שינוי — היא מידע אישי לכל דבר, וכפופה לחוק הגנת הפרטיות ול-GDPR כמו כל תוכן אחר.

האם צריך לנקות metadata גם כשמדביקים רק טקסט?

הדבקת טקסט נקי מעבירה הרבה פחות מהעלאת קובץ — אבל הטקסט עצמו עדיין עשוי להכיל מזהים. הבטוח ביותר: לנקות את המסמך כולו, טקסט ו-metadata, ואז לשתף.