CodeariaAcademy
כריכת המאמר: יומן פתוח עם סימנייה בצורת דגל והכיתוב צ'אט עם Claude הוא לא יומן
6 אוקטובר 202611 דק׳ קריאהClaude Codeסוכני AI

ביטול האימון לא מסתיר את הצ'אט מעיני הבודק. מה אדם ב-Anthropic רואה ב-Claude, ומתי השיחה מגיעה למשטרה?

האם Anthropic קוראת את הצ'אטים שלכם עם Claude? שיחה מסומנת נשמרת עד שנתיים גם אם ביטלתם את האימון, והרף למסירת השיחה למשטרה נמוך ממה שמדווח בתקשורת.

במאמר הזה6
בקצרה

Anthropic יכולה לקרוא את הצ'אט שלכם עם Claude ולמסור אותו למשטרה, ומדיניות הפרטיות מ-10 בספטמבר 2026 מתירה זאת במפורש: חשיפה מותרת אם החברה סבורה בתום לב שהיא נחוצה באופן סביר כדי למנוע נזק חמור לאדם או לרכוש. המסלול נראה כך: מערכות אוטומטיות מסמנות שיחה, מקרים חמורים עוברים לצוות בודקים אנושיים, ובודק מחליט אם לפנות למשטרה. כך קרה ב-26 בספטמבר עם תושבת פלורידה שכתבה שהיא "תירה" במשרד השריף: ב-30 בספטמבר הוגש נגדה כתב אישום לפי סעיף 836.10. צ'אט מסומן נשמר עד שנתיים, ציוני המסווגים עד 7 שנים, וביטול האימון לא משנה את זה. מחיקה מסירה צ'אט רגיל מהשרתים תוך 30 יום, צ'אט מסומן נשאר. כמה פעמים Anthropic עצמה פנתה למשטרה, לא ידוע בפומבי: הדוח של החברה סופר רק בקשות נכנסות מהרשויות.

ביטול האימון ב-Claude מכבה פעולה אחת, לא את כולן. הוא אוסר לאמן מודלים על השיחות שלכם. הוא לא אוסר על מערכת אוטומטית לבדוק שיחה, על אדם לקרוא אותה, ועל החברה לשמור אותה שנתיים אם היא סומנה. כל זה כתוב במדיניות הפרטיות של Anthropic ובמאמר העזרה על שמירת נתונים.

הסיבה לפתוח את המסמכים האלה הגיעה מפלורידה. אישה שלדבריה השתמשה ב-Claude כיומן כתבה בו איום, ועובד של Anthropic קרא את הרשומה. בהמשך נעבור על המקורות הראשוניים: מה קורה להודעה שאתם שולחים ל-Claude, אילו הגדרות משפיעות על מה, ומה חסר במסמכים הפומביים.

מה קרה בפלורידה ומאיפה אנחנו יודעים

פרטים מ-Anthropic אין: החברה לא הגיבה על המקרה. כל מה שידוע מגיע מדוח המעצר כפי שסיכם אותו ערוץ החדשות המקומי WINK News, ומרישומי בית המשפט של המחוז שבדק Tom's Hardware.

ב-26 בספטמבר משתמשת שהדוח מכנה "Carli" כתבה ל-Claude שהיא מתכננת "shoot up" את משרד השריף של מחוז לי. למחרת אותו חשבון כתב שיש לה אקדח חדש. לפי הדוח, הפלטפורמה של Anthropic עוקבת אחר ביטויי מפתח ותוכן מאיים, ובגלל חומרת הרשומות הן הועברו לצוות בדיקה ידנית. הצוות פנה למשטרה.

סגני השריף זיהו את קרלי מישל הלר מבוניטה ספרינגס ועצרו אותה בביתה ללא תקריות. לשריף כרמין מרסנו היא אמרה שהיא משתמשת בבינה מלאכותית "כמו ביומן". ב-30 בספטמבר נרשם בבית המשפט אישום לפי סעיף 836.10 לחוקי פלורידה: איום בכתב או באמצעי אלקטרוני בירי המוני או בפיגוע, עבירה מסוג felony בדרגה שנייה. הקראת כתב האישום נקבעה ל-2 בנובמבר.

לעורכי דין יש כאן שורה מעניינת אחת. סעיף 836.10 דורש שהאיום יישלח או יפורסם כך שאדם אחר יוכל לראות אותו. Tom's Hardware משער ששיחה עם מודל שבודק קורא עונה על ההגדרה הזו. בית המשפט יכריע.

Never truly anonymous.
כרמין מרסנו, השריף של מחוז לי · כך תיאר השריף את משתמשי פלטפורמות הבינה המלאכותית בשיחה עם WINK News, 30 בספטמבר 2026

זה לא המקרה הראשון. Tom's Hardware מונה לפחות שלוש שיחות עם צ'טבוטים שהגיעו למשטרה מאז אוגוסט. בסן אנטוניו ב-11 באוגוסט מישהו שאל "צ'אט AI של Anthropic" על ירי בבית ספר יסודי סמוך, ה-FBI התריע בפני המשטרה, וגבר בן 22 נעצר. ב-14 באוגוסט בסן פרנסיסקו משתמש כתב ל-Claude שקנה AR-15 ואיים על דריו אמודיי. Anthropic הודיעה למשטרה, אבל לא היו מעצר ואישום.

איך צ'אט מסומן מגיע לאדם ב-Anthropic

מהמסמכים של Anthropic ומדוח המעצר המסלול מסתכם בארבעה שלבים. החברה לא מפרסמת ספים וקריטריונים, ולכן להלן רק מה שכתוב.

  1. 1

    מסווגים

    מערכות trust and safety אוטומטיות בודקות שיחות לאיתור הפרות של ה-Usage Policy. לפי דוח המעצר, הן מחפשות ביטויי מפתח ותוכן מאיים.

  2. 2

    סימון

    צ'אט מסומן נשמר עד שנתיים, ציוני המסווגים עד 7 שנים. הוא משמש לאימון מודלי בטיחות גם אם ביטלתם את האימון.

  3. 3

    אדם

    מקרים חמורים עוברים לצוות בדיקה ידנית. זה עולה מדוח המעצר; במסמכים של Anthropic אין תיאור נפרד.

  4. 4

    החלטה על חשיפה

    אם הבודק רואה באיום איום אמיתי, החברה רשאית למסור נתונים לרשויות לפי סעיף המדיניות על מניעת נזק חמור.

בשלב השני יש הסתייגות. המדיניות אומרת שתוכן מסומן מנותק מה-user ID שלכם ומשמש לאימון מסווגים פנימיים. נשמע כמו התממה. המשפט הבא באותה מדיניות: Anthropic רשאית לזהות מחדש את הקלטים והפלטים האלה כדי לאכוף את ה-Terms of Service או את ה-Usage Policy על המשתמש האחראי. ההתממה כאן משרתת את האימון, לא את ההגנה מפני תוצאות.

זה הזמן ש-Anthropic שומרת את ציוני מסווגי ה-trust and safety על צ'אט מסומן. הקלטים והפלטים עצמם נשמרים עד שנתיים

Anthropic Privacy Center, "How long do you store my data?", עודכן ב-1 ביולי 2026

מה משנים ביטול האימון, מחיקה ומצב גלישה בסתר

הכללים שלהלן חלים על המסלולים הצרכניים Free,‏ Pro ו-Max, כולל Claude Code בחשבונות האלה: מאמר העזרה של Anthropic על שמירת נתונים נכתב בדיוק עבורם. ב-API ובמסלולים הארגוניים התקופות שונות, למעט כלל אחד שנפרט אחרי הטבלה.

צ'אט רגילצ'אט מסומן
ביטול האימוןלא משמש לאימון מודליםעדיין משמש לאימון מודלי בטיחות
מחיקהמההיסטוריה מיד, מהשרתים תוך 30 יוםנשמר עד שנתיים, ציונים עד 7 שנים
Incognitoלא בהיסטוריה ובזיכרון, לא באימון, נשמר 30 יוםמאמר העזרה לא אומר
אימון מופעלמותמם, עד 5 שנים בצינורות האימוןעד שנתיים ועוד ציונים עד 7 שנים

על מצב incognito ניסחנו בזהירות. מאמר העזרה מבטיח שצ'אטים במצב הזה לא נכנסים להיסטוריה, לזיכרון ולאימון, ושהם נשמרים 30 יום. על בדיקת מסווגים אין בו מילה, לא "כן" ולא "לא". אנחנו לא היינו רואים ב-incognito הגנה מפני בדיקה: 30 יום על השרתים הם בדיוק החלון שבו האוטומציה פועלת.

הכלל שחל על כל המסלולים מופיע בתיעוד ה-API. גם עם Zero Data Retention ו-HIPAA, צ'אט או סשן מסומן נשמר עד שנתיים. אם המוצר שלכם רץ על ה-API והלקוחות כותבים לו כל מה שעולה בדעתם, זה נוגע גם לכם: ZDR לא מכבה את ה-trust and safety.

למי שעובד ב-Claude Code, המסקנה פשוטה. הסוכן קורא את הקבצים, הלוגים וכל שיחה שאתם מדביקים לו, וכל זה חלק מהסשן. הכללים של Anthropic לא נוגעים במה שלא יוצא מהמחשב שלכם, למשל הזיכרון של claude-mem במסד SQLite מקומי. כל מה שעבר למודל בענן חי לפי הכללים שבטבלה.

מתי Anthropic יכולה למסור שיחה למשטרה

כאן הסיכומים בתקשורת והמקור הראשוני נפרדים, וזה הדבר העיקרי שמצאנו.

TechSpot כותב ש-Anthropic משתפת נתוני משתמש במקרי חירום מוגבלים, אם היא סבורה שהחשיפה נחוצה כדי למנוע מוות או פגיעה גופנית חמורה. הניסוח אמיתי, אבל הוא לקוח מהדוח על בקשות רשויות. שם הוא מתאר "בקשות חירום": המשטרה עצמה פונה ל-Anthropic ומבקשת נתונים בלי צו.

לחשיפה ביוזמתה, יש ל-Anthropic בסיס פומבי אחד: מדיניות הפרטיות. ושם הרף נמוך יותר. החשיפה מותרת אם לחברה יש אמונה בתום לב שהיא נחוצה באופן סביר כדי "prevent serious harm to any person or to property". נזק חמור לאדם או לרכוש. לא מוות, לא פגיעה קשה. גם רכוש. באותו סעיף מופיעות עוד שתי עילות: איתור או מניעה של הונאה ופעילות בלתי חוקית אחרת, והגנה על הזכויות, הרכוש והבטיחות של Anthropic עצמה, של המשתמשים שלה ושל אחרים.

שני תקנים בשני מסמכים

הדוח על בקשות רשויות: חשיפה לפי בקשת חירום של המשטרה, כדי למנוע איום של מוות או פגיעה גופנית חמורה. מדיניות הפרטיות מ-10 בספטמבר 2026: חשיפה ביוזמת Anthropic, כדי למנוע נזק חמור לאדם או לרכוש, וגם הונאה ופעילות בלתי חוקית אחרת. במקרה בפלורידה המשטרה לא ביקשה דבר: Anthropic פנתה ראשונה.

להשוואה, OpenAI תיארה את הנוהל שלה בפומבי באוגוסט 2025. שיחות שבהן משתמש מתכנן לפגוע באחרים עוברות לצוות קטן שהוכשר על מדיניות השימוש. אם הצוות רואה איום מיידי בפגיעה גופנית חמורה באחרים, OpenAI עשויה להעביר את המקרה לרשויות האכיפה. מקרים של פגיעה עצמית OpenAI לא מעבירה למשטרה, ומסבירה זאת באופי הפרטי של השיחות. אצל Anthropic לא מצאנו טקסט כזה בגישה פתוחה, גם לא על פגיעה עצמית.

מה אף אחד מלבד Anthropic לא יודע

הדוח על בקשות רשויות ליולי–דצמבר 2025 נראה מרגיע. 2 בקשות לתוכן שיחות על 8 חשבונות, נתונים נמסרו בשתיהן. 20 בקשות לנתוני חשבון כמו שם ודוא"ל על 55 חשבונות, נתונים נמסרו ב-7. אפס בקשות חירום.

המקרה מפלורידה לא ייכנס לטבלה כזו, גם לא בדוח של 2026. מעצם הגדרתו הדוח סופר בקשות שהגיעו ל-Anthropic. מקרים שבהם Anthropic עצמה פונה למשטרה לא נספרים בו בכלל. Tom's Hardware הצביע על כך, ואנחנו בדקנו מול ה-PDF: שורה כזו אין. כמה שיחות בשנה המסווגים שולחים לבני אדם, וכמה מהן מגיעות למשטרה, לא ידוע בפומבי.

עוד דבר שחסר במסמכים הוא התחייבות להודיע. Anthropic כותבת שהיא מודיעה למשתמשים על בקשות רשויות, למעט כשהחוק אוסר זאת ובמצבי חירום עם איום מיידי בנזק חמור. על הפניות שלה עצמה למשטרה אין התחייבות להודיע.

מה לכתוב ל-Claude ומה לא

הדעה שלנו, ואפשר להתווכח איתה: הסיפור הזה לא עוסק במעקב, אלא בכך שרבים לא קראו את התנאים. מודל שעונה כמו בן שיח קל לבלבל עם יומן. אבל ליומן אין מסווגים, אין שמירה לשנתיים ואין עובד שמחליט מה בו רציני. אנחנו טועים אם Anthropic תפרסם את הספים ואת הסטטיסטיקה של הבדיקות וההפניות למשטרה: אז זה יהפוך לנוהל ברור ולא לקופסה שחורה.

בפועל, לא הרבה נובע מזה:

  1. צ'אט עם Claude הוא לא רשומות אישיות. כל מה שלא הייתם כותבים במסנג'ר בעבודה, שבו מנהל יכול לפתוח את ההיסטוריה, לא כדאי לכתוב גם כאן. איומים, גם בצחוק או ברגע של כעס, על אחת כמה וכמה.
  2. ביטול האימון הוא לא פרטיות. הוא עוסק באימון מודלים, לא בשמירה ובבדיקה. בדקו את ההגדרה בכל זאת, אבל אל תסמכו עליה כהגנה.
  3. אל תכניסו נתונים אישיים של אחרים למודל בענן. מאגרי לקוחות, התכתבויות, מסמכים. לגבי סוכנים זה אומר: לא לתת ל-Claude Code לקרוא מה שלא שייך לשרתים של מישהו אחר. איך ספק עוקב אחרי הסוכנים שלו עצמו ואיפה הניטור שלו טועה, אפשר לראות בניתוח שלנו על סוכן של OpenAI שברח מארגז החול.
  4. אם אתם בונים מוצר על ה-API, כתבו זאת במדיניות שלכם. המשתמשים שלכם כותבים למודל דרככם, והכלל על בקשות מסומנות ו-ZDR חל גם עליהם.

גרסאות המסמכים נכון ל-6 באוקטובר 2026

מדיניות הפרטיות של Anthropic בנוסח מ-10 בספטמבר 2026, מאמר העזרה על תקופות שמירה מ-1 ביולי 2026, הדוח על בקשות רשויות ליולי–דצמבר 2025. פרטי המקרה בפלורידה לפי דוח המעצר כפי שסיכמו אותו WINK News ו-Tom's Hardware; Anthropic לא הגיבה. מדיניות משתנה, בדקו את הנוסחים העדכניים לפני שאתם מחליטים.

מקורות11להרחיב
  1. Anthropic, "Privacy Policy", בתוקף מ-10 בספטמבר 2026, נבדק ב-6 באוקטובר 2026 — https://www.anthropic.com/legal/privacy
  2. Anthropic Privacy Center, "How long do you store my data?", 1 ביולי 2026 — https://privacy.claude.com/en/articles/10023548-how-long-do-you-store-my-data
  3. Anthropic Privacy Center, "What is Anthropic's policy for handling governmental requests for user information?", 16 במרץ 2026 — https://privacy.claude.com/en/articles/9519291-what-is-anthropic-s-policy-for-handling-governmental-requests-for-user-information
  4. Anthropic, "Government Requests Report", יולי–דצמבר 2025 — https://www-cdn.anthropic.com/5d453bc3285b8e0c101b7193b5765419920cee24.pdf
  5. Claude Docs, "API and data retention", נבדק ב-6 באוקטובר 2026 — https://platform.claude.com/docs/en/manage-claude/api-and-data-retention
  6. Claude Help Center, "Use incognito chats", נבדק ב-6 באוקטובר 2026 — https://support.claude.com/en/articles/12260368-use-incognito-chats
  7. Damien Alvarado, WINK News, "Woman arrested after AI threat against Lee County Sheriff's Office: Investigators", 30 בספטמבר 2026 — https://www.winknews.com/news/woman-arrested-after-ai-threat-against-lee-county-sheriffs-office-investigators/article_3d4c5915-7015-43c0-b86a-d7fa5eadf958.html
  8. Shane Downing, Tom's Hardware, "Anthropic reports Florida woman's Claude diary threat to shoot up sheriff's office", 5 באוקטובר 2026 — https://www.tomshardware.com/tech-industry/artificial-intelligence/anthropic-reports-florida-womans-claude-diary-threat-to-shoot-up-sheriffs-office-felony-charge-follows-its-at-least-the-third-such-conversation-to-reach-police-since-august
  9. Rob Thubron, TechSpot, "Florida woman used Claude as a diary, then Anthropic reported an entry to police", 4 באוקטובר 2026 — https://www.techspot.com/news/114091-florida-woman-used-claude-diary-anthropic-reported-shoot.html
  10. Florida Statutes, § 836.10, נבדק ב-6 באוקטובר 2026 — http://www.leg.state.fl.us/statutes/index.cfm?App_mode=Display_Statute&URL=0800-0899/0836/Sections/0836.10.html
  11. OpenAI, "Helping people when they need it most", אוגוסט 2025, ציטוטים דרך Futurism, 27 באוגוסט 2025 — https://www.yahoo.com/news/articles/openai-says-scanning-users-conversations-210511235.html

תגובות