אנתרופיק חושפת: כיצד קלוד מוכיח שהטקסט שלו אמיתי
סימני מימי בטקסט AI, זה המדע שמאחורי הגילוי. אנתרופיק חושפת איך קלוד מוטמע בתוך כל טקסט סימנים שלא נראים אבל קיימים, ואיך הם עוזרים לאתר תוכן מזויף.
סימני מימי בטקסט AI, זה המדע שמאחורי הגילוי. אנתרופיק חושפת איך קלוד מוטמע בתוך כל טקסט סימנים שלא נראים אבל קיימים, ואיך הם עוזרים לאתר תוכן מזויף.
סימן מימי (watermark) בטקסט הוא מידע שנוסף לתוך הטקסט בצורה סטטיסטית כה קטנה שהקורא לא שם לב, כמו בחירת מילים ספציפיות או סדר פסקאות שונה באופן זעום. כשמשהו מסרקן טקסט עם הכלי של אנתרופיק, הוא מוצא את הדפוס הזה ויודע שזה קלוד.
קשה מאוד. אנתרופיק אומרת שהסימנים עמידים אפילו כשמעדכנים את הטקסט, מתרגמים או משנים את הניסוח. אבל אם תשכתבו את הכל מחדש או תזרקו קטעים גדולים, יכול להיות שהסימן יתרקק. זו לא החריקה.
לא. סימני המימי של אנתרופיק לא מוטמעים בקוד, רק בטקסט חופשי. קוד שנוצר על ידי קלוד עובד בדיוק כמו קוד כל שהוא, בלי השפעה כלשהי.
הידעת?
סימני המימי של אנתרופיק אינם נראים לעין בלולא, אך הם עמידים אפילו כשמערערים את הטקסט, תרגום, עריכה, ונסיגה, וזה הופך אותם לכלי יעיל למיוחד לעסקים שחוששים מתוכן מזויף.
לפני שבועות ספורים, אנתרופיק (Anthropic) פרסמה כי היא משתמשת בטכנולוגיית סימני מימי (watermarks) בטקסט שנוצר על ידי קלוד (Claude), כלי לזיהוי תוכן מלאכותי. כעת החברה חשפה מה זה בדיוק, כיצד הוא עובד ומדוע זה חשוב לעסקים בישראל.
סימן המימי של אנתרופיק אינו סימן דיגיטלי גדול המופיע על המסך. זה משהו הרבה יותר עדין: סטטיסטי ובלתי נראה. קלוד בוחר מילים, סדר פסקאות או דפוסי שפה בדרך שמשתמש רגיל לא יבחין בה, אבל כלי זיהוי של אנתרופיק יכול לתפוס זאת.
כשמבקשים מקלוד לכתוב מסמך או מאמר, הוא אינו רק יוצר תוכן, אלא משתמש באלגוריתם שקובע מה הוא יגיד ובאיזה סדר. האלגוריתם הזה מוטמע בטקסט בצורה כל כך עדינה שהיא בלתי מורגשת לעין או לאוזן.
כשמנתח זיהוי של אנתרופיק סורק את הטקסט, הוא מחזיר דוח סטטיסטי ואומר: "זה קלוד. סיכוי של 95% או יותר."
מה שמעניין במיוחד היא העמידות. אנתרופיק טוענת שהסימן המימי שלה עומד מול:
זה אינו מושלם. אם תשכתבו את כל הטקסט מחדש או תסירו 70% ממנו, הסימן יתמעמע. אבל עבור עורכי תוכן שמנסים להסתיר את מקורו, זה משמעותי.
בישראל, שלושה סוגי עסקים צריכים לשים לב:
סוכנויות פרסום ומודיעים משתמשים ב-AI ליצירת תוכן בכמויות גדולות. סימני המימי הללו עוזרים להם לוודא האם מתחרה "העתיק" תוכן באמצעות קלוד או כתבו משלהם. זה כלי חוקי לתביעות זכויות יוצרים.
סטארטאפ ישראלי המשתמש בקלוד לעבודה פנימית (דוחות, בדיקת קוד, ניתוח) יכול להשתמש בכלי זה לאימות: האם הטקסט שהגיע מעובד מסוים נכתב באמת על ידי קלוד, או הוא כתבו ידנית? זה חשוב במריבות פנים על קרדיט או בדיקת ביצוע עבודה.
כשמטלות סטודנטים וטענות משפטיות כתובות על ידי AI, כלי זה הופך לעדות. זיהוי של סימן מימי של אנתרופיק במטלה או בתזה היא כמעט הוכחה שקלוד כתב את זה (או חלק ממנו).
סימני מימי לא מוטמעים בקוד שנוצר על ידי קלוד. אם אנתרופיק הכניסה סימנים שונים ללולאות או משתנים, הקוד היה מתקלקל.
לכן קלוד משתמש בסימנים בטקסט חופשי בלבד: מאמרים, דוחות, מיילים וטענות משפטיות. קוד נשאר קוד.
תוכן מזויף הולך וגדל. מדיניות של מפרסמים ומנועי חיפוש דורשת כעת היכולת להוכיח אם משהו נכתב על ידי AI. חוקי בינה מלאכותית בעולם (כולל הנורמות בישראל) מתחילים לדרוש שקיפות בנושא.
אנתרופיק הבהירה שהכלי שלהם חינם ופתוח לכל אחד, ללא צורך בכרטיס אשראי. זה חלק מהמדיניות שלהם להיות שקופים בנושא זיהוי AI.
אם אתם משתמשים בקלוד לתוכן ציבורי (חדשות, מאמרים, מדריכים): התחשבו בסימנים הללו כחלק מתהליך האימות שלכם.
אם אתם עורכי דין או בעסק שבו אימות קשור לעבודה: דעו על כלי זה בעת חקירה של טענות זויפות.
אין צורך לדאוג: סימנים אלו לא משפיעים על איכות הטקסט או הקוד שלכם, והם שקופים לחלוטין למשתמש הסופי.
סימני המימי של אנתרופיק הם צעד נוסף בכיוון של שקיפות בעידן AI. הם לא מושלמים ויכול לעקוף אותם בעורך או בשכתוב מוחלט, אבל הם עושים את העבודה: עוזרים לזהות תוכן AI בהצלחה. בעולם שבו תוכן מזויף הוא בעיה גוברת, זה כלי בעל ערך.
בעידן של תוכן AI מזויף וחדשות כוזבות, כלי זה עוזר לבדוק אם מסמך או מאמר שהגיע אליכם בחדשות או ממתחרה בא מ-AI. זה מגן על אמינות וגם על זכויות יוצרים.