- אנתרופיק ו-OpenAI מציעות להטמיע מעריכי בטיחות בלתי תלויים בתוך המעבדות שלהן. חוקרים בפני דילמה: גישה חסרת תקדים לעומת חשדות על עצמאות וממשל.
חוקרים טוענים שגישה אמיתית לתוכן מעבדות AI היא חסרת תקדים בתעשייה, אך בדיוק זה מעלה שאלות על כמה 'בלתי תלוי' יכול להיות מעריך כשהוא עובד בשרידי החברה שהוא אמור לשגר.
מעריכי בטיחות פנימיים: חדשנות או הסוואה?
אנתרופיק (Anthropic) ו-OpenAI הודיעו כי הן רוצות להטמיע צוותי בטיחות בתוך המעבדות שלהן. הרעיון פשוט: במקום להמתין לביקורת חיצונית לאחר ההשקה, מעריכים יעקבו אחרי התפתחות המודלים בזמן אמת ויזהירו על בעיות בטיחות בשלב מוקדם.
זהו מהלך כמעט חסר תקדים בתעשייה. אך חוקרים ומרכזי מדיניות כבר שואלים שאלה קריטית אחת: האם מעריך שעובד בתוך החברה באמת בלתי תלוי?
איך בדיוק זה צריך לעבוד
התוכנית מעניינת: צוותי בטיחות פנימיים יקבלו גישה לכל דבר, נתונים, הנחיות, תהליכי ניסיון. הם לא יחכו לדוח סוף־שנה; הם יעקבו ויתערבו בזמן אמת. עבור OpenAI ואנתרופיק, זה אומר שהן יכולות לטפל בבעיות טרם הן הופכות לבעיות ציבוריות.
וחוקרים מודים: התוכנית היא, בעיקרון, טובה. "הגישה המקדימה חשובה", אומרים כמה. "זה יוצר הזדמנות שלא היתה לנו בעבר."
הבעיה: עצמאות בפועל או אשליה?
אך הנקודה השנייה של הטענה מעבירה לעומק. מעריכים שעובדים בתוך המעבדה, גם אם יש להם כותב עצמאות פורמלי, תעודה, קשר עם גורם רגולטורי, מה שלא יהיה, עלולים להיות כפופים ללחצים מובנים:
- לחץ תרבותי: אם הכל סביבך אומר שהמודל גדול וטוב, קל להטות מצפיות.
- לחץ כלכלי: החברה משלמת את המשכורת שלך; האם זה באמת לא משנה?
- צפיפות מידע: מעריך חיצוני לא רואה את השיחות בחדרים, את ההערות השוליות של המנהלים. מעריך פנימי? הוא רואה.
חוקרים טוענים שללא שקיפות מלאה בפומביום, וללא יכולת של עיתונאים או חוקרים לראות את דוחות הבטיחות, "בלתי תלוי" יהיה קיצור יד להיות "כפוף לחברה בדרכים קשות יותר למדוד".
מה זה אומר לעסק הישראלי?
לעסקים בישראל שמכניסים בינה מלאכותית, הנושא הזה משנה יותר ממה שנראה:
בטיחות היא עתה חלק מהמשחק הכלכלי. אם אתה משתמש בקלוד או ב-GPT או בכל מודל, אתה מסתמך על כך שהבטיחות שלו קיימת. אם הבטיחות היא "מעריכה בלתי תלויה" שעובדת למי שהיא אמורה לשגר, הסיכון שלך גדל.
חברות ישראליות צריכות לדעת: אם אתם משתמשים ב-AI לנתונים רגישים (פיננסיים, בריאות, מידע אישי), הערכות הבטיחות צריכות להיות שקופות וחיצוניות, לא רק "מעריכים שעובדים בפנים ובאים בהוד על הטלפון כשיש בעיה."
צרו שירות בדיקות חיצוני או דרשו דוח בטיחות מפורש מכל ספק AI שבו אתם בוחרים, במיוחד אם הוא מודל פנימי או מותאם.
מה הצד המחויב להגיד?
אנתרופיק טוענת שהיא כבר משוחחת עם רגולטורים ועם חוקרי בטיחות לעיצוב התוכנית כך שעצמאות תהיה אמיתית. OpenAI באותה נימה: שקיפות, הרשאות מוקדימות, דיווח סטנדרטי.
אך עד שלא יהיה דוח ציבורי מפורש, דוח שלא כתבה החברה, שלא יכלו החברה לערוך לפני פרסום, שלא ניתן לעדכן, זה נשמע יותר כמו ביטחון מילולי מאשר בטיחות מעשית.
שורה תחתונה
הרעיון טוב. הביצוע? עדיין פתוח. אנתרופיק ו-OpenAI נמצאות בחזית של חידוש בטיחות בינה מלאכותית. אך עצמאות אמיתית זקוקה לשקיפות חיצונית, לא להבטחות פנימיות.
קורס במתנה עם ברכה אישית מכם, מסירה מיידית או בתאריך שתבחרו, וגישה לכל החיים.


