מופעל ע"י
Featured

מנכ"ל Bitgo מממן ארנק עם 100 BTC, ומאתגר את ה-AI של Anthropic לגנוב אותם

מנכ”ל Bitgo מייק בלשה הפך את אחד הוויכוחים הגדולים ביותר סביב אבטחת הבינה המלאכותית לאתגר ביטקוין פומבי, כאשר הפקיד 100 BTC, בשווי של כ־6.3 מיליון דולר באותה עת, בארנק שכתובתו ידועה לציבור והזמין את מודלי Claude של Anthropic לגנוב אותם. המהלך הגיע בעקבות חשיפת Anthropic שלפיה כמה ממודלי ה־AI שלה הגיעו לאינטרנט הפתוח וקיימו אינטראקציה עם מערכות ייצור אמיתיות במהלך הערכות אבטחת סייבר.

נכתב ע"י
שתף
מנכ"ל Bitgo מממן ארנק עם 100 BTC, ומאתגר את ה-AI של Anthropic לגנוב אותם

נקודות עיקריות

  • Bitgo מימנה 100 BTC ב־1 באוגוסט כדי לאתגר את מודלי Claude של Anthropic.
  • Anthropic מצאה 3 כשלי הערכת AI מתוך 141,006 הרצות אבטחת סייבר.
  • 100 ה־BTC של Bitgo נותרו ללא מגע נכון ל־2 באוגוסט, בעוד Anthropic שמרה על שתיקה.

מנכ”ל Bitgo דוחף חזרה לאחר חשיפת ה־AI של Anthropic

האתגר החל ב־1 באוגוסט כאשר בלשה הגיב ישירות להודעתה של Anthropic שתיארה שלושה אירועים שנחשפו במהלך בדיקות אבטחת סייבר. Anthropic הסבירה שמספר מודלי Claude הגיעו שלא בכוונה לאינטרנט הציבורי לאחר שסביבות ההערכה חוברו בטעות לרשת, במקום להישאר מבודדות.

במקום להתייחס לממצאים כהוכחה ליכולת AI “בורחת משליטה”, בלשה התמקד בתצורת מערך הבדיקות עצמו. תקריות כאלה מצביעות בדרך כלל על כשלי קונפיגורציה ולא על פריצות דרך טכניות בלתי אפשריות, במיוחד כאשר מערכות הערכה חשופות לתשתית חיה. כדי להפוך את הטענה למדידה, הוא מימן כתובת ביטקוין עם בדיוק 100 BTC ואתגר את Claude להעביר את המטבעות.

Bitcoin address screenshot.
תמונה של כתובת הביטקוין שבלשה שיתף ב־X.

הארנק קיבל את הכספים ב־31 ביולי, ורישומי הבלוקצ’יין עדיין הראו שהיתרה המלאה לא נגעה בה נכון ל־2 באוגוסט.

Anthropic מפרטת שלושה אירועי אבטחה מן העולם האמיתי

הדוח של Anthropic תיאר שלושה אירועי הערכת אבטחת סייבר נפרדים שזוהו לאחר סקירה של יותר מ־141,000 הרצות בדיקה. החברה אמרה ששש סשנים של הערכה בשלושה מודלים קיימו במפתיע אינטראקציה עם ארגונים אמיתיים לאחר שאי־הבנה הותירה את סביבות הבדיקה מחוברות לאינטרנט.

המודלים המעורבים כללו את Claude Opus 4.7, את Claude Mythos 5, וכן מודל מחקר פנימי שטרם פורסם. לכל אחד הוקצו תרגילי “Capture the Flag” שנועדו לאתר מידע מוסתר בתוך מערכות מחשב בדיוניות. אף שהפרומפטים של Anthropic ציינו שהמודלים פועלים בתוך סימולציות מבודדות ללא גישה לאינטרנט, הסביבות היו למעשה מקוונות בגלל טעות קונפיגורציה שבה היה מעורב שותף בדיקות צד שלישי בשם Irregular.

Claude ניצל מערכות אמיתיות בעודו סבור שמדובר באימון

Anthropic תיארה את המקרה החמור ביותר ככזה שכלל את Claude Opus 4.7. לאחר שנכשל בהשלמת המשימה הבדיונית שלו, המודל מצא אתר אמיתי הנושא את אותו שם כמו החברה המדומה. לאחר מכן הוא ניצל סיסמאות חלשות ושירותים חשופים, שחזר אישורי גישה לתשתיות, וניגש למסד נתונים ייצור שהכיל כמה מאות רשומות.

החברה אמרה שהמודל המשיך גם לאחר שזיהה שהסביבה עשויה להיות אמיתית, משום שהסיק שהמערכות האמיתיות כנראה עדיין חלק מההערכה. כל מי שעבד בבדיקות חדירה יודע שסוג כזה של בלבול נעשה סביר הרבה יותר כאשר גבולות הבדיקה אינם ברורים — ולכן סביבות מבודדות כראוי חשובות לא פחות מהתוכנה הנבחנת. Anthropic הדגישה שה־AI ניסה להשלים את המשימה שהוקצתה לו, ולא ניסה במכוון לברוח מהכליאה או לרדוף מטרות עצמאיות.

עיצוב המשמורת של Bitgo מעלה את רף ההימור

האתגר של בלשה חורג בהרבה מהשאלה האם AI יכול לנצל סיסמאות חלשות או שרתים שהוגדרו בצורה לקויה. הביטקוין יושב בתוך פלטפורמת המשמורת המוסדית של Bitgo, הנשענת על טכנולוגיית רב־חתימה או חישוב רב־צדדי (MPC) שמפזרת את סמכות החתימה על פני מספר מפתחות עצמאיים, במקום להסתמך על נקודת כשל יחידה.

Bitcoin address transfer screenshot
נתוני העברת הכתובת שבלשה שיתף מציגים כי יושמה רב־חתימה.

מערכות שנבנות כך מתוכננות כך ששום חולשה יחידה אינה מספיקה כדי להזיז כספים. תוקף יצטרך לעקוף ניהול מפתחות, מדיניות אישורים, הגנות חומרה ובקרות תפעוליות בסדר הנכון — מה שהופך את הבעיה לשונה מהותית מניצול סביבת בדיקה חשופה. לפי דוח המקור, פגיעה במערכת כזו תדרוש תקיפה של כמה שכבות עצמאיות במקביל.

הבלוקצ’יין יספק את התשובה הסופית

בניגוד לטענות רבות בתחום אבטחת הסייבר שנשארות חבויות מאחורי חקירות חסויות, הניסוי הזה פומבי לחלוטין. כל אחד יכול לעקוב אחר הארנק בבלוקצ’יין של ביטקוין ולראות מיד אם המטבעות זזים אי פעם.

האתגר גם ממשיך את הביקורת הרחבה יותר של בלשה על נרטיבים סנסציוניים סביב אבטחת AI. מוקדם יותר ב־2026 הוא חלק על פרשנויות נפוצות שלפיהן מודל של Anthropic פרץ באופן עצמאי למערכות מסווגות של הסוכנות לביטחון לאומי (NSA), וטען שהדיווחים הציגו בצורה שגויה תרגיל פנימי מורשה ולא פשרה חיצונית אמיתית. האתגר האחרון שלו ממשיך באותו דפוס, כאשר הוא מחליף ויכוחים היפותטיים במבחן שקוף ובר־מדידה.

הוויכוח כעת חורג מעבר לבינה מלאכותית

הפרשה מדגישה פער הולך וגדל בין הדגמות המתבצעות בתוך סביבות מחקר מבוקרות לבין מתקפות על מערכות ייצור שנועדו לעמוד בפני יריבים מתוחכמים.

עבור תעשיית הקריפטו, האתגר משמש גם כהדגמה פומבית של ארכיטקטורת משמורת מוסדית. גניבה מוצלחת תעלה מיד שאלות הן לגבי יכולות ה־AI והן לגבי אחסון ביטקוין ברמת אבטחה גבוהה. אם הארנק יישאר ללא שינוי, תומכים יטענו ככל הנראה שזה מחזק את ההבדל בין ניצול סביבות בדיקה שהוגדרו בצורה שגויה לבין הבסת מערכות משמורת ארגוניות ברמת Enterprise.

האתגר של בכיר Bitgo מגיע בעת שניצול Coldcard האחרון ממשיך להתפתח, כאשר סך ההפסדים הגיע ל־1,431.97 BTC נכון לשעה 20:00 שעון המזרח ביום ראשון. מקרה Coldcard גם הזין ספקולציות האם הפריצה נבעה בסופו של דבר מטעות אנוש, תקלות תפעוליות, או סיבה אחרת לחלוטין — כולל האם ל־AI היה תפקיד כלשהו בגילוי פגיעות הקושחה.

כעת תשומת הלב מופנית ל־Anthropic ולארנק

נכון ל־2 באוגוסט, Anthropic לא הגיבה בפומבי לאתגר הספציפי של בלשה, ו־100 ה־BTC נותרו בכתובת שפורסמה ללא כל עסקאות יוצאות. בכך הבלוקצ’יין משמש כלוח תוצאות אובייקטיבי, בעוד תעשיית הטכנולוגיה הרחבה מתווכחת מה בדיוק הוכיחו התקריות.

ההתפתחויות הבאות צפויות להגיע מניתוח טכני נוסף של סביבות ההערכה של Anthropic, מכל תגובה של החברה לגבי האתגר, או מתזוזה של הביטקוין עצמו. עד אז, ההימור של בלשה הפך דיון מורכב על בטיחות AI לשאלה פשוטה עם תשובה שניתנת לאימות פומבי: האם ה־AI של היום יכול להביס את מערכות המשמורת המוסדיות של תעשיית הקריפטו?

מאמר זה תורגם מאנגלית באמצעות בינה מלאכותית. הגרסה המקורית באנגלית היא המקור הקובע; תרגומים אוטומטיים עשויים להכיל אי-דיוקים, במיוחד במונחים משפטיים ורגולטוריים.