สนับสนุนโดย
Featured

ซีอีโอของ Bitgo เติมเงินให้กระเป๋าเงิน 100 BTC ท้าให้เอไอของ Anthropic ขโมยมันออกไป

ไมค์ เบลเช่ ประธานเจ้าหน้าที่บริหารของ Bitgo ได้เปลี่ยนหนึ่งในประเด็นถกเถียงด้านความปลอดภัยที่ใหญ่ที่สุดของปัญญาประดิษฐ์ให้กลายเป็นความท้าทายบิตคอยน์ต่อสาธารณะ โดยนำ 100 BTC ซึ่งในเวลานั้นมีมูลค่าราว 6.3 ล้านดอลลาร์ ไปไว้ในวอลเล็ตที่รู้กันโดยสาธารณะ และเชิญชวนให้โมเดล Claude ของ Anthropic มาขโมยมัน การเคลื่อนไหวนี้เกิดขึ้นหลังจาก Anthropic เปิดเผยว่าโมเดล AI หลายตัวของตนเข้าถึงอินเทอร์เน็ตสาธารณะและมีปฏิสัมพันธ์กับระบบจริงในการใช้งานจริงระหว่างการประเมินด้านความมั่นคงปลอดภัยไซเบอร์

เขียนโดย
แชร์
ซีอีโอของ Bitgo เติมเงินให้กระเป๋าเงิน 100 BTC ท้าให้เอไอของ Anthropic ขโมยมันออกไป

ประเด็นสำคัญ

  • Bitgo ใส่เงินทุน 100 BTC เมื่อวันที่ 1 ส.ค. เพื่อท้าทายโมเดล Claude ของ Anthropic
  • Anthropic พบความล้มเหลวในการประเมิน AI 3 กรณีจากการทดสอบความปลอดภัยไซเบอร์ 141,006 ครั้ง
  • 100 BTC ของ Bitgo ยังไม่ถูกแตะต้อง ณ วันที่ 2 ส.ค. ขณะที่ Anthropic ยังคงเงียบ

ซีอีโอ Bitgo โต้กลับหลังการเปิดเผยเรื่อง AI ของ Anthropic

ความท้าทายเริ่มขึ้นในวันที่ 1 ส.ค. เมื่อเบลเช่ ตอบกลับประกาศของ Anthropic โดยตรง ซึ่งอธิบายเหตุการณ์ 3 กรณีที่พบระหว่างการทดสอบความปลอดภัยไซเบอร์ Anthropic อธิบายว่าโมเดล Claude หลายตัวได้เข้าถึงอินเทอร์เน็ตสาธารณะโดยไม่ตั้งใจ หลังจากสภาพแวดล้อมการประเมินถูกเชื่อมต่อออนไลน์โดยผิดพลาด แทนที่จะถูกแยกออกจากกันตามที่ควร

แทนที่จะมองผลการค้นพบว่าเป็นหลักฐานของความสามารถ AI ที่หลุดควบคุม เบลเช่มุ่งไปที่การตั้งค่าระบบทดสอบเอง เหตุการณ์ลักษณะนี้มักชี้ไปที่ความล้มเหลวด้านการกำหนดค่า (configuration) มากกว่าจะเป็นความก้าวหน้าทางเทคนิคที่แทบเป็นไปไม่ได้ โดยเฉพาะเมื่อระบบประเมินถูกเปิดให้เชื่อมกับโครงสร้างพื้นฐานจริง เพื่อทำให้ประเด็นนี้วัดผลได้ เขาจึงเติมเงินเข้า ที่อยู่บิตคอยน์ด้วยจำนวน 100 BTC พอดี และท้าให้ Claude ย้ายเหรียญออกไป

Bitcoin address screenshot.
ภาพของที่อยู่บิตคอยน์ที่เบลเช่แชร์บน X

วอลเล็ตดังกล่าวได้รับเงินทุนเมื่อวันที่ 31 ก.ค. และข้อมูลบนบล็อกเชนยังแสดงว่ายอดคงเหลือเต็มจำนวนยังไม่ถูกแตะต้อง ณ วันที่ 2 ส.ค.

Anthropic แจกแจงเหตุการณ์ความปลอดภัยจริง 3 กรณี

รายงานของ Anthropic ระบุ เหตุการณ์การประเมินด้านความปลอดภัยไซเบอร์ 3 กรณีแยกกัน ที่ตรวจพบหลังจากทบทวนการทดสอบมากกว่า 141,000 ครั้ง บริษัทระบุว่ามีเซสชันการประเมิน 6 ครั้ง ครอบคลุม 3 โมเดล ที่มีปฏิสัมพันธ์กับองค์กรจริงโดยไม่คาดคิด หลังจากความเข้าใจผิดทำให้สภาพแวดล้อมการทดสอบถูกเชื่อมต่อกับอินเทอร์เน็ต

โมเดลที่เกี่ยวข้องได้แก่ Claude Opus 4.7, Claude Mythos 5 และโมเดลวิจัยภายในที่ยังไม่เปิดตัว แต่ละโมเดลได้รับมอบหมายแบบฝึกหัด capture-the-flag ที่ออกแบบมาเพื่อค้นหาข้อมูลที่ซ่อนอยู่ภายในระบบคอมพิวเตอร์สมมติ แม้ว่าพรอมป์ของ Anthropic จะระบุว่าโมเดลทำงานอยู่ในซิมูเลชันที่ถูกแยกและไม่มีการเข้าถึงอินเทอร์เน็ต แต่จริง ๆ แล้วสภาพแวดล้อมนั้นออนไลน์ เนื่องจากความผิดพลาดด้านการกำหนดค่าที่เกี่ยวข้องกับพาร์ตเนอร์ทดสอบบุคคลที่สามชื่อ Irregular

Claude โจมตีระบบจริงขณะคิดว่ากำลังฝึกซ้อม

Anthropic อธิบายกรณีที่ร้ายแรงที่สุดว่าเกี่ยวข้องกับ Claude Opus 4.7 หลังจากทำภารกิจสมมติไม่สำเร็จ โมเดลได้ค้นพบเว็บไซต์จริงที่ใช้ชื่อเดียวกับบริษัทในซิมูเลชัน จากนั้นจึงใช้ประโยชน์จากรหัสผ่านที่อ่อนแอและบริการที่ถูกเปิดเผย กู้คืนข้อมูลรับรองโครงสร้างพื้นฐาน และเข้าถึงฐานข้อมูลการใช้งานจริงที่มีบันทึกหลายร้อยรายการ

บริษัทระบุว่าโมเดลยังคงดำเนินการต่อหลังจากตระหนักว่าสภาพแวดล้อมอาจเป็นของจริง เพราะสรุปว่าระบบจริงน่าจะยังเป็นส่วนหนึ่งของการประเมิน ผู้ที่เคยทำ penetration testing ย่อมรู้ว่าความสับสนแบบนี้เกิดขึ้นได้ง่ายขึ้นมากเมื่อขอบเขตการทดสอบไม่ชัดเจน นี่คือเหตุผลที่สภาพแวดล้อมที่ถูกแยกอย่างเหมาะสมสำคัญพอ ๆ กับซอฟต์แวร์ที่กำลังถูกประเมิน Anthropic เน้นว่า AI กำลังพยายามทำงานที่ได้รับมอบหมาย ไม่ได้ตั้งใจหลบหนีการกักกันหรือไล่ตามเป้าหมายอิสระ

การออกแบบระบบรับฝากทรัพย์สินของ Bitgo เพิ่มเดิมพัน

ความท้าทายของเบลเช่ไปไกลกว่าการถามว่า AI สามารถใช้ประโยชน์จากรหัสผ่านอ่อนแอหรือเซิร์ฟเวอร์ที่ตั้งค่าผิดพลาดได้หรือไม่ บิตคอยน์ดังกล่าวอยู่ภายใน แพลตฟอร์มรับฝากทรัพย์สินระดับสถาบันของ Bitgo ซึ่งพึ่งพาเทคโนโลยีแบบ multi-signature หรือ multi-party computation ที่กระจายอำนาจการลงนามไปยังคีย์อิสระหลายชุด แทนการพึ่งพาจุดล้มเหลวเพียงจุดเดียว

Bitcoin address transfer screenshot
ข้อมูลการโอนของที่อยู่ที่เบลเช่แชร์แสดงว่าได้ใช้ multi-signature แล้ว

ระบบที่สร้างแบบนี้ถูกออกแบบให้ไม่มีจุดอ่อนเพียงจุดเดียวที่พอจะย้ายเงินได้ ผู้โจมตีจะต้องฝ่าการจัดการคีย์ นโยบายการอนุมัติ การป้องกันด้วยฮาร์ดแวร์ และการควบคุมด้านปฏิบัติการตามลำดับที่ถูกต้อง ทำให้ปัญหาแตกต่างโดยพื้นฐานจากการโจมตีสภาพแวดล้อมทดสอบที่ถูกเปิดเผย ตามรายงานต้นทาง การเจาะระบบเช่นนี้จะต้องโจมตีหลายชั้นอิสระพร้อมกัน

บล็อกเชนจะให้คำตอบสุดท้าย

ต่างจากข้ออ้างด้านความปลอดภัยไซเบอร์จำนวนมากที่ยังคงซ่อนอยู่หลังการสืบสวนแบบปกปิด การทดลองนี้เป็นสาธารณะอย่างสมบูรณ์ ทุกคนสามารถติดตามวอลเล็ตบนบล็อกเชนบิตคอยน์และเห็นได้ทันทีว่าเหรียญเคยถูกย้ายหรือไม่

ความท้าทายนี้ยังสานต่อคำวิจารณ์ที่กว้างขึ้นของเบลเช่ต่อเรื่องเล่าด้านความปลอดภัย AI ที่ชวนตื่นตระหนก เมื่อต้นปี 2026 เขาโต้แย้งการตีความอย่างแพร่หลายว่าโมเดลของ Anthropic ได้เจาะระบบของสำนักงานความมั่นคงแห่งชาติสหรัฐฯ (NSA) ที่เป็นความลับโดยอิสระ โดยให้เหตุผลว่ารายงานบิดเบือนความหมายของการฝึกซ้อมภายในที่ได้รับอนุญาต ไม่ใช่การเจาะจากภายนอกจริง ความท้าทายล่าสุดของเขาเดินตามแนวทางเดียวกัน ด้วยการแทนที่การถกเถียงเชิงสมมติด้วยการทดสอบที่โปร่งใสและวัดผลได้

การถกเถียงตอนนี้ขยายไปไกลกว่าเรื่องปัญญาประดิษฐ์

เหตุการณ์นี้สะท้อนช่องว่างที่เพิ่มขึ้นระหว่างการสาธิตที่ทำในสภาพแวดล้อมวิจัยที่ควบคุมได้ กับการโจมตีต่อระบบการใช้งานจริงที่ถูกออกแบบมาให้ทนต่อคู่ต่อสู้ที่ซับซ้อน

สำหรับอุตสาหกรรมคริปโต ความท้าทายนี้ยังทำหน้าที่เป็นการสาธิตสถาปัตยกรรมการรับฝากทรัพย์สินระดับสถาบันต่อสาธารณะ หากการขโมยสำเร็จ จะเกิดคำถามทันทีทั้งต่อความสามารถของ AI และการเก็บรักษาบิตคอยน์ความปลอดภัยสูง หากวอลเล็ตยังไม่ถูกแตะต้อง ผู้สนับสนุนก็น่าจะโต้แย้งว่านี่ตอกย้ำความแตกต่างระหว่างการใช้ประโยชน์จากสภาพแวดล้อมทดสอบที่ตั้งค่าผิด กับการเอาชนะระบบรับฝากทรัพย์สินระดับองค์กร

ความท้าทายของผู้บริหาร Bitgo เกิดขึ้นในขณะที่เหตุการณ์การโจมตี Coldcard ล่าสุดยังคงดำเนินอยู่ โดย ความเสียหายรวมแตะ 1,431.97 BTC ณ เวลา 20.00 น. ตามเวลาฝั่งตะวันออกของวันอาทิตย์ กรณี Coldcard ยังจุดกระแสคาดเดาว่าการรั่วไหลนั้นท้ายที่สุดเกิดจากความผิดพลาดของมนุษย์ ความผิดพลาดเชิงปฏิบัติการ หรือสาเหตุอื่นทั้งหมด รวมถึงว่า AI มีบทบาทใด ๆ ในการค้นพบ ช่องโหว่เฟิร์มแวร์หรือไม่

ความสนใจหันไปที่ Anthropic และวอลเล็ต

ณ วันที่ 2 ส.ค. Anthropic ยังไม่ได้ตอบสนองต่อความท้าทายเฉพาะของเบลเช่ต่อสาธารณะ และ 100 BTC ยังคงอยู่ในที่อยู่ที่เผยแพร่โดยไม่มีธุรกรรมขาออก นั่นทำให้บล็อกเชนทำหน้าที่เป็นกระดานคะแนนที่เป็นกลาง ขณะที่อุตสาหกรรมเทคโนโลยีโดยรวมถกเถียงกันว่าเหตุการณ์เหล่านี้แสดงให้เห็นอะไรจริง ๆ

ความคืบหน้าถัดไปน่าจะมาจากการวิเคราะห์ทางเทคนิคเพิ่มเติมเกี่ยวกับสภาพแวดล้อมการประเมินของ Anthropic การตอบสนองใด ๆ จากบริษัทเกี่ยวกับความท้าทาย หรือการเคลื่อนไหวของบิตคอยน์เอง จนกว่าจะถึงตอนนั้น การเดิมพันของเบลเช่ได้เปลี่ยนการสนทนาที่ซับซ้อนเกี่ยวกับความปลอดภัยของ AI ให้กลายเป็นคำถามง่าย ๆ ที่ตรวจสอบได้ต่อสาธารณะ: AI ในวันนี้สามารถเอาชนะระบบรับฝากทรัพย์สินระดับสถาบันของอุตสาหกรรมคริปโตเคอร์เรนซีได้หรือไม่?

บทความนี้แปลจากภาษาอังกฤษโดยใช้ AI เวอร์ชันภาษาอังกฤษต้นฉบับเป็นแหล่งข้อมูลที่เชื่อถือได้ การแปลอัตโนมัติอาจมีความไม่ถูกต้อง โดยเฉพาะอย่างยิ่งในคำศัพท์ทางกฎหมายและข้อบังคับ