Izvršni direktor podjetja Bitgo, Mike Belshe, je eno največjih varnostnih razprav na področju umetne inteligence spremenil v javni izziv v zvezi z bitcoinom, tako da je 100 BTC, ki so bili takrat vredni približno 6,3 milijona dolarjev, shranil v javno znano denarnico in modele Claude podjetja Anthropic povabil, naj jih ukradejo. Ta poteza je sledila razkritju podjetja Anthropic, da je več njegovih modelov umetne inteligence med ocenjevanjem kibernetske varnosti doseglo odprti internet in interagiralo z dejanskimi produkcijskimi sistemi.
Izvršni direktor podjetja Bitgo je napolnil denarnico s 100 BTC in izzval umetno inteligenco podjetja Anthropic, naj jih ukrade

Ključne ugotovitve
- Bitgo je 1. avgusta namenil 100 BTC za izziv modelom Claude podjetja Anthropic.
- Podjetje Anthropic je v 141.006 izvedbah ocen kibernetske varnosti odkrilo 3 napake pri ocenjevanju umetne inteligence.
- 100 BTC podjetja Bitgo je 2. avgusta ostalo nedotaknjeno, medtem ko je podjetje Anthropic molčalo.
Izvršni direktor podjetja Bitgo se odziva na razkritje podjetja Anthropic o umetni inteligenci
Izziv se je začel 1. avgusta, ko je Belshe neposredno odgovoril na objavo podjetja Anthropic, v kateri so opisali tri incidente, odkrite med testiranjem kibernetske varnosti. Podjetje Anthropic je pojasnilo, da je več modelov Claude nenamerno doseglo javni internet, potem ko so bila ocenjevalna okolja po pomoti povezana z internetom, namesto da bi ostala izolirana.
Namesto da bi ugotovitve obravnaval kot dokaz nebrzdanih zmožnosti umetne inteligence, se je Belshe osredotočil na samo testno okolje. Takšni incidenti običajno kažejo na napake v konfiguraciji in ne na nemogoče tehnične preboje, še posebej kadar so ocenjevalni sistemi izpostavljeni delujoči infrastrukturi. Da bi to dokazal, je na bitcoin naslov nakazal točno 100 BTC in izzval Clauda, naj prenese te kovance.

Denarnica je sredstva prejela 31. julija, zapisi v verigi blokov pa so 2. avgusta še vedno kazali, da je celotno stanje ostalo nedotaknjeno.
Anthropic podrobno opisuje tri varnostne incidente v realnem svetu
Poročilo podjetja Anthropic opisuje tri ločene incidente pri ocenjevanju kibernetske varnosti, ki so bili ugotovljeni po pregledu več kot 141.000 testnih izvedb. Podjetje je navedlo, da je pri šestih ocenjevalnih sejah v treh modelih prišlo do nepričakovane interakcije z dejanskimi organizacijami, potem ko je zaradi nesporazuma testno okolje ostalo povezano z internetom.
Med vključenimi modeli so bili Claude Opus 4.7, Claude Mythos 5 in še neobjavljeni notranji raziskovalni model. Vsakemu od njih so bile dodeljene vaje »capture-the-flag«, namenjene iskanju skritih informacij znotraj fiktivnih računalniških sistemov. Čeprav so navodila podjetja Anthropic navajala, da modeli delujejo znotraj izoliranih simulacij brez dostopa do interneta, so bila okolja dejansko povezana z internetom zaradi napake v konfiguraciji, v katero je bil vpleten zunanji partner za testiranje, podjetje Irregular.
Claude je izkoriščal resnične sisteme, medtem ko je mislil, da se usposablja
Podjetje Anthropic je kot najresnejši primer opisalo primer modela Claude Opus 4.7. Potem ko model ni uspel zaključiti svoje izmišljene naloge, je odkril pravo spletno stran z istim imenom kot simulirano podjetje. Nato je izkoristil šibka gesla in izpostavljene storitve, pridobil pristopne podatke za infrastrukturo ter pridobil dostop do produkcijske baze podatkov, ki je vsebovala več sto zapisov.
Podjetje je pojasnilo, da je model nadaljeval delovanje, potem ko je prepoznal, da je okolje morda resnično, saj je sklenil, da so resnični sistemi verjetno še vedno del ocenjevanja. Vsak, ki se je že ukvarjal s testiranjem vdorov, ve, da je takšna zmeda veliko verjetnejša, kadar so meje testiranja nejasne, zato so ustrezno izolirana okolja prav tako pomembna kot programska oprema, ki se ocenjuje. Podjetje Anthropic je poudarilo, da je umetna inteligenca poskušala izpolniti dodeljeno nalogo, namesto da bi namerno pobegnila iz omejenega okolja ali zasledovala neodvisne cilje.
Bitgov model hrambe povečuje tveganje
Belshejev izziv sega daleč onkraj vprašanja, ali lahko umetna inteligenca izkorišča šibka gesla ali slabo konfigurirane strežnike. Bitcoini se nahajajo znotraj Bitgovega institucionalnega sistema za hrambo, ki temelji na tehnologiji večkratnega podpisovanja ali večstranskega računanja, ki pooblastilo za podpisovanje porazdeli med več neodvisnih ključev, namesto da bi se zanašal na eno samo točko odpovedi.

Sistemi, zgrajeni na ta način, so zasnovani tako, da nobena posamezna šibkost ne zadostuje za premik sredstev. Napadalec bi moral v pravilnem zaporedju zaobiti upravljanje ključev, politike odobravanja, zaščito strojne opreme in operativne kontrole, kar problem bistveno razlikuje od izkoriščanja izpostavljenega testnega okolja. Glede na poročilo vira bi ogrožanje takšnega sistema zahtevalo sočasen napad na več neodvisnih plasti.
Blockchain bo dal končni odgovor
Za razliko od mnogih trditev o kibernetski varnosti, ki ostajajo skrite za zaupnimi preiskavami, je ta poskus popolnoma javen. Kdor koli lahko spremlja denarnico na verigi blokov bitcoina in takoj vidi, ali se kovanci kdaj premaknejo.
Ta izziv nadaljuje tudi Belshejevo širšo kritiko senzacionalističnih zgodb o varnosti umetne inteligence. Že prej leta 2026 je izpodbijal razširjene interpretacije, da je model podjetja Anthropic samostojno vdrl v zaupne sisteme Nacionalne varnostne agencije (NSA), pri čemer je trdil, da so poročila napačno predstavila odobreno notranjo vajo in ne dejanskega zunanjega vdora. Njegov najnovejši izziv sledi istemu vzorcu, saj hipotetične razprave nadomešča s preglednim in merljivim testom.
Razprava se zdaj širi tudi izven področja umetne inteligence
Ta epizoda poudarja vse večjo vrzel med demonstracijami, izvedenimi v nadzorovanih raziskovalnih okoljih, in napadi na produkcijske sisteme, zasnovane tako, da zdržijo napade izkušenih nasprotnikov.
Za industrijo kriptovalut ta izziv služi tudi kot javna demonstracija arhitekture institucionalnega hrambe. Uspešna kraja bi takoj sprožila vprašanja tako o zmogljivostih umetne inteligence kot o visoko varnostnem shranjevanju bitcoinov. Če denarnica ostane nedotaknjena, bodo zagovorniki verjetno trdili, da to še bolj poudarja razliko med izkoriščanjem napačno nastavljenih testnih okolij in premagovanjem sistemov hrambe na ravni podjetij.
Izziv izvršnega direktorja podjetja Bitgo prihaja v času, ko se nedavni izkoriščeni varnostni luknji v sistemu Coldcard še vedno razvija, pri čemer so skupne izgube do nedelje ob 20. uri po vzhodnem času dosegle 1.431,97 BTC. Primer Coldcard je prav tako spodbudil špekulacije o tem, ali je do vdora prišlo zaradi človeške napake, operativnih napak ali povsem drugega vzroka, vključno z vprašanjem, ali je umetna inteligenca igrala kakršno koli vlogo pri odkritju ranljivosti vgrajene programske opreme.
Pozornost se zdaj usmerja na podjetje Anthropic in denarnico
Do 2. avgusta podjetje Anthropic še ni javno odgovorilo na Belshejev konkreten izziv, 100 BTC pa je ostalo na objavljenem naslovu brez kakršnih koli odhodnih transakcij. S tem blockchain služi kot objektivna tabela rezultatov, medtem ko širša tehnološka industrija razpravlja o tem, kaj so ti incidenti dejansko pokazali.
Naslednji razvoj dogodkov bo verjetno izhajal iz dodatne tehnične analize ocenjevalnih okolij podjetja Anthropic, morebitnega odgovora podjetja na izziv ali gibanja samega bitcoina. Do takrat je Belsheva stava spremenila zapleteno razpravo o varnosti umetne inteligence v preprosto vprašanje z javno preverljivim odgovorom: Ali lahko današnja umetna inteligenca premaga institucionalne sisteme hrambe v industriji kriptovalut?
Ta članek je bil iz angleščine preveden z umetno inteligenco. Izvirna angleška različica je verodostojni vir; samodejni prevodi lahko vsebujejo netočnosti, zlasti pri pravni in regulativni terminologiji.















