Teknologi

Claude brøt seg inn hos OpenAI på dager — og de vanskelige spørsmålene er Anthropics

Adrian Kessler
Legg oss til på Google

Et lite team rettet Anthropics nyeste modell mot OpenAIs inngangsdør og gikk rett inn. Versjonen de fleste leser – smarte utenforståennde som gjør ChatGPT-skapren flau – tar feil om saken. Innbruddet handlet ikke om noe OpenAİ glemte å lap pe. Det handlet om øyeblikket da Anthropic lanserte en mer kapabel Claude. Det er den delen det er verdt å tenke på: en jobb som hadde gått i stå i dager ble løst av seg selv så snart et nytt flaggskip kom på nett.

Personene involvert var ikke krimielle. Forskere ved sikkerhetsstartupen Hacktron arbedet innenfor OpenAIs eget bug‑bounty‑program, koble sammen etpar uglamourøse nettsvakheter, nidde frem til kontoer til OpenAIs ansatte, og kom helt til et internt kodelager – så stoppet de, meldte inn va de fant, og tok imot en beskjeden belønning. De etterlot en uskadelig markør som bevis og gikk ikke videre. Les som en krimiell handling er det en ikk-hendelse. Les som en evnetest er det et signal som går opp.

Her er mekanismen som dekningen i nyhetsbyråene skled forb i. Teamet kjørte først jobben på Claude Opus 4.8, versjonen som er finjustert for sikkert, og det stagnerte over flere økter. Så slapp Anthropic Opus 5. «Opus 4.8 slet over flere økter med å produsere en fungerende utnyttelse,» skrev Hacktron‑teamet. «Innen timer etter lanseringen av Opus 5 ga vi den samm problem, og den lykkes.» VenturBeatt rap porterte at den nye modellen skrev en fun gerende utnyttelse for et vans kelig brikkemål in nen timer. In genting i OpenAIs for svar end ret seg i det vinduet. Modell en gord det.

Det er presis den tpen sprang – et leep i va en vanlig bruker kan gjøre med et abonnement rett fra flyen – som Anthropics egen sikkerts‑maskineri er byggt for å oppdage og holde tilbake. Sel skapet holder sin mest kapable kybermodell, Mythos, bak eksportkontroller og en kort liste over godkjente forsvare, og kaller den den sterkeste sikkersmodellen de har bygget. Intet av det hadd betydning her. Det offentlig tilgjengelige nivået var nok. Som Gray Swans adminstrerende direktr Matt Fredrikson sa til TechCrunch: «For 200 dol ar i måneden kan hvem som helst bruke disse verkøyene og hacke seg inn i et selskap som OpenAI.»

Det er h er ansvaret lander på Anthropic heller en på deres rival. Anthropic har bygget hele sin identitet på forsiktighet – deres adminstrerende direktør, Dario Amodei, snakker åpent om de «ekte farer» ved teknoogien og har presset industri til å sakke ned. En almenutgvelsesmodell som mål bart senker ters kelen for å bryte seg inn i en konkurrerende lab er en ubehagelig kontrav vekt mot den bkd japen. Spurt om å stå til rette for det, sa sels kapet int; CBS News rapporterte at Anthropic ikke svarte på en forespørsel om kommentar. OpenAI på sin side takket forskerne, innsnevrete tilgan gene som angriperne hadd utnyttet, og tilbakakalte de berørte øktene.

Detaljene er nesten hverdagslige. Veien inn var et forledet bildebehandlingsbibliotek som fulgte med Discours‑programvaren som driver OpenAIs fellesskapsforum; en annen glipe i hvordan innlogings‑tokener var avgrenset lot forskerne ri en kompromittert økt inn i ansattkontoer for ChatGPT og Codex, og videre til privat kode. Hele kjeden, fra første fotfeste til admin til gan, tok under tr dagar. OpenAI betalte 6.500 dollar. Teamet sier at de brukte mindre enn 3.000 dollar i Claude‑tid på hele innsatsen – to mnder arbeid, mest det menneskelig, komprimet på sluten til en maskin som ikke lenger trengte en spesialist.

Den knape resursen som pleide å beskytte et mål var aldri lappen. Det var eksperten som kunne finne svakhetene, sette dem sammen og se veien gjennom – og mnede det tok. Den ekspertisen ble netop billig. Denne gangen levere teamet som nidde OpenAIs kode inn en rapport og tok belønningen. Den neste som klarer samme terskel, på samm abonnement, er int påenget til å gjøre det.

Tagger: , , , , ,

Legg oss til på Google

Diskusjon

Det er 0 kommentarer.