RaunprófunUse case
Ptacek: Þarf ekki toppmódel til að brjótast út úr AI-sandkassa
Simon Willison · Birt 22. júlí 2026 · Síðast staðfest 23. júlí 2026
Öryggissérfræðingurinn Thomas Ptacek segir að opið AI-módel frá 2025 gæti, með réttum verkfærum, sloppið úr sandkassa (öruggu einangruðu keyrsluumhverfi) og skannað/ráðist á flest netkerfi. Hann segir þetta ekki koma á óvart nema fólk haldi að OpenAI sé með traustari sandkassa en gengur og gerist.
Engin sértæk verkfæri nefndTæknilegt Ekki tilgreintSjálfvirkni og agentar
Hvað var gert
Simon Willison vitnar í ummæli Thomas Ptacek um öryggi AI-líkana. Ptacek fullyrðir að ekki þurfi nýjustu toppmódel (frontier models) til að framkvæma sandbox escape — það að módel sleppi út úr einangruðu keyrsluumhverfi sínu — og noti það svo til að skanna og hakka net. Hann segir slíkt sé mögulegt með 2025-árgangs opnum líkönum (open weights models) ef byggður er sérstakur pentest-búnaður (verkfæri til að prófa öryggi kerfa) utan um þau.
Niðurstaðan
Engin formleg tilraun eða mæling er birt í heimildinni — þetta er skoðun/fullyrðing Ptacek, ekki staðfest niðurstaða prófunar.
Af hverju skiptir þetta máli
Þetta bendir til að öryggisógnir tengdar AI-módelum séu ekki bundnar við dýrustu og nýjustu líkönin — jafnvel eldri, opin módel gætu dugað árásarmönnum. Það hefur áhrif á hvernig fyrirtæki, líka OpenAI, ættu að hugsa um einangrun og öryggi í kringum AI-keyrslur.
Takmarkanir og fyrirvarar
- Þetta er fullyrðing eins sérfræðings, ekki staðfest með gögnum eða prófun í heimildinni.
- Engar tæknilegar upplýsingar um hvernig sandbox escape færi fram eru gefnar.
- Óljóst hvaða líkön eða net voru raunverulega prófuð, ef einhver.
Áreiðanleiki
Raunprófun: Nafngreind manneskja lýsir eigin raunverulegri notkun. Reynsla eins á ekki sjálfkrafa við alla.
Vægisstig: 70/100 — sjá ástæður
- Hagnýtt, endurtakanlegt vinnuflæði (+25)
- Tengist Claude, ChatGPT eða Codex (+15)
- Glænýtt — innan sólarhrings (+30)
- Traust á heimild: 70%