GPT-5.6 v Codexu mohl bez sandboxu omylem mazat soubory
OpenAI podle Thibaulta Sottiauxe prošetřovala několik hlášení, ve kterých GPT-5.6 v Codexu nečekaně odstranil soubory při plném přístupu bez sandboxu.
Thibault Sottiaux z OpenAI popsal několik hlášení, ve kterých GPT-5.6 při práci v Codexu nečekaně odstranil soubory. Vyjádření citoval Simon Willison.
Podle Sottiauxe se problém nejčastěji objevil při zapnutém režimu plného přístupu, bez sandboxu a bez automatické kontroly prováděných akcí. Nejde tedy o potvrzení, že ke stejné chybě dochází při každém použití Codexu nebo ve všech režimech.
Souvislost s proměnnou $HOME
V popsaných případech se model pokoušel změnit proměnnou prostředí $HOME, aby jako domovský adresář dočasně použil pracovní složku.
$HOME běžně obsahuje cestu k domovskému adresáři uživatele. Podle Sottiauxe mohl model při následném úklidu omylem spustit mazání nad skutečným domovským adresářem a odstranit jeho obsah.
Nešlo tedy o „smazání proměnné $HOME“, ale o nechtěné mazání souborů v adresáři, se kterým model pracoval.
Praktické omezení rizika
Zdroj neposkytuje úplný technický rozbor ani přesný seznam zasažených verzí Codexu. Popisuje několik hlášení spojených s GPT-5.6 a okolnosti, za kterých se problém objevoval nejčastěji.
Dokud není rozsah chyby přesně známý, je bezpečnější:
- ponechat zapnutý sandbox,
- nepoužívat plný přístup bez kontroly,
- pracovat v repozitáři s aktuální historií ve verzovacím systému,
- důležitá data pravidelně zálohovat.
Případ připomíná, že agent s přístupem k terminálu může způsobit skutečné změny v souborovém systému. Oprávnění a izolace proto nejsou jen doplňková nastavení, ale základní bezpečnostní hranice.