OpenAI в момента разследва малък брой сигнали, сочещи, че GPT-5.6 Codex неволно е изтрил файлове от домашните директории на потребителите.
Съобщава се, че тези инциденти са възникнали, когато на Codex е бил предоставен пълен достъп до файловата система без необходимата защита в изолирана среда или контроли за автоматизиран преглед.
Според Тибо Сотьо, член на екипа на Codex в OpenAI, проблемът най-често възниква по време на задачи, свързани с работа с временни директории.
В тези случаи моделът се опитва да презапише променливата на средата HOME, за да установи временен работен път, но по погрешка насочва самия $HOME за изтриване.
При Unix-подобни системи $HOME обикновено се отнася до домашната директория на активния потребител, която може да съдържа важни файлове като документи, изходен код, SSH ключове, облачни идентификационни данни, конфигурации на приложения, данни от браузъра и други чувствителни материали.
Изпълнението на грешна команда за рекурсивно изтриване на това място може да причини значителна загуба на данни и да изложи организациите на оперативни прекъсвания и предизвикателства при възстановяването на идентификационни данни.
От OpenAI заявиха, че това поведение не е било очаквано, дори в сценарии, при които потребителите съзнателно избират режим за пълен достъп.
Компанията отбеляза, че на засегнатите среди са липсвали основни защитни слоеве: изолиране на файловата система и автоматичен преглед – контролен механизъм, който оценява и отхвърля високорискови действия преди изпълнение.
Този инцидент повдига по-широки опасения за сигурността по отношение на автономните инструменти за програмиране. За разлика от традиционните системи за автоматично довършване на код, автономните агенти могат да изпълняват shell команди, да създават или премахват файлове, да променят конфигурации и да взаимодействат с среди за разработка. Ако даден агент интерпретира погрешно път, променлива на средата или потребителска инструкция, той може да предприеме вредни действия със скоростта на машина.
Документацията на OpenAI за системата GPT-5.6 вече беше отбелязала по-голяма склонност на модела (в сравнение с GPT-5.5) да надхвърля заявения от потребителя обхват при задачи за автономно програмиране.
Въпреки това компанията описа общата честота на поява като ниска. Неотдавнашните доклади за изтриване илюстрират защо превишаването на правата в системи с директен достъп до инструменти може да се превърне в проблем за безопасността, а не просто в грижа за качеството на резултата.
За да разреши този проблем, OpenAI внедрява мерки за смекчаване, включително актуализации на системата за съобщения към разработчиците, по-категорични насоки за по-безопасни режими на разрешения и допълнителни предпазни мерки на ниво инфраструктура на приложението.
Компанията също така планира да публикува подробен анализ след инцидента, адресиращ случаите и очертаващ мерките, предназначени да намалят риска от повторна поява.
Разработчиците, използващи Codex или подобни ИИ агенти за програмиране, трябва да избягват предоставянето на неограничен достъп до лични работни станции и производствени среди.
Агентите трябва да работят в контейнери, виртуални машини, контейнери за разработка или строго ограничени проектни директории. Разрушителните операции като rm, rmdir, del, изтриване на бази данни и команди за премахване на инфраструктура трябва да изискват изричен преглед и одобрение.
Екипите по сигурността също трябва да прилагат принципа на най-малките привилегии към идентификационните данни на агента, да поддържат непроменими или изнесени извън устройството резервни копия, да използват контрол на версиите за код и конфигурации и да наблюдават регистрационните файлове с команди за неочаквана активност във файловата система.
Бариерите за човешко одобрение са особено важни за команди, които работят с широки пътища, променливи на средата, монтирани томове или домашни директории.
Въпреки че OpenAI характеризира проблема като изключително рядък, тези съобщения затвърждават важен принцип за разработката, подпомагана от ИИ: на никой автономен агент за програмиране не трябва да се поверяват неограничени привилегии за изтриване на ценни данни.