OpenAI обяви, че съзнателно забавя разработването на Astra – своя предстоящ авангарден модел с изкуствен интелект. Това решение е взето, след като вътрешни оценки са разкрили напредък в автономното програмиране (agentic coding) и киберсигурността, който би могъл да тласне системата в територията на „критичен“ риск.
Компанията заяви, че е взела това решение след преглед на резултатите от скорошни вътрешни тестове, съчетани с външни експертни оценки. Изводът е, че към момента не могат да бъдат изключени критични кибер възможности съгласно нейната Рамка за готовност (Preparedness Framework). Това е вътрешното ръководство за безопасност, което OpenAI използва от декември 2023 г. за проследяване и реагиране на нарастващите възможности на ИИ в области като биология, химия, киберсигурност и самоусъвършенстване.
Astra представлява значителен скок спрямо предишните версии. По-ранните модели, включително GPT-5.6-Sol, бяха оценени за авангардни кибер възможности и бяха класифицирани на прага на „висок“, а не на „критичен“ риск.
Съгласно рамката на OpenAI, даден модел преминава в територията на критичния риск, ако може независимо и без човешка намеса да идентифицира и създава функционални експлойти от тип нулев ден във всички нива на сериозност срещу защитени критични системи от реалния свят, или ако може да планира и изпълнява изцяло нови стратегии за кибератаки срещу защитени цели, разполагайки единствено с високопоставена цел.
Предварителните тестове на OpenAI показват, че представянето на Astra е достатъчно силно, за да не може да се изключи преминаването на този праг. Това е подтикнало компанията да оповести публично констатацията в интерес на прозрачността пред общността за изследвания в областта на безопасността и сигурността.
Важно е да се отбележи, че OpenAI поясни, че Astra не е участвала в скорошния инцидент с експлоатация на Hugging Face, разграничавайки нарастващия профил на възможностите на модела от всякакви активни компрометирания в реалния свят.
В отговор OpenAI увеличи тестването за устойчивост на своите предпазни мерки и контроли за сигурност, за да съответстват на повишения профил на риска. Компанията въвежда по-строги мерки за сигурност за модели с високи възможности, включително изолирани среди за тестване, ограничен достъп до мрежа и инструменти, по-сериозна защита и криптиране на теглата на модела, разширени системи за наблюдение и откриване, както и изпълнение в изолирана среда. OpenAI също така спря вътрешната работа по Astra, която все още не отговаря на тези затегнати изисквания за сигурност.
Внедрена е универсална система за мониторинг за всички автономни употреби на Astra, обхващаща както обучението, така е оценката. Тази система инспектира веригата от мисли (chain of thought) на модела и може да задейства отговор за сигурност, за да прекъсне високорискова дейност в реално време.
OpenAI също така планира да си сътрудничи с правителствени агенции и избрани организации за безопасност на ИИ, за да тестват независимо възможностите на Astra, и ще сподели препоръчани контроли за сигурност с партньори от трети страни, провеждащи оценки с по-висок риск.
Това не е първият път, когато OpenAI публично сигнализира за преход във възможностите. През юни 2025 г. компанията предприе подобни действия, след като нейните модели се доближиха до прага на висок риск за биологични способности, укрепвайки предпазните мерки и разширявайки партньорствата за външно тестване. От OpenAI споделят, че сега прилагат същия принцип на управление спрямо възможностите на Astra в областта на киберсигурността.
Компанията формулира по-широката си цел като осигуряване на това високоспособните модели да помагат на защитниците да откриват и коригират уязвимости, преди киберпрестъпниците да могат да ги експлоатират, вместо да накланят везната в полза на атаката.
OpenAI потвърди ангажимента си да работи с правителства, институти за безопасност и групи от гражданското общество, за да гарантира, че авангардни системи като Astra се внедряват отговорно, докато техните възможности продължават да се развиват.