Вътрешната оценка на OpenAI за нейния предстоящ модел, Astra, установи значителен напредък в агентното програмиране и киберсигурността, което доведе компанията до заключението, че не може да изключи възможността моделът да достигне ниво на критични възможности за киберсигурност съгласно своята Рамка за готовност (Preparedness Framework).
Рамката за готовност, публикувана за първи път през декември 2023 г., очертава как OpenAI оценява рисковете от авангардния изкуствен интелект и определя предпазните мерки, необходими преди внедряването на все по-способни модели. Тя идентифицира области с високорискови възможности, включително киберсигурност, биологични и химически заплахи, вредно убеждаване и самоусъвършенстване на изкуствения интелект, и изисква моделите да преминават през оценки за безопасност преди внедряване. Ако се прецени, че даден модел представлява неприемливо ниво на риск, OpenAI заявява, че ще забави внедряването или ще въведе допълнителни предпазни мерки, докато рискът не бъде намален.
Как OpenAI оценява критичните кибер възможности
Съгласно Рамката за готовност, OpenAI класифицира даден модел като притежаващ критични възможности за киберсигурност, ако той може независимо да открива неизвестни досега софтуерни уязвимости в защитени системи или да планира и извършва сложни кибератаки срещу добре защитени цели с малко или без човешко ръководство.
Компанията следва същия подход, който прие през 2025 г., когато нейните модели с изкуствен интелект започнаха да демонстрират напреднали възможности в областта на биологията.
„Въпреки че продължаваме да тестваме и оценяваме този модел, нашите предварителни оценки показват достатъчно силно представяне, така че към момента не можем да изключим нивото на критични възможности. Astra е предстоящ модел и не е участвал в експлоатирането на Hugging Face“, заявиха от OpenAI.
Компанията поясни, че това е предварителна оценка и Astra все още не е класифициран като критичен модел за киберсигурност, като продължават оценките преди вземането на окончателно решение съгласно Рамката за готовност.
OpenAI засили предпазните мерки и контрола на сигурността, за да подкрепи внедряването на модели с подобни възможности. По време на разработването на Astra тя започна да прилага по-строги мерки за сигурност за модели с по-високи възможности и свързаните с тях дейности, включително изолирани среди за тестване, ограничен достъп до мрежи и инструменти, подобрена защита и криптиране на теглата на модела, допълнителни системи за наблюдение и откриване, както и изпълнение в изолирана среда.
Компанията заяви, че е спряла дейностите, свързани с Astra, които не отговарят на тези повишени изисквания за сигурност, и е въвела цялостно наблюдение за откриване на рискови действия и признаци на несъответствие при агентните приложения.
Преди да внедри Astra, OpenAI ще поиска от правителствени агенции и независими организации за безопасност на изкуствения интелект да оценят възможностите за киберсигурност на модела. Тя също така ще предостави на външни партньори за тестване насоки и мерки за сигурност, за да даде възможност за безопасна оценка на по-високорисковите възможности на модела.