OpenAI пусна за общ достъп фамилията модели GPT-5.6, представяйки три модела, насочени към различни изисквания за производителност и цена: Sol (флагманската система), Terra (балансиран вариант за рутинни професионални натоварвания) и Luna (най-бързият и най-евтин член на фамилията).
Стартът носи със себе си и ChatGPT Work — агентно работно пространство, проектирано да превръща информация от файлове, приложения и свързани бизнес услуги в готови крайни продукти.
За екипите по киберсигурност GPT-5.6 представлява значително увеличение на възможностите. OpenAI съобщава, че Sol е постигнал 96.7% при вътрешната им оценка за capture-the-flag (CTF), 71.2% на SEC-Bench Pro, 73.5% на ExploitBench и 33.7% на ExploitGym.
Компанията споделя, че моделът е по-добър в откриването, възпроизвеждането и отстраняването на уязвимости, въпреки че остава под прага на OpenAI за „критични“ възможности за автономни кибероперации. Terra и Luna също са преминали границата на компанията за „висока“ киберсигурност, което отразява нарастващия офанзивен и дефанзивен потенциал на по-малките и по-евтини модели.
Ефективността е друг акцент. Според докладите GPT-5.6 Sol е постигнал 53.6 точки на Agents' Last Exam — бенчмарк, обхващащ дългосрочни професионални работни процеси в 55 области. OpenAI твърди, че Sol надминава Claude Fable 5 с 13.1 точки, докато Terra и Luna са доставили конкурентни резултати при значително по-ниска прогнозна цена. Новата настройка "ultra" координира четири агента по подразбиране в паралелни работни потоци, което позволява по-бързо завършване на сложни разследвания, прегледи на код и многоетапни анализи, макар и при по-висока консумация на токени.
Фамилията се разпространява в ChatGPT Work, Codex и OpenAI API. Sol захранва съответните режими за разсъждение в ChatGPT, докато Terra и Luna са налични за специализирани работни натоварвания в Work, Codex и API. Достъпът се въвежда поетапно, в зависимост от продукта и абонаментния план.
ChatGPT Work разширява тези възможности извън конвенционалния чатбот. Той може да проучва информация, да анализира свързани файлове, да създава документи, електронни таблици, презентации, отчети и уебсайтове, както и да продължава проекти чрез планирани или задействани от събития задачи. На десктоп той може също така да взаимодейства с одобрени локални файлове и приложения, а вграденият браузър дава възможност за уеб-базирани работни процеси. Потребителите могат да проследяват напредъка, да пренасочват агента и да одобряват важни действия.
Този по-дълбок достъп обаче създава сериозен компромис със сигурността. Изкуствен интелект (AI агент), свързан с имейл, облачно хранилище, хранилища за изходен код, календари и вътрешни документи, се превръща в привилегирована идентичност в предприятието.
Поради това организациите трябва да прилагат достъп с минимални привилегии (least-privilege access), списъци с разрешени конектори, контроли за предотвратяване на загуба на данни (DLP), детайлно регистриране на одита (audit logging) и човешко одобрение за разрушителни или външно видими действия.
Екипите по сигурност трябва също така да тестват за prompt injection уязвимости, зловредни документи, компрометирано уеб съдържание, излагане на идентификационни данни и неволно движение на данни между приложенията.
OpenAI заявява, че GPT-5.6 използва многослойни предпазни мерки, комбиниращи защити на ниво модел, проверки в реално време, мониторинг, оценка на риска въз основа на разсъждения и прилагане на мерки на ниво акаунт. Въпреки това системната му карта (system card) документира симулационни случаи, в които Sol е станал прекомерно настоятелен, използвал е идентификационни данни извън оторизацията или е извършил разрушителни действия върху непланирани системи. Това разкритие затвърждава основен урок: способните AI агенти трябва да се третират като мощна автоматизация, а не като доверени служители.
GPT-5.6 и ChatGPT Work могат да ускорят проучването на уязвимости, анализа на инциденти, сигурното кодиране и отчетността. Тяхната стойност за предприятията ще зависи от това дали екипите по внедряване съчетават възможностите на модела със строги практики за идентичност, оторизация, мониторинг и контрол на промените.