OpenAI разработва проактивна, високоустойчива версия на своя водещ AI агент, Codex, научи WIRED.
През последните дни OpenAI започна да добавя код за нова настройка „Постоянен режим“ (Persistent mode) към своята версия на Codex за команден ред, според промени в кодовата база на продукта, прегледани от WIRED. Промените в инструмента за команден ред на Codex се правят публични по подразбиране, а новите функции обикновено се появяват първо там, преди да си проправят път до другите агентски продукти на OpenAI, като десктоп приложението Codex и ChatGPT Work.
Постоянният режим все още не е широко разпространен или официално обявен, но това може да се случи в бъдеще. Говорител на OpenAI потвърди пред WIRED, че компанията тества тази функция, но заяви, че няма незабавни планове за нейното стартиране.
„OpenAI има много отворена култура, ориентирана отдолу нагоре, и много различни неща се изследват в хранилището с отворен код, което е нещо като нашата споделена площадка за игра“, каза Тибо Сотио, ръководител на основните продукти на OpenAI, в изявление за WIRED.
Функцията изглежда е най-новият опит на OpenAI да създаде AI агенти, които хората действително ще искат да използват. OpenAI, Anthropic и Meta се надпреварват да предоставят агентски продукти с общо предназначение, които да помагат на хората да автоматизират задачи в професионалния и личния си живот, като например подаване на отчети за разходи или насрочване на часове при лекар. Досега хората, които използват AI агенти, са предимно софтуерни инженери, но Силициевата долина вярва, че технологията може да се превърне в основен бизнес сектор с много по-широка клиентска база.
Постоянният режим се появява в менюто за „усилия за разсъждение“ (reasoning effort) на Codex, в което потребителите могат да избират нивото на изчислителна мощност, токени и време, които искат да позволят на AI модела за „мислене“, преди да отговори на дадена подкана. Изглежда, че това е една от най-интензивните откъм изчислителни ресурси настройки на OpenAI. Когато потребителите са избрали Постоянен режим, кодовата база на OpenAI указва, че Codex ще „продължи да работи, докато не бъде приспиван“. Това е ярък контраст с наличните в момента режими, които спират работа по дадена задача след няколко минути или часа, дори ако тя не е завършена.
В друг файл в кодовата база OpenAI описва функция в рамките на Постоянния режим, наречена „проактивност“. Това изглежда е вид системна подкана за агенти в Постоянен режим, на които се казва, че работата им не е приключила, когато свършат с отговора на потребителска заявка. Вместо това на агента се указва проактивно да създава последващи задачи за себе си. Агентът е способен да работи по тези задачи в рамките на различни сесии и да използва минали потребителски взаимодействия и „знания за потребителя“, за да реши върху какво да работи. Той също така има инструмент да изпраща съобщения на потребителя, без да е питан, но му е казано да прави това пестеливо.
Инструкциите също така определят граници за агента, според документа. На агента се указва, че Постоянният режим не разширява спектъра на позволените му действия и че промяната на каквото и да е извън собствената система на потребителя изисква предварително одобрение от потребителя – мярка, очевидно предназначена да ограничи рисковете от потенциално опасен постоянен AI агент. Файлът се намира в споделеното ядро на Codex, а не в специфичния за терминала код, което предполага, че функцията за проактивност е предназначена за нещо повече от инструмента за команден ред.
В наскоро излъчени подкасти, интервюта и частни срещи с инвеститори изпълнителният директор на OpenAI Сам Алтман описа желанието си да превърне ChatGPT в проактивен, винаги включен AI агент. OpenAI се надява, че тези промени ще стимулират приемането на най-напредналите AI модели на компанията, които днес се използват само от малка част от общата потребителска база на ChatGPT.
„Има един единствен продукт, който е: трябва да попитам AI нещо“, каза Алтман в скорошен епизод от подкаста на Дейвид Сенра. „В крайна сметка може би AI трябва проактивно да ми предлага неща. Но вие ще имате този интерфейс, който започна като чатбот, а сега разполага и с кодиращи агенти и, мисля, че в даден момент ще се усеща като по-постоянен агент.“
Компанията също така признава, че постоянните AI модели носят повишени рискове. В технически доклад, публикуван тази седмица, OpenAI заяви, че инцидентът с хакването на Hugging Face е бил предизвикан главно от вътрешен изследователски модел, обучен да бъде силно устойчив и постоянен. Компанията казва, че оттогава е изключила този конкретен модел от мрежата си. Въпреки това OpenAI заявява, че е обучила други предстоящи AI модели, включително Astra, да поддържат постоянни агенти.
Един от рисковете, които постоянството засилва, е свързан с подравняването (alignment). Когато са изправени пред неизпълнима задача, OpenAI споделя, че нейните агенти са прибегнали до нежелани средства за решаването ѝ, включително опити за сондиране и компрометиране на изолираната среда, в която се намират.
OpenAI се е опитвала да пусне проактивни AI продукти няколко пъти, но нито един от тях не изглежда е спечелил потребителите. Миналата година OpenAI стартира Pulse – агент, предназначен да създава сутрешни брифинги за потребителите, докато спят, но компанията спря продукта по-рано това лято. Постоянният режим е значително по-амбициозна версия на същия залог.