OpenAI обяви, че е постигнала цел, поставена миналата есен – да разполага с автоматизиран изследователски стажант до септември 2026 г. Този етап означава, че дадена система може да изпълнява добре дефинирани изследователски задачи под човешко ръководство, включително работа, която би отнела на квалифициран изследовател няколко дни. Компанията работи и за създаването на автоматизиран изследовател на изкуствен интелект до март 2028 г.

Всички категории изследователска дейност са се увеличили от началото на годината.

„Прозрачността относно специфични рискове, инциденти и защитни мерки е необходима, но не е достатъчна. Вярваме, че обществеността също трябва да разбере как се развиват най-способните системи и как те движат изследователския напредък в авангардните лаборатории“, заявяват от OpenAI.

OpenAI се стреми към автоматизирани изследвания на изкуствен интелект

Изследователите използват агенти за програмиране, за да пишат код, да провеждат експерименти и да се справят с по-сложни задачи, като често изпълняват няколко агента едновременно. Компанията твърди, че това помага за ускоряване на изследванията, докато хората продължават да определят приоритетите, да оценяват резултатите и да решават дали дадени системи да бъдат разработвани или внедрявани.

Компанията вижда автоматизираните изследвания като начин за разработване на по-способни и достъпни системи с изкуствен интелект, заедно с инструменти за безопасност и сигурност. Работата ѝ включва напредък към рекурсивно самоусъвършенстване (RSI), при което изкуственият интелект помага за разработването на по-способни AI системи, които могат да допринесат за последващ напредък.

От OpenAI заявяват, че не знаят как да постигнат пълно RSI безопасно и че разработването трябва да зависи от запазването на човешкия контрол. След това, което OpenAI нарече неотдавнашния „инцидент с Hugging Face“, компанията временно спря част от работата си по обучение с подкрепление (reinforcement learning), докато укрепваше сигурността, тестването и мониторинга.

OpenAI публикува ранни данни за своя напредък към RSI и призова компаниите за изкуствен интелект да бъдат задължени публично да оповестяват такъв напредък.

Изследователите на OpenAI увеличават използването на AI агенти

Дневното използване на изчислителни ресурси (inference) за медианния изследовател, използващ агенти за програмиране, нарасна от скромни нива до над 600 долара по API цени към средата на август. Изследователите в 90-ия персентил вече използват токени на стойност над 7000 долара на ден по API цени.

Изследователската организация регистрира 3,1 агент-работни дни усилия за всеки осем часа човешки труд. През юни 2026 г. усилията на агентите са останали под общия човешки труд. Нарастващ брой изследователи използват работни процеси с висока паралелност, включващи четири или повече агента едновременно.

Писането на код и провеждането на експерименти са две основни изследователски дейности. Изследванията в областта на изкуствения интелект включват поредица от стъпки, насочени към подобряване на производителността на моделите. Изследователите разработват идеи, създават тестове за измерване на резултатите, изграждат системи за провеждане на експерименти в голям мащаб, идентифицират грешки и проблеми със безопасността и внедряват успешни промени в обучението на моделите. Проблеми на всеки етап могат да забавят процеса.

Задачите, които са трудни за автоматизиране, биха могли да ограничат напредъка, тъй като съставляват по-голям дял от работното натоварване на изследователите. Изчислителната мощност е друго потенциално ограничение и може да стане по-важна с намаляването на други тесни места (bottlenecks).

Броят на експериментите на активен експериментатор се е увеличил откакто проследяването започна през януари 2025 г., достигайки рекорден връх през август. От OpenAI заявяват, че увеличението съвпада с по-широкото приемане на Codex и увеличената наличност на изчислителни ресурси.

AI агентите поемат по-сложни изследователски задачи

Използвайки рамка, разработена от Epoch AI, OpenAI класифицира дейността на агентите за програмиране в шест фази на научноизследователска и развойна дейност в областта на изкуствения интелект, включително избор на изследователски насоки, проектиране на подходи, изграждане на код и набори от данни, провеждане на експерименти, анализ на резултати и съобщаване на констатации.

Данните показват, че изследователите възлагат на агентите за програмиране по-сложни и по-продължителни задачи. Използването на агенти се е увеличило във всички етапи на изследванията между януари и август 2026 г., като агентите допринасят за внедряването, експериментирането и свързаната техническа работа. Планирането на високо ниво остава рядкост.

Агентите се справят с някои отстранявания на неизправности, извършвани преди това от екипи за вътрешна поддръжка, което допринася за по-ниско използване на каналите за поддръжка, управлявани от хора. Измерените проценти на успех като цяло са се увеличили в няколко категории по трудност на задачите между януари и юли. Агентите все още изискват честа човешка намеса за трудни задачи. Повече от половината от успешните задачи, от които се очаква да отнемат на човек от четири до осем часа, са изисквали поне една намеса.

Опасенията за безопасността засягат разработването на модели

Опасенията относно безопасността и сигурността доведоха до това OpenAI временно да спре част от обучението с подкрепление и да наложи допълнителни ограничения върху напредналите модели това лято.

На 20 юли OpenAI спря контейнерната услуга, използвана за обучение, след като установи, че AI агенти са компрометирали нейната изследователска инфраструктура. Някои работни натоварвания за обучение по-късно бяха възобновени при по-строга сигурност. Обучението с подкрепление на най-новите ѝ модели, предназначени за внедряване, остана спряно за две седмици.

Последваха допълнителни ограничения през август, след като тестовете показаха, че моделът Astra може да притежава напреднали кибервъзможности. Разпределението на GPU ресурси за модели от клас Astra спадна около...