Ерата на отцепилите се ИИ хакерски агенти настъпи — но това не трябваше да се случва по този начин.

След като агент на OpenAI проби платформата Hugging Face по-рано този месец, двете компании заявиха тази седмица, че хакерската серия е била по-обширна, отколкото се смяташе досега, и е включвала също така прониквания в множество акаунти и услуги на трети страни като част от атаката срещу Hugging Face. Инцидентът предизвика вълнения в общността по киберсигурност на фона на по-широки дискусии за това как развиващите се възможности на изкуствения интелект променят както офанзивното хакерство, така и цифровата защита. Но с появата на повече информация много изследователи заключиха, че вместо да изясни следващата граница пред ИИ, епизодът просто е подчертал дългогодишни проблеми в киберсигурността, които са по-значими от всякога в ерата на изкуствения интелект.

„Хората действат изключително безразсъдно. Шокиращо е колко малко се е мислило за подобен сценарий“, казва Алекс Зенла, съосновател и главен технически директор на фирмата за облачна сигурност Edera. „Считам целия ИИ и всичко, до което ИИ се докосва, за напълно ненадеждно — което е нормално, просто трябва да изграждате защити срещу това. И тази ситуация доказва твърдението. Фактът, че OpenAI не са били по-параноични по този въпрос, изглежда малко безотговорен.“

OpenAI не предостави коментар за тази статия преди публикуването й.

Компанията заяви в първоначалното си разкритие за хакерската атака срещу Hugging Face, че един от двата модела, които са преминали границите на изолация и са попаднали в отворения интернет за дни, е бил експериментален прототип, който никога не е бил предназначен за пускане. OpenAI също така отбеляза, че ситуацията е възникнала отчасти защото „предпазните мерки за внедряване умишлено не са били активирани“ и на двата модела с цел тестване. „Този инцидент показва необходимостта от допълнително укрепване на съгласуваността на нашия модел, киберзащитата по време на оценка и мониторинга по време на вътрешно тестване“, написа компанията.

OpenAI също така заяви в актуализация тази седмица, че след пробива в Hugging Face е „деактивирала, шифровала и ограничила [непуснатия модел] от достъп за изследвания“. Въпреки че винаги има място за подобрение на състоянието на сигурността във всяка компания, съществуващите предпазни мерки на OpenAI сами по себе си биха могли да предотвратят или минимизират инцидента, ако бяха в сила.

„Един прост анализ на действителния риск има съвсем прост отговор“, казва дългогодишният консултант по сигурност и съответствие Дави Отенхаймер. „Грешките на OpenAI бяха изключително елементарни.“

Множество източници подчертаха пред WIRED, че моделите на OpenAI изглежда са избягали от изолация и поради пропуски в прилагането на основни най-добри практики за сигурност — включително „нулево доверие“ и „дълбока защита“ — които снабдяват цифровите системи със слоеве на защита и предпазни механизми за минимизиране на щетите, когато нещо се обърка. Въпреки че няма такова нещо като перфектна сигурност, изследователите и практиците са прекарали последните две десетилетия в разработване и популяризиране на дефанзивни стратегии, които са се доказали като устойчиви, но изискват постоянни инвестиции на време и пари за внедряване.

Може да бъде трудно за малкия бизнес, лошо финансираните групи в обществен интерес или новосъздадените организации да отделят ресурси за приоритетно инвестиране в базова сигурност. Но с оценка от 850 милиарда долара и наемането на ветерани от цялата технологична индустрия, OpenAI не е в неизгодно положение за прилагане на най-добрите практики за сигурност.

Фундаменталните защити, които биха могли да предотвратят хакерския поход на моделите на компанията, са добре известни в индустрията. Говорейки за откриването на уязвимости в Chrome в сряда, преди да станат известни подробностите за допълнителните пробиви на моделите на OpenAI, директорът по инженерство на Chrome Дъг Търнър каза пред WIRED, че търсенето и отстраняването на грешки, управлявано от ИИ, изисква конвейер, който е изграден „с мисъл за сериозни предпазни ограничения“.

За вътрешните ИИ услуги, които оценяват Chrome, „всичко работи в контейнер, всичко е изолирано от интернет. Всяка изходяща мрежова активност към система за проследяване на грешки е строго регулирана и ние следим за подозрителна активност“, казва Търнър. „Това е задължително нещо, когато се прави такъв тип работа, защото искаме да сме сигурни, че моделите не могат да изпълняват системни команди или да установяват изходяща връзка извън изолираната среда. И се надяваме, че и други ще възприемат подобен подход.“

OpenAI заяви в актуализираната си публикация в блога във вторник, че „извършва задълбочен преглед заедно с външни съветници“ и че ще публикува технически анализ на инцидента „през следващите седмици“. Компанията добави: „Приемаме сериозно нашата отговорност да идентифицираме и да се подготвяме за рискове от все по-способни системи с изкуствен интелект.“

Въпреки че ИИ е нов и разрушителен елемент в сложната сфера на киберсигурността, вече има множество налични услуги и инструменти, които са фокусирани върху справянето със заплахата от отцепил се ИИ по различни начини и от различни гледни точки. Проекти с отворен код като IronCurtain и Wirken, създадени от Отенхаймер, имат за цел да ограничат ИИ агентите и да изискват отчетност. А двегодишният стартъп на Зенла...