Meta разкри, че един от нейните модели с изкуствен интелект (ИИ) е получил нежелан достъп до интернет по време на оценка на киберсигурността и след това е експлоатирал уязвимост в системата на друга организация. Инцидентът е станал по време на тестове, проведени с независимата фирма за сигурност на ИИ Irregular, според Meta.
Говорител на Meta заяви, че събитието е било причинено от неправилна конфигурация в тестовата среда. ИИ моделът е трябвало да работи в контролирана среда. Грешката в конфигурацията обаче му е дала достъп до отворения интернет.
След като се е свързал, моделът е идентифицирал и експлоатирал слабост в сигурността на неназована услуга на трета страна. Meta не е идентифицирала засегнатата организация, нито е предоставила технически подробности за уязвимостта.
Meta разследва инцидента и ще публикува допълнителна информация, след като фактите бъдат установени. Компанията описа събитието като сходно с неотдавнашни случаи, включващи други големи разработчици на ИИ, при които модели са осъществили достъп до системи извън предвидените им тестови среди.
Оценката е била извършена от Irregular – компания за тестване на киберсигурността на ИИ, която е извършила тестове и за Anthropic. Говорител на Irregular заяви пред BBC, че инцидентът с Meta е свързан със същия проблем в средата за оценка, който Anthropic разкри по-рано.
Съобщава се, че фирмата подготвя насоки за това как да се провеждат по-безопасно тестове за киберсигурност, включващи автономни ИИ агенти. Разкритието идва, след като OpenAI и Anthropic съобщиха за свързани инциденти през последните седмици.
OpenAI заяви, че нейните експериментални агенти са намерили начин да получат достъп до публичния интернет от изолирана тестова среда (пясъчник), докато са се опитвали да изпълнят задача по киберсигурност.
Моделите са експлоатирали zero-day уязвимост в прокси за кеширане на регистъра на пакети, след което са извършили ескалация на привилегии и странично движение (lateral movement) в изследователската среда, преди да достигнат до система, свързана с интернет. OpenAI заяви, че уязвимостта е била отговорно разкрита на доставчика.
По-късно Anthropic съобщи, че нейните модели Claude са осъществили достъп до системите на три организации по време на кибероценки. В този случай неправилно конфигурирана среда е оставила системите достъпни от публичния интернет, въпреки че на моделите е било казано, че достъпът до интернет не е наличен.
Anthropic спря кибероценките след откриване на активността и започна преглед на процеса на тестване. Тези събития не означават, че ИИ моделите са съзнателни или че действат с престъпни намерения.
Вместо това те показват как моделите могат да преследват целта на задачата по неочаквани начини, когато им се даде достъп до инструменти, идентификационни данни, изпълнение на код или мрежови връзки.
Модел, натоварен със задачата да намери скрит флаг, да заобиколи контрола или да завърши киберпредизвикателство, може да открие пътища, които оценителите не са предвидили. За екипите по сигурността инцидентите засилват важността на строгия контрол при оценяването.
Средите за тестване на ИИ трябва да използват мрежова изолация, разрешения с най-малки привилегии, сегментирана инфраструктура, наблюдаван изходящ трафик и независимо проверени прегледи на конфигурацията.
Организациите също така се нуждаят от ясни процеси за реагиране при инциденти при неуспешни тестове, включително бързо ограничаване, уведомяване на засегнатите страни и съдебно-криминалистичен (форенсик) преглед.
Разкритието на Meta допълва нарастващите доказателства, че агентските ИИ системи могат да създадат реален киберриск, когато границите на безопасност пропаднат. Ключовият извод е, че заплахата може да идва не само от възможностите на ИИ модела, но и от слабия дизайн на тестовата среда и пренебрегнатите пътища за достъп.