Алианс от над 100 технологични компании и други организации предлага система за докладване на безопасността на AI агенти (агенти с изкуствен интелект), която според групата ще помогне да се предотврати нанасянето на щети на обществото от компрометирани или извън контрол модели.

Инициативата „Споделен обмен на разкрития за ИИ“ (Shared AI Findings Exchange – SAFE), изготвена от работна група на Open Secure AI Alliance, има за цел да създаде механизми за събиране на информация за инциденти със сигурността, свързани с изкуствен интелект, споделяне на тази информация със засегнатите организации, идентифициране на общи черти между инцидентите и публикуване на препоръки въз основа на извлечените поуки.

Във вторник Linux Foundation, един от водещите членове на алианса, публикува покана за коментари по предложението. От членовете на SAFE ще се очаква да споделят информация за инциденти в определени срокове, като например 72 часа за уведомяване на клиентите за „достоверно изтичане на данни“ и четири работни дни за докладване на инцидент към борсата за обмен. Организациите ще разполагат с 30 дни, за да публикуват предварителен доклад за инцидент, „в зависимост от съображения за сигурност, правни и разследващи ограничения“.

Предложението идва в момент, когато политиците и лидерите в технологичната индустрия се борят с възхода на AI агентите, тяхното интегриране в чувствителни бизнес функции и липсата на надзор, който тези инструменти обикновено получават. То следва и скорошни високопрофилни инциденти, при които модели на OpenAI и Anthropic автономно избягаха от тестовите си среди и хакнаха други компании.

„Днес организациите често разследват инциденти със сигурността на ИИ вътрешно, като ценните оперативни знания остават в отделните компании“, заявяват от Linux Foundation в публикация в блога си. „Няма широко възприета общностна рамка за поверително споделяне на оперативни сривове на ИИ, идентифициране на повтарящи се повреди в контрола и превръщане на тези уроци в повторно използваеми насоки за защита в рамките на цялата екосистема.“

Системата SAFE ще работи по „неутрален“ начин и ще бъде независима от контрола на който и да е доставчик, обещават от Linux Foundation. От членовете ще се очаква да докладват за инциденти, включващи както търговски системи, така и системи с отворен код.

Членовете на алианса Cisco, CrowdStrike, Hugging Face, NVIDIA и Red Hat помогнаха на Linux Foundation при изготвянето на предложението за SAFE. Hugging Face беше една от няколкото организации, които моделите на OpenAI хакнаха, след като излязоха извън контрол.

Все още не е ясно какъв отзвук ще получат насоките в света на политиките или в ИИ общността. OpenAI и Anthropic – двете компании с най-голямо влияние по въпросите на ИИ – не са членове на Open Secure AI Alliance.