Осем членове на „Центъра за анализ и устойчивост на системния риск“ (Analysis and Resilience Center for Systemic Risk) — организация, включваща директорите по сигурността (CISO) на Goldman Sachs, Morgan Stanley, Citi, Bank of America и Wells Fargo — прекараха месеци в съвместна работа с Anthropic по въпрос, който за техните одитори е по-важен от тестовите показатели. Скот ДеПаскуале, президент и главен изпълнителен директор на центъра, заяви, че тези осем експерти са дефинирали „какво е необходимо за внедряването на най-способните модели от последно поколение (frontier models) в системно важна банка: кой притежава данните, кой съхранява ключовете, какво може и какво не може да вижда автоматизираният преглед и при какви условия на човек изобщо е позволено да ги разглежда.“

Отговорът бе представен във вторник, като Anthropic го нарича Enterprise Frontier Safeguards. Данните за активността, използвани за откриване на злоупотреби, вече могат да се съхраняват в профилите на клиентите в Amazon S3, Azure Blob Storage или Google Cloud Storage, под техните собствени шифроващи ключове, политики за достъп и регистри за одит (audit logging).

Когато автоматизираните системи засекат нещо подозрително, сигналът се изпраща директно на клиента. Никой служител на Anthropic не го чете. За ръководителите на сигурността в регулирани компании това означава, че обработката на предупрежденията за сигурност вече се поема изцяло от техните екипи.

Защо регистрите се съхраняват на първо място

Споразумението за нулево запазване на данни (zero data retention), предпочитано от повечето регулирани купувачи, означава, че потребителските заявки и отговорите се анализират и изтриват незабавно, вместо да се съхраняват. Anthropic премахна тази опция за най-способното си ниво, започвайки с Fable 5, и премина към 30-дневен прозорец на съхранение. Обявената причина бе откриването на злоупотреби. Компанията посочва, че най-сложните форми на злоупотреба се разпростират върху множество задачи, сесии и профили, поради което отделният анализ и незабавното изтриване на всяка интеракция не позволяват откриването на цялостния шаблон на атаката. От Anthropic подчертават, че никога не са обучавали моделите си върху корпоративни данни без изрично разрешение.

Забележителен е фактът, че компанията не твърди, че корелацията изисква съхранение на данни точно за 30 дни, а просто „за значителен период от време“.

Именно тази политика забави корпоративните купувачи. Предприятията в регулираните индустрии разбраха аргументите за сигурност, но въпреки това не можеха да използват моделите, тъй като добавянето на Anthropic като друг доверен доставчик на данни изискваше уведомяване на клиентите им, преработване на договортe и спазване на вътрешните правила за съхранение на чувствителни материали.

Какво търси мониторингът

При новата конфигурация автоматизираните системи анализират непрекъснато цикличен прозорец от трафик за сигнали за сериозни злоупотреби, включително опити за разработване на офанзивни кибернетични или биологични възможности, както и признаци за откраднати или изтекли идентификационни данни.

Кражбата на идентификационни данни е ключовият случай, който оправдава архитекурата на решението. Anthropic наблюдава злоупотреби, свързани с откраднати или присвоени корпоративни данни за достъп — категория, която трудно се открива без наблюдение на трафика за необичайно поведение във времето, тъй като откраднатият ключ генерира единични заявки, изглеждащи напълно нормално. Компанията посочва и автономни агенти, извършващи деструктивно поведение — нов вид дефект, различен от злоупотребата от страна на човек.

Възражението на клиентите никога не е било срещу самия преглед, а срещу това кой го извършва. Много от тези компании работят съгласно строги правила за това кой има право да вижда поверителни правни документи, вътрешна информация или доклади за безопасност на лекарства, а техният персонал вече разполага с необходимия достъп и обучение. С Enterprise Frontier Safeguards човешкият преглед от страна на служители на Anthropic е напълно премахнат от процеса.

От Anthropic заявяват, че са работили с над 100 клиента по дизайна на системата, обхващащи четвърт от Fortune 100 и всяка американска глобална системно важна банка, заедно с Comcast, KPMG, Mastercard, Salesforce и Visa.

„Enterprise Frontier Safeguards ни дава точно това, което поискахме: нашите регистри остават в среда, управлявана от Wells, под ключове, управлявани от Wells. Ние запазваме пълния контрол върху данните си, докато Anthropic извършва откриването на заплахи. Това разделение позволява на екипите ни да внедряват безопасно най-съвременните модели и да изпълняват задълженията си към клиенти, служители и регулатори,“ заяви Муниш Кумар Шарма, CISO в Wells Fargo.

Планира се поддръжка за Claude Code, Claude Enterprise, Claude Platform, Amazon Bedrock, Claude Platform в AWS, Google’s Agent Platform и Microsoft Foundry, с идентични контроли независимо дали купувате директно или чрез облачен партньор. Собственото облачно съхранение, управляваните от клиента шифроващи ключове и напълно автоматизираният преглед се активират по избор и нито едно от тях не променя поведението на модела, цените на API или ограниченията за заявки. Внедряването се извършва на етапи с планирана широка достъпност по-късно тази есен, като отговарящите на условията клиенти получават нулево съхранение на данни за Fable 5 и Fable 5.1, докато дойде техният ред.

Anthropic не таксува допълнително за Enterprise Frontier Safeguards. Клиентите, които съхраняват данните в своя облачен профил, заплащат единствено на своя доставчик за използваната инфраструктура.