Anthropic насочи модела Claude Mythos Preview към 281 проекта с отворен код и събра 23 019 потенциални уязвимости. Външни компании за сигурност са прегледали 1 900 от тях. Поддържащите екипи са получили 1 596 доклада и са потвърдили 1 451; 97 корекции за сигурност са внедрени в основните кодови бази, а 88 констатации са публикувани като официални бюлетини за сигурност (данните са актуални към 22 май 2026 г.). Останалите 21 119 потенциални уязвимости не са били преглеждани от никого извън Anthropic.
Anthropic обяснява този спад с недостига на специалисти, които да проверят резултатите, а прегледаната част потвърждава това: 1 726 от 1 900 (или 90.8%) са се потвърдили като реални уязвимости. Echo, компанията за сигурност на софтуерната верига за доставки, която събра тези данни, прави важно уточнение: изпратените 1 900 уязвимости за преглед едва ли са били произволно избрани, така че процентът от 90.8% вероятно показва само колко добри са били най-добрите кандидати. Anthropic не е публикувала данни за точността при останалите 21 000 сигнала.
Оценките за сериозност не издържаха проверката
На 27 от 88-те официални съобщения бяха присвоени CVE идентификатори. Mythos определи осем от тях като критични (Critical), 15 като високи (High) и четири като средни (Medium), и нито една като ниска (Low). Независимото оценяване по CVSS и засегнатите поддържащи екипи дадоха различно разпределение: една критична, 16 високи, осем средни и две ниски. Само една от осемте критични оценки на модела се потвърди.
Две понижения на степента на сериозност показват какво моделът не е успял да вземе предвид. За Temporal Server Mythos определи степен „Критична“ и описа как атакуващ може да контролира работните процеси между отделните пространства от имена (namespaces). Поддържащите екипи на Temporal оцениха проблема на 2.3 („Ниска“), тъй като за извършване на атаката се изисква контролирано от киберпрестъпника пространство от имена, което вече притежава привилегировани вътрешни идентификационни данни, а въздействието засяга само известни работни процеси. При MinIO Mythos отново посочи „Критична“, външна фирма за сигурност определи степен „Висока“, а MinIO прие степен „Средна“: за атаката е необходим съществуващ JWT токен с администраторски права за клъстера и се предоставя достъп само за четене. Нивото на сериозност зависи от предположенията за внедряване, границите на привилегиите и предварителните условия за атака, а те са трудни за извличане единствено от изходния код.
Констатациите, които пристигат с предварително определена оценка, са входни данни за сортиране (триаж) от екипа по сигурност. При 14 от общо 27 случая има съществено разминаване в сериозността, като при 13 от тях тя е била надценена, а при един – слабост в инструмента за команден ред jq за JSON – е била подценена. Опашка от задачи, подредена по собствените оценки на модела, би извела начело работа, която не принадлежи там.
Скокът в създаването на експлойти е реален, но с определени уговорки
Anthropic създаде бенчмарк от 50 предварително открити уязвимости в JavaScript енджина SpiderMonkey, включен във Firefox 147, след което даде на всеки модел по пет опита за уязвимост – общо 250 опита. Claude Mythos Preview превърна известен срив на системата в работещ злонамерен код за произволно изпълнение на код при 181 от опитите (72.4%) и достигна до частичен контрол над регистрите при още 29 опита.
Claude Opus 4.6 успя да постигне това само при два опита, което е процент на успех под 1%. Това представлява приблизително 90-кратен скок между поколенията модели, но той е съпроводен от три важни условия: всеки опит започва от срив, който вече е бил открит от човек; средата за тестване премахва изолираната среда (sandbox) на браузъра Firefox и други защити в дълбочина; оценката е проектирана и проведена от Anthropic без независима репликация.
Цената също се промени. Anthropic превърна известна use-after-free уязвимост в ядрото на Linux в работещ зловреден код за придобиване на root права за по-малко от 2000 долара разходи за изчисления и за под един ден време за работа, като я комбинира с втора use-after-free уязвимост, открита в планировчика за управление на трафика на ядрото. Откриването на уязвимост, която си струва да бъде адресирана, все още струва няколко хиляди долара, без гаранция, че резултатът ще бъде дефект с висока или критична сериозност.
През юли 2026 г. Echo анкетира над 80 старши ръководители по сигурността в САЩ. В това проучване 37% посочват откриването на повече уязвимости, отколкото могат да бъдат коригирани, като най-голямата бариера пред подобряването на сигурността на софтуерната верига за доставки, а 11% заявяват, че по-доброто засичане или сканиране би било следващата им инвестиция. Anthropic ръчно е потвърдила още уязвимости, които не е изпратила на поддържащите екипи, тъй като нейният собствен екип и външните ѝ партньори нямат достатъчно капацитет за преглед, за да се справят с тях.