Anthropic официално пусна Claude Opus 5 – модел от ново поколение с голям езиков модел (LLM), проектиран да повиши производителността в софтуерното инженерство и сложната умствена работа, като същевременно поддържа строг контрол върху офанзивните възможности за киберсигурност.
Позициониран като модела по подразбиране в Claude Max и най-мощната опция в Claude Pro, Opus 5 предоставя икономически ефективна алтернатива, която се доближава до върховото ниво на интелигентност на Claude Fable 5 на приблизително половината от цената.
Claude Opus 5 открива уязвимости
Opus 5 показва най-съвременни резултати при основните бенчмаркове за кодиране и знания, включително Frontier-Bench и GDPval-AA, въпреки че все още изостава от специализирания модел Mythos 5 при тясно нишови оценки на киберсигурността.
В сравнение със своя предшественик, Opus 4.8, Opus 5 осигурява значителен скок в производителността:
- Frontier-Bench v0.1: Повече от два пъти по-висока производителност при по-ниски разходи за задача.
- CursorBench: Постига почти пълно сходство с Fable 5 при приблизително наполовина по-ниски оперативни разходи.
- Знания и автоматизация: Силни резултати при ARC-AGI, OSWorld 2.0 и пакети за автоматизация на работния процес, което прави Opus 5 особено привлекателен за генериране на корпоративен код.
От гледна точка на сигурността, най-забележителната промяна в Opus 5 е в начина, по който моделът се справя с откриването на уязвимости в сравнение с генерирането на експлойти.
Anthropic съобщава, че Opus 5 се доближава до Mythos 5 при идентифицирането на софтуерни дефекти, включително при техния тестов пакет за оценка OSS-Fuzz, където и двата модела се представят по сходен начин при откриването на грешки.
Според бележките по версията на Anthropic, Opus 5 постига значително по-ниски резултати, когато има задача да превърне тези уязвимости в работещи експлойти. Този преднамерен избор на дизайн не позволява на модела да развива рискови възможности с двойна употреба.
На практика екипите по сигурността могат да използват модела за автоматизирано откриване на уязвимости в изходния код и системите, но ще се сблъскат със сериозни пречки, ако се опитат да превърнат тези констатации в работещ злонамерен код.
За да наложи това разграничение, Anthropic внедри специализирани класификатори за киберсигурност около Opus 5. Моделът има разрешение да помага при откриването на уязвимости на ниво изходен код, но по подразбиране блокира сканирането на двоични файлове, тестовете за проникване и генерирането на експлойти.
Когато потребителска заявка задейства тези граници на сигурност в Claude.ai, Claude Code или Claude Cowork, трафикът автоматично се пренасочва обратно към Opus 4.8, вместо да се изпълнява под Opus 5.
Предприятията могат по избор да конфигурират същите механизми за резервен вариант чрез API интеграции.
Тази защитена архитектура контрастира с неограничените офанзивни платформи с изкуствен интелект, които се опитват да автоматизират целия процес на компрометиране.
За проверени организации за сигурност Anthropic предлага програмата „Cyber Verification Program“, която предоставя оторизирана конфигурация на Opus 5 с намалени ограничения в подкрепа на важни дефанзивни сценарии, без да се излагат на риск офанзивни инструменти.
Дефанзивни последици за конвейерите за сигурност на приложенията (AppSec)
За корпоративните екипи по сигурността Opus 5 очертава ясна посока за подпомаганата от изкуствен интелект сигурност: осигуряване на високоскоростен анализ на код и идентифициране на уязвимости, докато се ограничава автоматизираното разработване на експлойти.
Този баланс позволява на екипите по сигурността да разглеждат компромиса не като ограничение, а като стратегическо предимство за защитниците.
Чрез интегрирането на Opus 5 в тръбопроводите за статичен анализ, процесите на фъзинг и инструментите за защитен жизнен цикъл на разработка (SDLC), организациите могат драстично да ускорят циклите на отстраняване на уязвимости и да открият скрити недостатъци в кода, преди злонамерени субекти да успеят да ги експлоатират.