В сряда Google обяви Gemini 3.8 Flash Cyber, който определи като най-способния си модел за киберсигурност, и го предостави на група от доверени защитници чрез нова инициатива, наречена Fairwind Program.
„Програмата Fairwind предоставя на високоприоритетни защитници (като правителства, здравни заведения и телекомуникационни услуги) ранен достъп до усъвършенствани модели, които им помагат да изградят по-добра защита, преди да се появят нови заплахи“, заявиха от Google. „Така защитниците имат предимство от самото начало, което им помага да защитят жизненоважна инфраструктура – което от своя страна защитава хората, разчитащи на тези системи.“
Технологичният гигант сподели, че в момента работи с над 650 партньори в световен мащаб, сред които CrowdStrike, Datadog, Menlo Security, Palo Alto Networks и Snowflake. Програмата е достъпна за група клиенти на Google Cloud, държавни агенции и партньори в областта на киберсигурността.
Пускането на Gemini 3.8 Flash Cyber идва малко повече от месец след като Google представи Gemini 3.5 Flash Cyber. Най-новият модел се подобрява спрямо своя предшественик, като демонстрира производителност от най-високо ниво при автономното откриване на уязвимости, дори изпреварвайки по-големи водещи модели на конкуренти като Anthropic (Mythos 5) и OpenAI (GPT-5.6 Sol и GPT-5.5-Cyber).
„С Gemini 3.8 Flash Cyber се фокусирахме специално върху това да оборудваме защитниците с експертни възможности, които им дават предимство пред атакуващите. Ето защо инвестирахме в отстраняването на уязвимости от самото начало и му дадохме приоритет пред офанзивни възможности като експлоатация“, казаха Тулси Доши, старши директор по продуктовия мениджмънт, и Ралука Ада Попа, ръководител на Gemini Security в Google DeepMind.
Anthropic дебютира с Claude Fable 5.1 и Claude Mythos 5.1
Разработката съвпада с пускането от Anthropic на Claude Fable 5.1 и Claude Mythos 5.1 с различни нива на мерки за безопасност, като последният е достъпен само чрез нейните програми за доверен достъп и поддържаща работа в областта на киберсигурността и науките за живота.
Компанията също така заяви, че вече позволява Fable 5.1 да се използва за идентифициране на софтуерни уязвимости, но очаква все още да пренасочва някои задачи по киберсигурност към моделите Opus, като „тестване за проникване, генериране на експлойти и сканиране за уязвимости на двоично ниво“.
„Направихме оценки на това как Claude Mythos 5.1 реагира на злонамерени заявки и инжектиране на подкани (злонамерени инструкции, скрити в съдържанието, обработвано от AI модели)“, отбелязаха от Anthropic. „Той отказа злонамерени заявки за автономно писане на код и използване на компютър с процент, сравним с Mythos 5, Sonnet 5 и Opus 5, и е най-устойчивият ни модел до момента при външни бенчмаркове за инжектиране на подкани.“
Компанията за изкуствен интелект (AI) оттогава обяви и ново решение, наречено Enterprise Frontier Safeguards (EFS), което според нея комбинира „поверителността на политиката за без запазване на данни (ZDR) с най-съвременните защити за откриване на злоупотреби“, като същевременно дава на бизнеса пълен контрол върху това как неговите данни се преглеждат, съхраняват и управляват. OpenAI разполага с подобно решение, известно като Private Safety Processing.
Освен това от Anthropic заявиха, че са внедрили допълнителни мерки за укрепване и изолиране, увеличили са мониторинга за откриване на разминавания в поведението на модела и са спрели външните оценки за киберсигурност на предварително пуснати модели в отговор на инциденти с неоторизиран достъп, включващи модели Claude срещу реални системи.
Признавайки, че инцидентите са били „пропуск в оперативната сигурност“, от Anthropic заявиха, че са изградили класификатор, който открива и блокира опити за бягство от изолирана среда, и са променили спецификациите около възнагражденията на модела, за да се справят с опасенията, при които AI агент прибягва до пряк път за манипулиране на метриката без действително постигане на предвидената цел.
OpenAI твърди, че Astra покрива критичния праг за възможности в киберсигурността
От своя страна OpenAI разкри, че предстоящият му модел Astra покрива прага за критични възможности за киберсигурност съгласно неговата рамка за подготвеност (Preparedness Framework) и че възнамерява да направи най-усъвършенстваните си функции за киберсигурност достъпни за група тестери чрез програмата Daybreak Blue.
Обозначението „Критично“ се прилага, когато един AI модел може самостоятелно да открива и експлоатира zero-day уязвимости в множество добре защитени системи или да извърши пълна кибератака срещу защитена цел само от инструкция на високо ниво, без човек да го напътства по време на процеса.