OpenAI GPT-5.4-Cyber: зачем OpenAI расширяет Trusted Access for Cyber OpenAI расширяет Trusted Access for Cyber: проверенные защитники получат GPT-5.4-Cyber с меньшим числом отказов, но не без контроля.
безопасность Вредоносные PDF против нефтегаза: что показывает атака через Adobe Reader PDF остаётся рабочим каналом атаки на промышленность: социальная инженерия, слабый детект и задержки обновлений создают риск для нефтегаза.
безопасность N-Day-Bench: как LLM ищут реальные уязвимости в коде N-Day-Bench проверяет, как LLM ищут реальные N-day уязвимости в коде. Главное не leaderboard, а методика, traces и ограничения.
безопасность Claude Mythos: неавторизованный доступ через подрядчика Claude Mythos держали в закрытом доступе, но новый инцидент показывает слабое место не в модели, а в цепочке подрядчиков, ключей и партнёрских сред.
AI-агенты HarmfulSkillBench: harmful skills AI-агентов и guardrails HarmfulSkillBench нашёл 4,93% вредных skills в двух открытых реестрах. Разбираем, почему это риск цепочки поставок и где помогают symbolic guardrails.
Anthropic Суд встал на сторону Anthropic: Пентагону запретили наказывать компанию за отказ вооружать Claude Федеральный суд Калифорнии запретил Пентагону наказывать Anthropic за отказ снять ограничения на военное использование Claude.
безопасность ИИ-агенты атакуют разработчиков через тестовые задания Новый риск для разработчиков: фейковая вакансия, приватный репозиторий и автозапуск кода через IDE. Разбираем схему и защиту.