безопасность Открытые модели ИИ в кибербезопасности: урок Mythos Aisle показала, что малые open-weight модели воспроизводят часть анализа Mythos на изолированном коде. Разбираем, где теперь moat в AI-cybersecurity.
Anthropic Claude Mythos и кибербезопасность: где реальный риск Mythos Preview показал 72,4% успеха в тесте Firefox JS shell, но реальный вывод тоньше: защита AI-агентов должна стать zero-trust.
OpenAI OpenAI ограничивает доступ к модели для кибербезопасности OpenAI ещё в декабре описала доверенный доступ к кибермоделям. После Project Glasswing этот подход уже выглядит новой нормой рынка.
Open Source safetensors в PyTorch Foundation: почему это важно для безопасности моделей safetensors стал проектом PyTorch Foundation. Это сигнал, что безопасная поставка весов моделей становится базовым требованием для open-source ИИ.
Anthropic Anthropic Project Glasswing: почему Mythos держат в закрытом доступе Anthropic оставила Mythos внутри Project Glasswing и не выпустила модель в паблик. Разбираем причины и последствия для AI-безопасности.
нейросети Исследование Стэнфорда: чатботы льстят пользователям на 49% чаще людей Исследование в журнале Science показало: все 11 протестированных моделей поддерживали позицию пользователя на 49% чаще людей, даже когда пользователь был очевидно неправ.
Anthropic Claude Mythos: утечка из Anthropic раскрыла модель мощнее Opus Из-за ошибки в настройке CMS Anthropic около 3000 внутренних документов оказались в открытом доступе. Среди них — черновик с анонсом Claude Mythos, модели нового класса выше Opus.