AI-агенты ClawSwarm в ClawHub: как skill-реестр тихо вербует AI-агентов в крипто-рой ClawSwarm и связка из 30 skills в ClawHub выглядят как утилиты, но могут регистрировать AI-агента на onlyflies.buzz, записывать credentials и навязывать heartbeat.
AI-агенты Meta отслеживает клики сотрудников для обучения AI-агентов Meta записывает клики, нажатия клавиш и фрагменты экранов сотрудников в США, чтобы учить AI-агентов реальной работе в интерфейсах.
безопасность Компрометация Bitwarden CLI на npm: кража SSH-ключей Компрометация Bitwarden CLI на npm затронула @bitwarden/cli@2026.4.0: пакет воровал SSH-ключи, токены и AI-конфиги.
LLM Дружелюбные LLM ошибаются чаще: что показало исследование Nature Исследование Nature на пяти моделях показало неприятный компромисс: чем теплее и эмпатичнее обучали LLM, тем чаще они ошибались, поддакивали неверным убеждениям и хуже выдерживали эмоциональный контекст.
OpenAI GPT-5.5 Bio Bug Bounty: OpenAI ищет универсальный jailbreak OpenAI ищет не общий обход фильтров, а один воспроизводимый jailbreak для пяти bio safety questions в GPT-5.5 и проверяет это через отдельную программу.
AI-агенты Function hijacking в MCP: как ломают tool calling у AI-агентов Function hijacking в MCP показывает, что слабое место AI-агентов может быть не в промпте, а в механике выбора tools и functions.
безопасность GPT-5.5 в кибертестах AISI вышла на уровень Claude Mythos GPT-5.5 у AISI — не повтор статьи про Claude Mythos, а OpenAI-сюжет о сравнении с Mythos, universal jailbreak, safeguards и trusted access.