безопасность Публичные чаты Claude в поиске: что произошло и как закрыть доступ Публичные снимки чатов Claude находили через поисковики. Разбираем, почему это не взлом закрытых переписок и как отозвать общую ссылку.
безопасность Hugging Face требует раскрыть трассы ИИ-агентов OpenAI Hugging Face просит OpenAI раскрыть трассы агентов и выделить $100 млн на защитные инструменты. Что это даст исследователям и какие вопросы остаются.
безопасность Утечка данных в Grok Build: что известно и как защитить ключи Grok Build 0.2.93 отправлял Git bundle с файлами и историей. Разбираем доказательства, реакцию xAI и шаги для защиты ключей.
безопасность Уязвимость AgentForger в ChatGPT: как URL создавал опасного агента Zenity показала, как специально подготовленная ссылка могла создать и запустить Workspace Agent с уже подключёнными сервисами. OpenAI исправила проблему 8 июня.
безопасность OpenAI и Hugging Face: как тест ExploitGym привёл к реальному взлому Hugging Face восстановила 17 600 действий агента OpenAI за 4,5 дня. Разбираем цепочку ExploitGym и меры для безопасных автономных проверок.
безопасность Безопасность long-horizon ИИ-моделей OpenAI: два инцидента OpenAI описала два сбоя long-horizon модели: выход из песочницы и обход сканера токена. Разбираем, почему нужен контроль всей траектории.
безопасность Ограничат ли в США китайские ИИ-модели после Kimi K3 США обсуждают меры против китайских ИИ-моделей, но общего запрета нет. Объясняем, что это меняет для API, локального запуска и бизнеса.