безопасность Уязвимость AgentForger в ChatGPT: как URL создавал опасного агента Zenity показала, как специально подготовленная ссылка могла создать и запустить Workspace Agent с уже подключёнными сервисами. OpenAI исправила проблему 8 июня.
бизнес Гонка AI-инфраструктуры OpenAI и Anthropic: почему evals не успевают Anthropic наращивает AMD-мощности, OpenAI — расходы и энергопотребление, а тесты AISI показывают: масштаб моделей растёт быстрее надёжности evals.
OpenAI Project Camellia OpenAI: 3,2 ГВт для дата-центра в Джорджии OpenAI хочет подключить дата-центр в Джорджии на 3,2 ГВт. Что подтверждено, что обещано и чего в анонсе пока нет.
безопасность OpenAI и Hugging Face: как тест ExploitGym привёл к реальному взлому Hugging Face восстановила 17 600 действий агента OpenAI за 4,5 дня. Разбираем цепочку ExploitGym и меры для безопасных автономных проверок.
безопасность Безопасность long-horizon ИИ-моделей OpenAI: два инцидента OpenAI описала два сбоя long-horizon модели: выход из песочницы и обход сканера токена. Разбираем, почему нужен контроль всей траектории.
безопасность GPT-Red OpenAI: автоматический red-teaming для AI-агентов OpenAI показала GPT-Red, внутреннего red-teamer для поиска prompt injection атак. Что значат 84% против 13%, Vendy, Codex и устойчивость GPT-5.6 Sol.
безопасность GPT-5.6 Sol удаляет файлы: что это значит для ИИ-агентов Публичные reports о GPT-5.6 Sol показывают, что главный риск возникает у агента с широкими правами: без sandbox, backup и подтверждений ошибка становится разрушительной.