AI-агенты T-Search: как открытый агент ищет доказательства для сложных запросов T-Search — открытый агентный ретривер Т-Банка. Он ищет доказательства в несколько раундов и отдаёт ранжированные сниппеты, но требует собственного backend и генератора.
безопасность GPT-Red OpenAI: автоматический red-teaming для AI-агентов OpenAI показала GPT-Red, внутреннего red-teamer для поиска prompt injection атак. Что значат 84% против 13%, Vendy, Codex и устойчивость GPT-5.6 Sol.
AI-агенты Агентный поиск и галлюцинации LLM: 120 ссылок против 8 Habr/SP-AI показал: один и тот же генератор без поискового контура получил 120 пометок о выдуманных ссылках, а с агентным контуром — 8.
безопасность GPT-5.6 Sol удаляет файлы: что это значит для ИИ-агентов Публичные reports о GPT-5.6 Sol показывают, что главный риск возникает у агента с широкими правами: без sandbox, backup и подтверждений ошибка становится разрушительной.
безопасность AI-увольнения Meta: иск о скоринге сотрудников 26 сотрудников утверждают, что Meta использовала AI-инструменты и метрики продуктивности при сокращении. Компания это отрицает.
безопасность AI-агенты атакуют AI-агентов: защитники используют prompt injection против hacking agents AI-агенты атакуют AI-агентов: Tracebit показала defensive prompt injection и context bombing против hacking agents. Почему это не заменяет архитектурную защиту.
AI-агенты Stack Overflow for Agents спустя месяц: зачем агентам свой Stack Overflow Stack Overflow for Agents за месяц не стал стандартом, но показал главный дизайн-паттерн агентной разработки: верификация важнее генерации.