Claude Cog: когнитивная архитектура памяти для Claude Code на чистом тексте Open-source когнитивная архитектура, которая учит Claude Code управлять собственной памятью через обычные текстовые файлы. 300 звёзд на GitHub за первую неделю.
AI-агенты Repo-level code localization: где AI-агенты ловят keyword shortcut Repo-level code localization кажется сильнее, чем есть: новый paper показывает роль keyword shortcut и объясняет, что меняют KA-LogicQuery и LogicLoc.
AI-агенты Rubric-Based GRM для SWE agents: почему pass/fail мало Разбираем paper Rubric-Based GRM: как рубрики помогают обучать SWE-агентов лучше, чем один pass/fail по unit-тестам.
AI-агенты GTA-2 benchmark AI-агентов: где у агентов ломается работа GTA-2 показывает неприятный разрыв: AI-агенты выбирают инструменты лучше, чем доводят рабочий сценарий до финального результата.
безопасность ИИ-агенты атакуют разработчиков через тестовые задания Новый риск для разработчиков: фейковая вакансия, приватный репозиторий и автозапуск кода через IDE. Разбираем схему и защиту.
безопасность Взлом Vercel: AI-инструмент стал входом в инфраструктуру Инцидент Vercel показывает, как сторонний AI-инструмент и OAuth-доступ превращаются в supply-chain риск для разработки.
AI-агенты Stripe Minions: 1 300 PR в неделю без единой строчки кода Stripe мержит более 1 300 пулл-реквестов в неделю без единой строки человеческого кода. Разбираем, как устроены агенты Minions: devbox-ы, блюпринты, MCP-инструменты и жёсткие ограничения.