безопасность Ghostcommit: prompt injection через PNG и AGENTS.md Ghostcommit показывает новую слепую зону AI code review: инструкция спрятана в PNG, AGENTS.md ведёт агента к файлу .env, а секреты уходят в обычный коммит.
LLM Databricks GLM 5.2: почему AI-кодинг считают по задаче Databricks показала, почему для AI-кодинга важнее цена за выполненную задачу, чем стоимость токена: GLM 5.2 стала кандидатом на daily coding model.
AI-агенты GitHub Copilot code review: как workflow-инструкции снизили стоимость ревью GitHub показал редкий публичный кейс: агент для ревью стал дешевле после переписывания workflow-инструкций, а не после смены модели или инструментов.
AI-агенты AgentLens benchmark для coding agents: почему pass/fail уже мало AgentLens оценивает coding agents по полной траектории работы, а не только по pass/fail. Разбираем методику, первые результаты Java fold и ограничения paper.
OpenAI OpenAI нашла, что треть SWE-Bench Pro сломана: что это значит для AI-кодинга OpenAI отзывает рекомендацию SWE-Bench Pro после аудита задач. Что значит 30% broken tasks для AI-кодинга, leaderboard и внутренних evals компаний.
безопасность HalluSquatting: supply-chain атака на AI coding tools HalluSquatting делает галлюцинации LLM риском цепочки поставки: coding agent может скачать и запустить ресурс, который атакующий занял заранее.
Gemini Gemini API Managed Agents получили background execution и MCP Google добавила в Gemini API Managed Agents background execution, remote MCP servers, custom functions и refresh credentials. Разбираем пользу и ограничения.