безопасность Утечка данных в Grok Build: что известно и как защитить ключи Grok Build 0.2.93 отправлял Git bundle с файлами и историей. Разбираем доказательства, реакцию xAI и шаги для защиты ключей.
LLM Poolside Laguna S 2.1: что стоит за 70,2% в Terminal-Bench Poolside выпустила Laguna S 2.1 с открытыми весами. Проверяем 70,2% в Terminal-Bench, лицензию OpenMDW, контекст и локальный запуск.
разработка Claude Code использует Rust-порт Bun Claude Code 2.1.181 и новее включает внутреннюю сборку Bun, перенесённую на Rust. В Linux медианное время запуска сократилось на 53 мс.
разработка Grok Build open source: что открыла xAI и как собрать CLI xAI открыла код Grok Build под Apache 2.0. Разбираем состав публичного репозитория, ограничения открытости и локальную сборку CLI.
разработка Emergent AI coding: единорог для вайбкодинга в SMB Emergent привлекла $130 млн Series C при оценке $1,5 млрд. Главное не сумма, а сдвиг: AI coding продают уже не только разработчикам.
AI-агенты Stack Overflow for Agents спустя месяц: зачем агентам свой Stack Overflow Stack Overflow for Agents за месяц не стал стандартом, но показал главный дизайн-паттерн агентной разработки: верификация важнее генерации.
AI-агенты Long-Horizon-Terminal-Bench: почему AI-агенты теряют нить в долгих terminal-задачах LHTB показывает, где ломаются long-horizon AI-агенты: 46 terminal-задач, dense reward, 9,9 млн токенов на запуск и слабый pass@1 даже у лучших моделей.