LLM ByteDance MMProLong: почему вопросы к длинным документам полезнее OCR Разбираем ByteDance MMProLong: почему VQA-обучение длинных документов оказалось сильнее OCR-транскрипции и что это значит для PDF-ассистентов.
Google Vibe coding на Android: что Google меняет в AI Studio Google переносит вайб-кодинг в нативный Android-контур AI Studio. Разбираем, что можно собрать по промпту и где всё ещё нужна инженерная проверка.
DeepSeek DeepSeek: ценовая война API-моделей начинается с V4 Pro DeepSeek закрепляет скидку 75% на V4 Pro как постоянный API-прайсинг. Разбираем, почему это давит на GPT-5.5, Claude Opus 4.7 и экономику AI-агентов.
AI-агенты Qwen3.7-Max: автономный coding-agent Alibaba работал 35 часов Alibaba заявляет, что Qwen3.7-Max автономно оптимизировал kernel-код 35 часов. Главное — не 10x speedup, а ставка на long-horizon agents.
безопасность Claude Mythos и patch gap: ИИ ищет уязвимости быстрее, чем их патчат Project Glasswing показал новое узкое место в кибербезопасности: ИИ ускоряет поиск уязвимостей, но проверка, раскрытие и патчи остаются медленнее.
LLM NVIDIA Nemotron-Labs Diffusion: как диффузия ускоряет LLM NVIDIA Nemotron-Labs Diffusion — разбор релиза NVIDIA: три режима генерации, цифры ускорения, SGLang и ограничения для LLM inference.
бизнес Как AI-стартапы раздувают ARR: CARR, pipeline и риск для рынка Разбираем, почему публичный ARR у AI-стартапов всё чаще оказывается CARR, pipeline или удачным месяцем, умноженным на 12.