образование ИИ-инфляция оценок: почему ChatGPT ломает университетские баллы Исследование UC Berkeley показывает: после ChatGPT доля A выросла на 13 п.п. в курсах, где много письменных, кодинговых и домашних заданий.
LLM Аудит прозрачности DiffusionGemma: что видно в reasoning Свежий аудит DiffusionGemma проверяет, насколько reasoning у diffusion-LLM остаётся наблюдаемым: opaque serial depth, token bottleneck и monitorability.
OpenAI OpenAI o3 и редкие заболевания: что показало исследование NEJM AI OpenAI o3 Deep Research помог врачам повторно разобрать 376 сложных случаев редких заболеваний. Разбираем 18 подтверждённых диагнозов и ограничения исследования.
LLM SubQ LLM: что стоит за заявлениями о sparse attention и 12 млн токенов SubQ заявляет sparse attention, 12 млн токенов и резкое снижение стоимости длинного контекста. Разбираем, что подтверждено, а что пока остаётся claim.
AI-агенты GitHub Qubot AI-агент: как устроена внутренняя аналитика на Copilot Разбор внутреннего аналитического AI-агента GitHub: интерфейсы, контекстный слой, MCP, Kusto, Trino, eval framework и ограничения.
Anthropic Зависимость от американского ИИ: что показало отключение Anthropic Fable 5 и Mythos 5 стали стресс-тестом для стран и компаний, зависящих от американских AI-платформ. Разбираем политический риск и сценарии снижения зависимости.
безопасность MosaicLeaks: как deep-research агенты выдают секреты через поиск MosaicLeaks показывает, что deep-research агент может раскрыть приватные факты не ответом, а журналом внешних поисковых запросов.