бизнес LM Arena стала $100M-бизнесом на оценке ИИ-моделей LM Arena, теперь Arena, вышла на $100M annualized run rate. Разбираем, почему оценка ИИ-моделей стала отдельным рынком.
безопасность AI-targeting в военном ИИ: как старая база привела к удару по школе AI-targeting в военном ИИ ускоряет выбор целей. На примере удара по школе в Минабе разбираем, где сломались Maven, базы и human oversight.
нейросети Micron HBM: дефицит памяти стал ставкой AI AI-инфраструктура упирается не только в GPU. Разбираем, почему Micron выигрывает от HBM, DRAM, NAND и дефицита памяти.
AI-агенты CEO-Bench: почему ИИ-агенты проигрывают длинную игру CEO-Bench проверяет, как AI-агенты управляют SaaS-стартапом 500 дней. Большинство моделей банкротятся, а эвристика обгоняет почти всех.
AI-агенты Агенты, Codex и MCP-инфраструктура: почему AI переходит из чата в рабочий слой AI-агенты переходят из чата в рабочую инфраструктуру: Codex, MCP, Computer Use и Autodata показывают, какие слои теперь нужны.
AI-агенты General Intuition: игровые данные для AI-агентов General Intuition делает ставку на игровые данные Medal: action labels должны помочь AI-агентам учиться причинности, но перенос в роботов ещё не доказан.
LLM ИИ в математике: как меняется роль исследователя ИИ уже помогает искать доказательства, формализовать теоремы и проверять идеи. Разбираем, что в этой работе остаётся за исследователем.