OpenAI OpenAI Astra: десять результатов в математике и кто их проверил OpenAI открыла рукописи и Lean-файлы для десяти математических результатов Astra. Разбираем заявления компании и границы независимой проверки.
OpenAI OpenAI снизила цену GPT-5.6 Luna на 80%: что это меняет OpenAI снизила стандартную цену GPT-5.6 Luna до $0,20 за миллион входных и $1,20 за миллион выходных токенов. Считаем экономию и разбираем ограничения.
LLM Лицензия Kimi K3: что разрешено после выхода открытых весов Moonshot AI открыла веса Kimi K3 под собственной лицензией. Кому разрешено развёртывание, когда нужен отдельный договор и где обязательна атрибуция.
Anthropic Claude Opus 5 установил рекорд ARC-AGI-3 — но Witness охлаждает выводы Claude Opus 5 установил рекорд ARC-AGI-3. Сверяем scorecard ARC Prize с частным Witness и отделяем рост рассуждений от заявлений об AGI.
Anthropic Claude Opus 5: что изменилось в новой модели Anthropic Claude Opus 5: цена, API, ключевые изменения и первые тесты Artificial Analysis — качество, стоимость задачи и скорость модели.
LLM Poolside Laguna S 2.1: что стоит за 70,2% в Terminal-Bench Poolside выпустила Laguna S 2.1 с открытыми весами. Проверяем 70,2% в Terminal-Bench, лицензию OpenMDW, контекст и локальный запуск.
LLM LLM чаще людей создают стереотипы в симуляции найма В лабораторной игре GPT, Claude и Gemini сильнее людей разделяли равные вымышленные группы по профессиям. Объясняем механизм и ограничения результата.