OpenAI OpenAI o1 в Harvard-исследовании обошёл врачей на ER-triage OpenAI o1 в Harvard-исследовании показал лучший результат на ER-triage. Разбираем бенчмарк clinical reasoning, цифры и почему это всё ещё не «замена врача».
LLM Cohere приобретает Aleph Alpha и собирает контур суверенного ИИ Cohere забирает Aleph Alpha, Schwarz Group добавляет 500 млн евро и STACKIT. Главное в истории не само M&A, а попытка собрать для Европы контур суверенного ИИ.
AI-агенты Meta отслеживает клики сотрудников для обучения AI-агентов Meta записывает клики, нажатия клавиш и фрагменты экранов сотрудников в США, чтобы учить AI-агентов реальной работе в интерфейсах.
ChatGPT OpenAI включила рекламу в ChatGPT по умолчанию: что это значит для Free и Go OpenAI включила рекламу в ChatGPT для Free и Go. Разбираем, как работают персонализация, Ads-Free и новая граница приватности.
LLM Дружелюбные LLM ошибаются чаще: что показало исследование Nature Исследование Nature на пяти моделях показало неприятный компромисс: чем теплее и эмпатичнее обучали LLM, тем чаще они ошибались, поддакивали неверным убеждениям и хуже выдерживали эмоциональный контекст.
AI-агенты Anthropic тестирует агентный маркетплейс: 186 сделок между ИИ-агентами Project Deal у Anthropic показал не просто торги между ИИ-агентами, а более неприятную вещь: качество модели уже начинает влиять на экономический результат пользователя.
OpenAI GPT-5.5 Bio Bug Bounty: OpenAI ищет универсальный jailbreak OpenAI ищет не общий обход фильтров, а один воспроизводимый jailbreak для пяти bio safety questions в GPT-5.5 и проверяет это через отдельную программу.