AI-агенты Data2Story: как ИИ-агенты делают проверяемую журналистику Data2Story показывает, как ИИ-агенты могут собрать data-историю и оставить проверяемый след от каждого утверждения к данным, коду или источнику.
безопасность Отравление AI search через Reddit: как UGC попадает в ответы Исследование Cornell показывает, как UGC на Reddit, Quora и Wikipedia может отравлять ответы AI search. Объясняем WARP, риски цитат и границы выводов.
AI-агенты OpenAI LifeSciBench: как теперь измеряют научных ИИ-агентов LifeSciBench проверяет не знание биологии, а реалистичную научную работу: артефакты, рубрики, ограничения и частичный прогресс моделей.
безопасность Anthropic jailbreaks: почему Fable 5 нельзя защитить одним патчем Anthropic jailbreaks стали поводом для отключения Fable 5 и Mythos 5. Разбираем, почему guardrails снижают риск, но не доказывают отсутствие всех обходов.
бизнес Сотрудники Amazon и мораторий на дата-центры в Сиэтле Конфликт Amazon и сотрудников вокруг моратория в Сиэтле показывает, что гонка AI-датацентров упирается в энергию, воду, тарифы и права работников.
безопасность OpenAI Deployment Simulation: прогноз безопасности LLM OpenAI описала Deployment Simulation — способ заранее оценивать поведение LLM на прошлых реальных диалогах. Разбираем, чем метод полезен и где его границы.
генерация видео Microsoft Mirage: пространственная память для генерации видео Mirage от Microsoft Research показывает, как видеомодель может помнить сцену в латентном пространстве, а не гонять RGB-кэш туда и обратно.