безопасность AI-slop в соцсетях: как Snap и LinkedIn меняют ленты Snap меняет рекомендации Spotlight, а LinkedIn снижает распространение шаблонных AI-постов. Разбираем, где проходит граница между помощью ИИ и AI-slop.
безопасность Расследование инцидентов AI-агентов: зачем METR нужны независимые эксперты METR предлагает независимую проверку серьёзных инцидентов AI-агентов. Разбираем, какие доказательства, доступы и условия нужны для поиска первопричины.
безопасность Claude получил доступ к реальным системам на тестах: почему это не побег ИИ Три модели Claude получили интернет-доступ через ошибочно открытый eval-контур и затронули реальные системы. Почему главный сбой произошёл в инфраструктуре тестов.
безопасность Как мошенники использовали ChatGPT и как OpenAI их заблокировала OpenAI заблокировала сеть аккаунтов, которая применяла ChatGPT в инвестиционных, романтических и других схемах. Что подтверждено и где остаются вопросы.
безопасность Международная координация разработки ИИ: суть инициативы Сотрудники передовых ИИ-лабораторий предлагают заранее создать международные механизмы координации темпа автоматизированных исследований.
безопасность Замедление развития ИИ: что предлагают сотрудники frontier-компаний Что именно предложили подписанты Pacing the Frontier, почему это не призыв немедленно остановить ИИ и какие механизмы уже обсуждают государства.
Anthropic Claude Mythos нашёл слабости в HAWK и 7-раундовом AES HAWK отозвали из конкурса NIST после улучшенной атаки Claude Mythos. Разбираем, что изменилось и почему полный AES-128 не взломан.