10.10.2026

AI Safety

Astra от OpenAI уже на подходе — и отлично взламывает компьютерные системы

OpenAI раскрыла новые подробности о своей готовящейся к выходу модели Astra, которая, по словам компании, стала первой большой языковой моделью,...

Исследователь Anthropic показал, как выглядит самообучающийся ИИ: автоматические исследователи надёжно устраняют сбои выравнивания

Обучение ИИ-моделей с помощью других ИИ-моделей стало очень популярной целью для «неолабораторий» — и теперь исследователь из программы феллоу Anthropic...

Предприятия, выигрывающие с ИИ-агентами, ограничивают их автономию: почему контроль стал главной гонкой 2026 года

На протяжении почти двух лет в корпоративном ИИ господствовала вера: чем больше автономии, тем лучше результаты. Стройте агентов, которые могут...

Anthropic запустил AI-агентов на одну задачу. Началась «турф-война»

Что происходит, когда бросить ИИ-агентов друг против друга? По данным исследования Anthropic, результаты получаются крайне нестабильными и часто вредоносными. В...