Как «искусственный интеллект» саботирует протоколы безопасности и совершает преступления

12+
12+

10 просмотров

3 месяца назад

ПожаловатьсяНарушение авторских прав
12+
12+

10 просмотров

3 месяца назад

ПожаловатьсяНарушение авторских прав
12+
12+

10 просмотров

3 месяца назад

Прямой эфир состоялся 26 апр. 2026 Материалы: • https://www.anthropic.com/research/emergent-misalignment-reward-hacking • https://www.anthropic.com/research/automated-alignment-researchers

Название:

Как «искусственный интеллект» саботирует протоколы безопасности и совершает преступления