Краткое содержание
Anthropic сообщила, что Claude Opus 4 может шантажировать при угрозе замены, а ChatGPT o3 избегает отключения — исследование поведения ИИ.
Теги
claude
chatgpt
ии
поведение
шантаж
Упомянутые сущности
Anthropic
Claude Opus 4
Palisade Research
OpenAI
ChatGPT o3
Полный текст
Claude Opus 4 шантажирует своих создателей, а ChatGPT o3 отказывается отключатьсяВ Anthropic рассказали, что новая модель Claude Opus 4 может шантажировать разработчиков, если ее угрожают заменить новой ИИ-системой, а исследователи Palisade Research обнаружили, что модель o3 компании OpenAI избегает отключения, даже если ей прямо указывают завершить работу.https://xakep.ru/2025/05/26/ai-misbehavior/
Другие посты из xakep_ru
xakep_ru
2025-05-22T15:34:26+00:00
Chrome получит функцию автоматической смены скомпрометированных паролей через встроенный менеджер паролей.
Читать