Полный текст
Anthropic: Claude сможет прерывать потенциально вредоносные разговорыКомпания Anthropic объявила о новых возможностях, которые позволят некоторым из ее новейших моделей завершать разговоры в «редких, экстремальных случаях при настойчиво вредоносных или оскорбительных взаимодействиях с пользователями». При этом в Anthropic заявляют, что делают это не для защиты пользователей, а самой ИИ-модели.https://xakep.ru/2025/08/18/end-conversations/