Краткое содержание
Исследование Anthropic показало, что всего 250 вредоносных документов в обучающих данных достаточно для отравления LLM, вызывая генерацию бессвязного текста при триггерной фразе.
Темы
ИИ
безопасность
киберугрозы
Теги
ai
llm
security
poisoning
research
anthropic
vulnerability
Упомянутые сущности
Anthropic
Институт безопасности ИИ при правительстве Великобритании
Институт Алана Тьюринга
xakep.ru
Полный текст
Anthropic: для отравления LLM достаточно 250 вредоносных документов в обучающих данныхСпециалисты компании Anthropic, совместно с Институтом безопасности ИИ при правительстве Великобритании, Институтом Алана Тьюринга и другими академическими учреждениями, сообщили, что всего 250 специально подготовленных вредоносных документов достаточно, чтобы заставить ИИ-модель генерировать бессвязный текст при обнаружении определенной триггерной фразы.https://xakep.ru/2025/10/13/poisoning-llm/
Другие посты из xakep_ru
xakep_ru
2025-10-09T13:35:17+00:00
Обзор компактного устройства M5StickC Plus2 на базе ESP32, которое сравнивают с Flipper Zero и используют для пентеста.
Читать