Полный текст

Системы ценностей больших языковых моделейКаждый раз, создавая новый AI-инструмент, человечество сперва любуется его пользой, а потом пугается своего отражения в нём. С языковыми моделями этот цикл прошёл с невероятным ускорением: от восторга перед ChatGPT до шока от его предвзятости прошло меньше двух лет.Звучит странно, но LLM не нейтральны. Разберёмся, откуда у них появляются политические взгляды, любимые расы и даже готовность пожертвовать одними людьми ради других. Поговорим о том, как наши собственные предубеждения кодируются в алгоритмах.