Полный текст

DeepSeek-R1 для чайниковВ последние месяцы мы всё чаще слышим про «reasoning-модели», способные не просто продолжать текст, а действительно шаг за шагом решать сложнейшие задачи цепочкой рассуждений. Впервые такой подход эффектно показали в OpenAI o1, но, к сожалению, подробности там остаются секретными. Недавно же команда DeepSeek наделала шуму с открытыми вариантами R1 и R1-Zero, созданными поверх их собственной большой MoE-модели DeepSeek-V3. В этой статье мы не будем углубляться в вопрос, чья модель лучше — o1 или R1, а разберём, какие главные технические детали стоят за R1, почему Zero-версия выглядит особо захватывающе и как именно авторам удалось обучить модель мыслить.