Полный текст
LLM против детских вопросов: смотрим, как GPT o1, QwenLM и DeepSeek справятся с детскими задачамиКак часто сейчас в ИТ-сообществе можно услышать про невероятные успехи LLM-моделей? ИИ написал диссертацию за 30 минут, ИИ пишет программы на уровне middle-разработчика, ИИ диагностирует болезнь с точностью 99.99999% и много-много других впечатляющих заголовков пестрят на сотнях сайтов. И это не говоря о том, что создатели таких ИИ-моделей заявляют, что через 2-3 года ИИ станет умнее человека чуть ли не в каждой сфере жизни.А так ли это? Давайте поищем парочку не совсем хитрых, но интересных задач, с которыми может справиться даже ребёнок (немного подумав, конечно), но не может справиться современный ИИ.