мы тренируем модели в изоляции, совсем не так, как учатся люди, а потом удивляемся, почему они не генерализируют знания так же хорошо, как мы
но люди учатся сравнивая ответы, видя reasoning друг друга прямо посреди процесса, а еще соревнуясь и адаптируясь, и этого всего нет в стандартном training run
так что может следующий качественный переход в тренировке моделей будет какая-то AI-версия "социального" обучения, типа обучения моделей вместе
но люди учатся сравнивая ответы, видя reasoning друг друга прямо посреди процесса, а еще соревнуясь и адаптируясь, и этого всего нет в стандартном training run
так что может следующий качественный переход в тренировке моделей будет какая-то AI-версия "социального" обучения, типа обучения моделей вместе