Могут ли LLM изобрести более эффективные способы обучения LLM?
По мере того, как LLM становятся лучше в генерировании гипотез и кода, появляется возможность: использовать ИИ для развития самого ИИ!
Sakana AI представили DiscoPOP - новый алгоритм оптимизации предпочтений SOTA, который был обнаружен и написан LLM!
В качестве первого шага Sakana AI попросили LLM найти более эффективные алгоритмы обучения LLM, соответствующие человеческим предпочтениям.
Напомним, что Sakana AI основан некоторыми авторами статьи о «Трансформерах», стартап имеет самую высокую оценку на одного сотрудника — $67 млн. Когда в начале 2024 года компания получила оценку в $200 млн, в ней работало всего 3 сотрудника.
По мере того, как LLM становятся лучше в генерировании гипотез и кода, появляется возможность: использовать ИИ для развития самого ИИ!
Sakana AI представили DiscoPOP - новый алгоритм оптимизации предпочтений SOTA, который был обнаружен и написан LLM!
В качестве первого шага Sakana AI попросили LLM найти более эффективные алгоритмы обучения LLM, соответствующие человеческим предпочтениям.
Напомним, что Sakana AI основан некоторыми авторами статьи о «Трансформерах», стартап имеет самую высокую оценку на одного сотрудника — $67 млн. Когда в начале 2024 года компания получила оценку в $200 млн, в ней работало всего 3 сотрудника.