Репост из: Это крипта, БРАТ!
Прошло ещё немного времени и чёт я приуныл.
OpenAI с 12 ноября отключает свои модели в Cursor. Тут, правда, история не про экосистемы, а про то, что Cursor купила SpaceX за 60млрд., и Альтман с Маском воюют. Но для меня история показательна, юзеры строят работу на инструменте, а доступ к моделям в нём решают пара человек, которые между собой соперничают со времен, когда Маск вышел из OpenAI и замутил xAI.
Но я хочу поделиться своим мнением про экосистемы, Work/Cowork и др. На примере Anthropic, они взяли фундамент Claude Code, выкатили его для тех людей, кто в ком.строку не хочет (большая ошибка), и вынесла на вебку или приложение. Они сами говорят, что большинство юзеров не пишут код. Основной поток людей и денег ведут туда, где ты выбираешь папку, а не флаги. И вот этот загон юзеров в песочницы, это пздц. Такое ощущение, что у нас забирают свободу, а подают как упрощение.
Логика понятная, юзер получает быстрый дофамин, подписка растёт, лимиты режут. Для маленьких проектов скорее верно. Но билдить большой проект в подобных инструментах не реально.
Вот и сижу в CLI. Кастомизация и контроль над своими данными, свой vps, приватные репо, ключи никуда не уезжают. Взломать можно всё, но разница между "у меня плохо лежало" и "оно лежало у них" всё-таки есть.
А теперь про мою боль. Код агенты пишут нормально, любой язык, высокая сложность, дизайн, база данных, карты и слои. Тут вопросов нет. Все проблемы начинаются на данных. Потеря кусочков, развороты на 180 градусов, топтание на месте. Я меняю местами агентов, гоняю варианты, но пока проблему не решил.
Гоняю локалку на живой базе, 42 контрольных вопроса. Без инструментов, просто с базой в контексте 2 правильных ответа из 42,, она уверенно отвечает "такого объекта нет" про объект, который в базе лежит. Подключаю инструментарий и детерминированный код, который сам ходит в базу и в результате 42 из 42, стабильно.
Это я к тому, что все эти базы для llm, как "собаке здрасте"! Тут или обучать llm, или детерминистика. Обучением занимаюсь, но это долго и дорого и это не промты, а именно слои.
Так что в подкапотке моих проектов до сих пор работают исключительно алгоритмы, а LLM сверху, надстройкой, на то, что реально требует суждения.
OpenAI с 12 ноября отключает свои модели в Cursor. Тут, правда, история не про экосистемы, а про то, что Cursor купила SpaceX за 60млрд., и Альтман с Маском воюют. Но для меня история показательна, юзеры строят работу на инструменте, а доступ к моделям в нём решают пара человек, которые между собой соперничают со времен, когда Маск вышел из OpenAI и замутил xAI.
Но я хочу поделиться своим мнением про экосистемы, Work/Cowork и др. На примере Anthropic, они взяли фундамент Claude Code, выкатили его для тех людей, кто в ком.строку не хочет (большая ошибка), и вынесла на вебку или приложение. Они сами говорят, что большинство юзеров не пишут код. Основной поток людей и денег ведут туда, где ты выбираешь папку, а не флаги. И вот этот загон юзеров в песочницы, это пздц. Такое ощущение, что у нас забирают свободу, а подают как упрощение.
Логика понятная, юзер получает быстрый дофамин, подписка растёт, лимиты режут. Для маленьких проектов скорее верно. Но билдить большой проект в подобных инструментах не реально.
Вот и сижу в CLI. Кастомизация и контроль над своими данными, свой vps, приватные репо, ключи никуда не уезжают. Взломать можно всё, но разница между "у меня плохо лежало" и "оно лежало у них" всё-таки есть.
А теперь про мою боль. Код агенты пишут нормально, любой язык, высокая сложность, дизайн, база данных, карты и слои. Тут вопросов нет. Все проблемы начинаются на данных. Потеря кусочков, развороты на 180 градусов, топтание на месте. Я меняю местами агентов, гоняю варианты, но пока проблему не решил.
Гоняю локалку на живой базе, 42 контрольных вопроса. Без инструментов, просто с базой в контексте 2 правильных ответа из 42,, она уверенно отвечает "такого объекта нет" про объект, который в базе лежит. Подключаю инструментарий и детерминированный код, который сам ходит в базу и в результате 42 из 42, стабильно.
Это я к тому, что все эти базы для llm, как "собаке здрасте"! Тут или обучать llm, или детерминистика. Обучением занимаюсь, но это долго и дорого и это не промты, а именно слои.
Так что в подкапотке моих проектов до сих пор работают исключительно алгоритмы, а LLM сверху, надстройкой, на то, что реально требует суждения.