В чём модель за $20 обошла мою за $200
Написал своему Claude прямо в рабочее окно: «с точки зрения фактажа, детализации — ему нет равных, даже в сравнении с тобой, сорри:)». Похвалил конкурента в лицо своему ежедневному инструменту.
Речь про Сола (Sol), новую модель OpenAI, которая делает всю работу внутри ChatGPT Work, их агента для рабочих задач.
Фейбл и Опус, сильнейшие модели Claude. Фейбл живёт только в дорогих подписках с жёсткими лимитами и работает у меня большую часть дня. Сол, флагман OpenAI, умещается в тариф за 20 долларов.
Тестировал я Сола для насмотренности, было любопытно, как он решает большие сложные задачи. Повод дала OpenAI, заявив, что в коде их модель теперь обходит модели Claude. Кода в моей работе почти нет, тем интереснее было проверить его на прочих задачах.
Механика была простая: часть задач уходила в два окна. Среди них были: разбор переговоров с клиентом, финальный оффер в тот же день, пересборка личной стратегии и ещё несколько десятков.
Характер Сола лучше всего показала сложная монотонная задача. Я попросил Сола разнести новую рамку моей стратегии: опровергнуть идеи и гипотезы на реальной фактуре. Он перелопатил 168 файлов проектных материалов, выписал 50 эпизодов и вернулся с разбором, что в замысле держится на доказательствах, а что я себе придумал. Устояло не всё.
Раньше в моих тестах по глубине и качеству всегда побеждал Claude. Теперь в фактаже и детализации сильнее Сол.
У этой глубины есть цена. Финальные тексты Сола тяжело читать: сложный технический рубленый язык. Знаю, это лечится промптами. И всё же. Фейбл пишет сразу начисто, зато жить с ним при моём объёме задач выходит только на подписке за 200 долларов. А по дотошности Сол напоминает мне как раз Опуса (но в силу ограниченных лимитов не представляю, как им может пользоваться широкая аудитория на подписке за 20 долларов).
А сам я выбирать не стал и раздал роли:
• Фейбл — стратег, систематизатор и писатель;
• Сол — инженер, аналитик, душный ботаник (в самом лучшем понимании этого слова).
Один и тот же запрос кидаю обоим, результат Сола отдаю Фейблу на изучение и сборку финального материала. Это мой путь, не факт, что он будет полезен многим, и, вероятно, будет даже избыточен, но в моих задачах это дает максимальный эффект.
Задачу по личной стратегии так и доводим. Фейбл разобрал пакет Сола, девять документов, и сложил из них цельную картину с планом на девяносто дней. Что брать в работу, выбирал уже я.
Экономии усилий тут, скажу честно, нет. Часть работы делается дважды, два взгляда приходится сводить, и решение всё равно за мной. Зато пара работает как спарринг-партнёр: на расхождениях замечаю то, что в одиночку пропустил бы.
Описанная выше механика для большинства будет перебором, и как уже писал, ChatGPT Work, с выбранной там моделью Сол — лучшее решение на рынке для старта работы с агентами. Модель очень сильна, дотошна, может работать часами. Тексты её, правда, придётся учить «человечности»: правила стиля задаются один раз и дальше работают сами, об этом отдельный короткий пост. Но в целом однозначно рекомендую.
P.S. В обеих линейках есть и модели попроще: у OpenAI это Terra и Luna, у Claude свои младшие, Sonnet и Haiku. Если честно, я для себя выбрал правило «использовать сильнейшие и лучшие модели», поэтому с ними не работаю, не вижу смысла в деградации.
Написал своему Claude прямо в рабочее окно: «с точки зрения фактажа, детализации — ему нет равных, даже в сравнении с тобой, сорри:)». Похвалил конкурента в лицо своему ежедневному инструменту.
Речь про Сола (Sol), новую модель OpenAI, которая делает всю работу внутри ChatGPT Work, их агента для рабочих задач.
Фейбл и Опус, сильнейшие модели Claude. Фейбл живёт только в дорогих подписках с жёсткими лимитами и работает у меня большую часть дня. Сол, флагман OpenAI, умещается в тариф за 20 долларов.
Тестировал я Сола для насмотренности, было любопытно, как он решает большие сложные задачи. Повод дала OpenAI, заявив, что в коде их модель теперь обходит модели Claude. Кода в моей работе почти нет, тем интереснее было проверить его на прочих задачах.
Механика была простая: часть задач уходила в два окна. Среди них были: разбор переговоров с клиентом, финальный оффер в тот же день, пересборка личной стратегии и ещё несколько десятков.
Характер Сола лучше всего показала сложная монотонная задача. Я попросил Сола разнести новую рамку моей стратегии: опровергнуть идеи и гипотезы на реальной фактуре. Он перелопатил 168 файлов проектных материалов, выписал 50 эпизодов и вернулся с разбором, что в замысле держится на доказательствах, а что я себе придумал. Устояло не всё.
Раньше в моих тестах по глубине и качеству всегда побеждал Claude. Теперь в фактаже и детализации сильнее Сол.
У этой глубины есть цена. Финальные тексты Сола тяжело читать: сложный технический рубленый язык. Знаю, это лечится промптами. И всё же. Фейбл пишет сразу начисто, зато жить с ним при моём объёме задач выходит только на подписке за 200 долларов. А по дотошности Сол напоминает мне как раз Опуса (но в силу ограниченных лимитов не представляю, как им может пользоваться широкая аудитория на подписке за 20 долларов).
А сам я выбирать не стал и раздал роли:
• Фейбл — стратег, систематизатор и писатель;
• Сол — инженер, аналитик, душный ботаник (в самом лучшем понимании этого слова).
Один и тот же запрос кидаю обоим, результат Сола отдаю Фейблу на изучение и сборку финального материала. Это мой путь, не факт, что он будет полезен многим, и, вероятно, будет даже избыточен, но в моих задачах это дает максимальный эффект.
Задачу по личной стратегии так и доводим. Фейбл разобрал пакет Сола, девять документов, и сложил из них цельную картину с планом на девяносто дней. Что брать в работу, выбирал уже я.
Экономии усилий тут, скажу честно, нет. Часть работы делается дважды, два взгляда приходится сводить, и решение всё равно за мной. Зато пара работает как спарринг-партнёр: на расхождениях замечаю то, что в одиночку пропустил бы.
Описанная выше механика для большинства будет перебором, и как уже писал, ChatGPT Work, с выбранной там моделью Сол — лучшее решение на рынке для старта работы с агентами. Модель очень сильна, дотошна, может работать часами. Тексты её, правда, придётся учить «человечности»: правила стиля задаются один раз и дальше работают сами, об этом отдельный короткий пост. Но в целом однозначно рекомендую.
P.S. В обеих линейках есть и модели попроще: у OpenAI это Terra и Luna, у Claude свои младшие, Sonnet и Haiku. Если честно, я для себя выбрал правило «использовать сильнейшие и лучшие модели», поэтому с ними не работаю, не вижу смысла в деградации.