Новый ChatGPT Work, а также как Anthropic и OpenAI убивают свои чаты
Обе компании уже всерьез намекают юзерам, что LLM стали достаточно мощными и дорогими, чтобы растрачивать их токены на всякие банальные вопросы. Поэтому они постепенно сворачивают свои режимы чатов и переводят юзеров в режим выполнения задач.
Claude совместил Cowork и Chat. Теперь это одна страница с переключателем между двумя режимами. По сути, пока что они позиционируются как равноправные. Но ставлю 🍋 токенов — это просто переходный этап.
OpenAI же сделали более радикальные шаги. Во-первых, старое приложение ChatGPT для Mac, где мы с вами кажется уже 100 лет назад делали папки-проекты, какие-то GPTs настраивали, — переименовали в "ChatGPT Classic" (читай отправили на пенсию ✋).
А во-вторых, приложение Codex повысили — оно стало новым ChatGPT. Теперь оно объединяет все режимы работы GPT: Codex, Work (о нем дальше) и Chat. И казалось бы то же самое что Claude — да вот только в отличие от Антропика, здесь Chat вообще стал вторичным. Codex и Work имеют полноценные отдельные страницы. А Chat теперь живет в маленьком всплывающем окошке, которое как бы намекает: "я тут чисто подсказать, а по серьезным вопросам пиши в Work".
ChatGPT Work
Теперь подробнее про него. Так OpenAI назвали свой аналог Claude Cowork, который выкатили на днях. По существу, почти то же самое. Тоже агент, живущий в виртуалке, как Codex, с доступом к компу, браузеру и всему тому же, что и Codex. Уровень работы благодаря GPT-5.6, который OpenAI сами рекомендуют как основную модель в этом режиме, — хороший.
Проверял я его прямо на живом. Мне нужно было сдать отчетность в налоговую. Не вдаваясь в подробности там есть этап, где нужно кропотливо классифицировать транзакции из банковской выписки по налоговым кодам, а потом сводить баланс по каждому счету, да еще и сопоставлять потом между разными счетами балансы, чтобы все билось. В общем, самая ненавистная для меня отчетность. Каждый раз настроение портилось, когда ее опять сдавать нужно.
Решил отдать эту задачу ChatGPT Work. Дал ему пример предыдущей отчетности, и запустил GPT-5.6 Sol Extra High. Не потому что такая силища для этой задачи нужна, а скорее чтобы перестраховаться — все таки тема достаточно чувствительная. Цена ошибки велика.
Но в итоге, результат такой же как с Claude Cowork — базово со всем справляется. Но с незначительными недочетами. Первый результат сдал — он был на "пять с минусом". Я ему дал комментарии по классификации нескольких транзакций. Тот ушел думать, вернулся — классификации отдельных транзакций поменял, а баланс не обновил. То есть не считал мое намерение (он же "интент"). Возможно, потому что сфера нетривиальная, и вряд ли его много тренировали на подобных задачах. Клодовский Cowork, интент обычно считывает хорошо, но на узкопрофильных задачах бывает так же тупит.
Дальше уже чисто для эксперимента попросил Codex сделать презентацию для C-level. Справился хорошечно — суть всю передал, по слайдам разбил очень логично, есть дорожная карта, график, табличка. В общем уровень Claude Cowork берет легко, только немного в своем стиле. Но, честно говоря, я уже давно все презентации делаю в Claude Design (и вам рекомендую). Настолько, что у нас в компании я юзаю его больше, чем отдел дизайна 😁 Поэтому для меня презентации что от ChatGPT Work, что от Claude Cowork — выглядят примитивными и топорными.
Итог: экосистема ChatGPT отстает только, пожалуй, в сфере дизайна. В остальном — удобство, функциональность, UX — такие же как у Claude, если не лучше.
Заместители
Обе компании уже всерьез намекают юзерам, что LLM стали достаточно мощными и дорогими, чтобы растрачивать их токены на всякие банальные вопросы. Поэтому они постепенно сворачивают свои режимы чатов и переводят юзеров в режим выполнения задач.
Claude совместил Cowork и Chat. Теперь это одна страница с переключателем между двумя режимами. По сути, пока что они позиционируются как равноправные. Но ставлю 🍋 токенов — это просто переходный этап.
OpenAI же сделали более радикальные шаги. Во-первых, старое приложение ChatGPT для Mac, где мы с вами кажется уже 100 лет назад делали папки-проекты, какие-то GPTs настраивали, — переименовали в "ChatGPT Classic" (читай отправили на пенсию ✋).
А во-вторых, приложение Codex повысили — оно стало новым ChatGPT. Теперь оно объединяет все режимы работы GPT: Codex, Work (о нем дальше) и Chat. И казалось бы то же самое что Claude — да вот только в отличие от Антропика, здесь Chat вообще стал вторичным. Codex и Work имеют полноценные отдельные страницы. А Chat теперь живет в маленьком всплывающем окошке, которое как бы намекает: "я тут чисто подсказать, а по серьезным вопросам пиши в Work".
ChatGPT Work
Теперь подробнее про него. Так OpenAI назвали свой аналог Claude Cowork, который выкатили на днях. По существу, почти то же самое. Тоже агент, живущий в виртуалке, как Codex, с доступом к компу, браузеру и всему тому же, что и Codex. Уровень работы благодаря GPT-5.6, который OpenAI сами рекомендуют как основную модель в этом режиме, — хороший.
Проверял я его прямо на живом. Мне нужно было сдать отчетность в налоговую. Не вдаваясь в подробности там есть этап, где нужно кропотливо классифицировать транзакции из банковской выписки по налоговым кодам, а потом сводить баланс по каждому счету, да еще и сопоставлять потом между разными счетами балансы, чтобы все билось. В общем, самая ненавистная для меня отчетность. Каждый раз настроение портилось, когда ее опять сдавать нужно.
Решил отдать эту задачу ChatGPT Work. Дал ему пример предыдущей отчетности, и запустил GPT-5.6 Sol Extra High. Не потому что такая силища для этой задачи нужна, а скорее чтобы перестраховаться — все таки тема достаточно чувствительная. Цена ошибки велика.
Но в итоге, результат такой же как с Claude Cowork — базово со всем справляется. Но с незначительными недочетами. Первый результат сдал — он был на "пять с минусом". Я ему дал комментарии по классификации нескольких транзакций. Тот ушел думать, вернулся — классификации отдельных транзакций поменял, а баланс не обновил. То есть не считал мое намерение (он же "интент"). Возможно, потому что сфера нетривиальная, и вряд ли его много тренировали на подобных задачах. Клодовский Cowork, интент обычно считывает хорошо, но на узкопрофильных задачах бывает так же тупит.
Дальше уже чисто для эксперимента попросил Codex сделать презентацию для C-level. Справился хорошечно — суть всю передал, по слайдам разбил очень логично, есть дорожная карта, график, табличка. В общем уровень Claude Cowork берет легко, только немного в своем стиле. Но, честно говоря, я уже давно все презентации делаю в Claude Design (и вам рекомендую). Настолько, что у нас в компании я юзаю его больше, чем отдел дизайна 😁 Поэтому для меня презентации что от ChatGPT Work, что от Claude Cowork — выглядят примитивными и топорными.
Итог: экосистема ChatGPT отстает только, пожалуй, в сфере дизайна. В остальном — удобство, функциональность, UX — такие же как у Claude, если не лучше.
Заместители