2. Effort
Пожалуй, это самый важный параметр при работе с ИИ. Effort, простыми словами - это «бюджет»: сколько токенов ты готов потратить на выполнение конкретной задачи. И здесь никогда нет правильного ответа, при отправке каждого промпта стоит хотя бы немного задуматься, какой effort сейчас стоит установить.
Для Claude: low → medium → high → extra → max
Для ChatGPT: low → medium → high → extra → pro
Отдельно стоит выделить ultracode (для Claude) и ultra (для ChatGPT). Обычно под этим понимается «оркестрирование» с практически неограниченным бюджетом. Каждая твоя задача отдаётся нескольким независимым «агентам» (простыми словами - «чатам с ИИ»), каждый из которых выполняет только свою часть задачи, а при необходимости может запускать других агентов. Бюджет токенов (сколько вообще может потянуть выбранная модель) на каждого агента - extra (для Claude) и pro (для ChatGPT), а так как агентов может быть несколько, да ещё и они могут вызывать новых агентов - можно сказать, что бюджет здесь вообще не ограничен (ИИ будет жрать твои токены, пока не выполнит поставленную задачу). Такой вариант я выбираю при рефакторинге (когда нужно иметь возможность позволить ИИ читать неограниченное число файлов в твоём проекте - иногда их бывает очень много).
Но здесь кроется большой риск - ни в коем случае нельзя всегда бездумно использовать ultracode/ultra. Во-первых, потому что это накладно по деньгам, плюс такие задачи выполняются МНОГОКРАТНО дольше любых других, где не используется «оркестрирование». А во-вторых, ИИ - тупой. И если ты отправил задачу изменить одну строчку текста на своей веб-страничке на другую строчку, выбрав при этом extra high effort - ИИ будет до посинения тратить твои бюджеты, выдумывать что-то новое, предлагать другие варианты для замены этой строчки или пойдёт искать по проекту, что ещё можно поменять, будет обмазывать всё синтетическими тестами, галлюцинировать и делать то, что ты не просил.
Во всех остальных случаях я практически всегда использую effort=extra. Обычно этого достаточно для внесения любых изменений в проект (не путать с реализацией какого-то нового функционала), при этом «бюджета» хватит на чтение всех нужных файлов проекта, которые требуются для решения этой задачи.
effort=max я использую, когда нужно поработать с большим объёмом данных, но я не хочу, чтобы агенты сожрали весь мой 5-часовой лимит за один заход. Это полезно при поиске ошибок в логах, при работе с дампами БД и т. д. Обычно этого достаточно, чтобы из пары гигабайт текста найти и вычленить только нужную информацию, которая относится к задаче, и при этом не потратить много токенов.
effort=high я использую крайне редко и только при работе с Claude Fable, потому что в противном случае ему тупо может не хватить твоих 5-часовых лимитов, приходится ограничивать.
low и medium я не использую в принципе: на таком бюджете модель либо не дочитывает проект и начинает косячить, либо дочитывает - и на саму задачу уже ничего не остаётся.
Также я не раз натыкался на мнение, что можно использовать Fable в effort=low и это даст результат на уровне Opus в effort=max, при этом по деньгам (токенам) выйдет дешевле. Но это прямо какое-то извращение. Объём действий, которые Fable успеет сделать за отведённый ему low-бюджет, крайне ограничен. Даже когда я рефакторил летом дюжину проектов с помощью Fable в режиме high - на каждый проект у меня уходило по 50-100 итераций просто потому, что даже на небольших Telegram-ботах модель за один заход успевала прочитать и поправить слишком мало. А увеличивать бюджет - не вариант, в случае с Fable ему бы не хватило лимитов. Вот и пришлось 2,5 месяца медленно и поэтапно всё править.
Итого:
- любые правки в проекте: effort=extra
- новый функционал: effort=max (либо если понимаешь, что модели для реализации задачи придётся прочитать файлов очень много - режим ultracode/ultra)
- рефакторинг: режим ultracode/ultra
- логи, дампы БД, большой объём данных: effort=max
- что угодно на Fable: effort=high
Пожалуй, это самый важный параметр при работе с ИИ. Effort, простыми словами - это «бюджет»: сколько токенов ты готов потратить на выполнение конкретной задачи. И здесь никогда нет правильного ответа, при отправке каждого промпта стоит хотя бы немного задуматься, какой effort сейчас стоит установить.
Для Claude: low → medium → high → extra → max
Для ChatGPT: low → medium → high → extra → pro
Отдельно стоит выделить ultracode (для Claude) и ultra (для ChatGPT). Обычно под этим понимается «оркестрирование» с практически неограниченным бюджетом. Каждая твоя задача отдаётся нескольким независимым «агентам» (простыми словами - «чатам с ИИ»), каждый из которых выполняет только свою часть задачи, а при необходимости может запускать других агентов. Бюджет токенов (сколько вообще может потянуть выбранная модель) на каждого агента - extra (для Claude) и pro (для ChatGPT), а так как агентов может быть несколько, да ещё и они могут вызывать новых агентов - можно сказать, что бюджет здесь вообще не ограничен (ИИ будет жрать твои токены, пока не выполнит поставленную задачу). Такой вариант я выбираю при рефакторинге (когда нужно иметь возможность позволить ИИ читать неограниченное число файлов в твоём проекте - иногда их бывает очень много).
Но здесь кроется большой риск - ни в коем случае нельзя всегда бездумно использовать ultracode/ultra. Во-первых, потому что это накладно по деньгам, плюс такие задачи выполняются МНОГОКРАТНО дольше любых других, где не используется «оркестрирование». А во-вторых, ИИ - тупой. И если ты отправил задачу изменить одну строчку текста на своей веб-страничке на другую строчку, выбрав при этом extra high effort - ИИ будет до посинения тратить твои бюджеты, выдумывать что-то новое, предлагать другие варианты для замены этой строчки или пойдёт искать по проекту, что ещё можно поменять, будет обмазывать всё синтетическими тестами, галлюцинировать и делать то, что ты не просил.
Во всех остальных случаях я практически всегда использую effort=extra. Обычно этого достаточно для внесения любых изменений в проект (не путать с реализацией какого-то нового функционала), при этом «бюджета» хватит на чтение всех нужных файлов проекта, которые требуются для решения этой задачи.
effort=max я использую, когда нужно поработать с большим объёмом данных, но я не хочу, чтобы агенты сожрали весь мой 5-часовой лимит за один заход. Это полезно при поиске ошибок в логах, при работе с дампами БД и т. д. Обычно этого достаточно, чтобы из пары гигабайт текста найти и вычленить только нужную информацию, которая относится к задаче, и при этом не потратить много токенов.
effort=high я использую крайне редко и только при работе с Claude Fable, потому что в противном случае ему тупо может не хватить твоих 5-часовых лимитов, приходится ограничивать.
low и medium я не использую в принципе: на таком бюджете модель либо не дочитывает проект и начинает косячить, либо дочитывает - и на саму задачу уже ничего не остаётся.
Также я не раз натыкался на мнение, что можно использовать Fable в effort=low и это даст результат на уровне Opus в effort=max, при этом по деньгам (токенам) выйдет дешевле. Но это прямо какое-то извращение. Объём действий, которые Fable успеет сделать за отведённый ему low-бюджет, крайне ограничен. Даже когда я рефакторил летом дюжину проектов с помощью Fable в режиме high - на каждый проект у меня уходило по 50-100 итераций просто потому, что даже на небольших Telegram-ботах модель за один заход успевала прочитать и поправить слишком мало. А увеличивать бюджет - не вариант, в случае с Fable ему бы не хватило лимитов. Вот и пришлось 2,5 месяца медленно и поэтапно всё править.
Итого:
- любые правки в проекте: effort=extra
- новый функционал: effort=max (либо если понимаешь, что модели для реализации задачи придётся прочитать файлов очень много - режим ultracode/ultra)
- рефакторинг: режим ultracode/ultra
- логи, дампы БД, большой объём данных: effort=max
- что угодно на Fable: effort=high