Лучшая оптимизация работы с Astra это отсутствие оптимизации - к такому выводу пришла спустя неделю использования
Просто дать ей достаточно reasoning effort и не мешать лишними делегированиями и микроменеджментом. Тогда она быстрее, точнее и в итоге дешевле
Выбираю high или xhigh, не делегирую другим моделям внутри одного чата, слежу за контекстом, чтобы не допустить разрастания
Новый чат в рамках проекта с скопированным deeplink предыдущего чата помогает не потерять нить, но при этом гораздо менее затратен, чем если бы модель тащила весь старый контекст
(правая кнопка мыши на чате » скопировать » скопировать диплинк)
Много токенов уходит на Computer use - сколько раз читает страницы и делает скриншоты, но если модель делает правильно с 1–2 попыток, это всё равно выгоднее, чем более дешёвая модель, которая ошибается намного чаще, а потом за ней Astra исправляет
*пока так, если найду более эффективный способ оптимизации - напишу
✏️Поделитесь своими наблюдениями
Просто дать ей достаточно reasoning effort и не мешать лишними делегированиями и микроменеджментом. Тогда она быстрее, точнее и в итоге дешевле
Выбираю high или xhigh, не делегирую другим моделям внутри одного чата, слежу за контекстом, чтобы не допустить разрастания
Новый чат в рамках проекта с скопированным deeplink предыдущего чата помогает не потерять нить, но при этом гораздо менее затратен, чем если бы модель тащила весь старый контекст
(правая кнопка мыши на чате » скопировать » скопировать диплинк)
Много токенов уходит на Computer use - сколько раз читает страницы и делает скриншоты, но если модель делает правильно с 1–2 попыток, это всё равно выгоднее, чем более дешёвая модель, которая ошибается намного чаще, а потом за ней Astra исправляет
*пока так, если найду более эффективный способ оптимизации - напишу
✏️Поделитесь своими наблюдениями