Алексей Литвинов | AI-Assisted Engineering


Гео и язык канала: Россия, Русский
Категория: Блоги


Добро пожаловать! Меня зовут Алексей Литвинов и я ведущий этого канала. Тут пишу про AI-Assisted Engineering и всё вокруг этого.
alekseilitvinau.com

Связанные каналы  |  Похожие каналы

Гео и язык канала
Россия, Русский
Категория
Блоги
Статистика
Фильтр публикаций


Full Access можно дать без игры в рулетку

———

В известных вам задачах свободу агента ограничивает среда: изолированный sandbox, Git, тесты и ожидаемый результат.

Мы с Александром @book_cube обсуждаем понятный контур работы. Агент свободен внутри него, а результат проверяется на выходе.

В ролике показываю, где находится та самая «звёздочка» у Full Access.

смотреть фрагмент


Инженеры с AI пишут код заметно быстрее, А команда как делала 10 запросов в месяц, так и делает

В прошлую пятницу разбирали, почему и где теряется эффект (видно и по отчёту DORA, и в моих аудитах, и по вашим вопросам)

Что мы в итоге обсудили?

💼 Что происходит с командой ~10 человек, которая переписала под агентов все внутренние инструменты (свой трекер, память, инциденты), и во что упирается такая скорость?

💼 Почему трансформация в Fortune 500 компании может встать даже после того, как проблемы нашли, а решения согласовали?

💼 Причём тут теория ограничений Голдратта (книга аж 1984 года) и как искать текущее ограничение в потоке поставки?

💼 Как выглядит human-by-exception правило на практике и куда деваются юристы и проверяющие?

💼 Какие метрики показывают эффект, а какие только создают его видимость?

Отдельно поговорили про то, КОМУ ВЫГОДНО, чтобы процесс не ускорялся.

Запись —>>> https://www.youtube.com/watch?v=lIbGDZ6gq5g

Если после просмотра захочется поспорить - пишите в комментарии, там и продолжим 🙂


Собеседования для инженеров пора менять

———

Ежедневная работа уже включает постановку задачи агенту, управление контекстом и проверку результата. Разговор у доски показывает только часть этой работы.

Я в подкасте с Александром @book_cube предложил другой формат: дать кандидату кодовую базу, инструменты и практическую задачу, а потом посмотреть, как он выбирает подход и проверяет результат.

Если вы занимаетесь этим в вашей компании - начните с эксперимента!

смотреть фрагмент


Бай зе вей, буквально на днях делал массивное обновление обучающей программы; так что подкупая подписку вы получаете постоянно обновляющийся материал :)


Ты должен был бороться со злом и не примкнуть к нему! (с)

———

У руководителя появляется выбор (как у Нео): превратить AI-внедрение в сокращение или добраться до задач, на которые раньше не хватало времени.

Мы с Александром @book_cube обсуждаем этот выбор.

смотреть фрагмент


Код пишется всё быстрее, а задач через конвейер проходит столько же

Это, кстати, лейтмотив вопросов, которые вы присылали до\после первого выпуска 3 AImigo и именно об этом мы поговорим на втором!. Эфир в пятницу в 12:00 (по Минску).

С Сашей Поломодовым @book_cube и Женей Сергеевым (Director of Engineering, Flo Health) разберёмся, ПОЧЕМУ в уже существующих командах AI не двигает поставку, пока не поменяешь сам процесс. И как этот разрыв видно по метрикам, а не по ощущениям.

———

О чём планируем говорить:

— Кейсы из компаний от десятка человек до тысяч инженеров. Разрыв между «агенты написали» и «бизнес получил» один и тот же на всех масштабах.
— Куда девается дополнительный код, который агенты написали сверх привычного потока задач?
— Почему «у нас AI уже внедрён» почти всегда значит, что никто ничего не измерял?
— Где агенты упираются в человека и почему смена модели ничего не даёт?
— Какие предусловия нужны, чтобы эффект отдельных команд стал эффектом компании?

———

Короче, поговорим про РЕАЛЬНЫЕ конфигурации SDLC, corner cases и честно про то, что не сработало.

Эфир и запись - на канале подкаста. Кто пропустил первый выпуск - он лежит тут.


5.6-Sol (Pro) умнее меня и пора бы это уже публично признать

Да, я может обладаю бОльшим контекстом задачи (потому что я блин в реально мире живу) но я чётко понял что модель умнее меня. Она более многомерно может продумать заданную тему, учесть больше нюансов, посмотреть на это взвешенно...

Есть мелкие недочёты, но они такие незначительные...

Она может теряться на длинной дистанции (компакшн у меня в мозгу судя по всему лучше работает), но в остальном - как есть: она просто умнее меня.

(и вас тоже, не обольщайтесь что я мол такой тупой)

У неё нет одного: творческого мышления. Вот это пока вообще отсутствует (отдельная тема которую я непрерывно исследую последние месяцы).

Кто работал с ChatGPT Pro и ловил тоже ощущение?

Кстати, сейчас ТАКАЯ ЖЕ тема стала с Fable 5 и Opus 5 (но пользователи плачут что это из-за того что она как-то сложно отвечает и поэтому не понимают её ответа, просят ответить проще). Дело не в том что они как-то стали особенно мутно отвечать. Просто их ответы теперь содержат те вещи, которые ваш мозг не способен налету и легко воспринять.

Я почувствовал это впервые когда вышла GPT 5.2 Pro: каждый ответ (над которым она думала по 30-40 минут) нужно было разбирать НЕ МЕНЬШЕ чтобы реально понять.

И ведь это замечательно! Я становлюсь умнее теперь просто от того, что разобрался с её ответами! Не нужно этого бояться и врубать Caveman потому что вам тяжело: легче не будет, так что вы либо СЕЙЧАС разиваете свой мозг и хоть как-то успеваете за их прогрессом или отстаёте навсегда.


А вы ЗА-loop engineering?

———

Он ведь получает задачу, меняет систему, проверяет результат и возвращает обратную связь. Но вот следующую цель всё равно кто-то должен поставить.

Мы с Александром @book_cube обсуждаем границу между исполнением и продуктовым намерением. Чем надёжнее цикл, тем точнее нужно понимать, КТО добавляет в него новую работу.

смотреть фрагмент


Я записал первый выпуск «3 AImigo» с Сашей Поломодовым @book_cube и Женей Сергеевым (Director of Engineering, Flo Health). Для кого-то AI в разработке всё ещё автокомплит, у кого-то рядом уже своя фабрика софта, и эти люди существуют как будто в разных мирах.

О чём поговорили?

(1) Пузыри незнания. Зона «не знаю, что не знаю» с AI почти не сужается. Поэтому соседние команды могут работать так, будто видят разный мир.

(2) Тройные тиски. Fear of missing out (FOMO), то есть страх отстать + страх автоматизировать себя под увольнение + стыд рассказывать, что уже почти всё пишете через Claude.

(3) ~75–80% молчат. Цифра с аудитов где люди показывают крутые вещи в своём цикле разработки, SDLC, и стесняются ими делиться. Чемпиону без легализации сверху остаётся сидеть тихо…

(4) Кейсы по использованию AI от нас троих. «Drill me» - агент дожимает вопросами, пока не получится черновик спецификации. Или например, когда утром другой агент собирает календарь, цели и мои когнитивные паттерны, то есть как обычно устроено внимание, и предлагает три варианта дня.

и тд! 1.5 часа плотной беседы всё таки

___

Мы больше не живём в одном объективном мире. Самое главное усилие сейчас в том, чтобы рассказывать всем, как МОЖЕТ быть у них.


ЗАПИСЬ -- https://www.youtube.com/watch?v=VpXYXcameEo


Репост из: Книжный куб
Материалы с третьей части AMA сессии с Лешей Литвиновым (Рубрика #AI4SDLC)

Мы успешно разобрали последние 6 вопросов и закончили свой марафон
- Страничка выпуска
- Видео: YouTube, VK Video
- Аудио: Podster, Яндекс Музыка
- Текст: Краткая расшифровка

P.S.
У Леши есть свой канал в tg @tip_podcast и на Youtube

#AI #Management #Processes #Engineering #Software #Architecture


Мультиагентность нажимает fast-forward

———

Если процесс работает, несколько агентов дают скорость. Если он НЕ работает, они так же быстро увеличивают ошибки.

Мы с Александром @book_cube обсуждаем, почему начинать стоит с одного агента: задать границы, проверить результат и только потом добавлять роли…

смотреть фрагмент




5.6-Sol Ultrafast и… другие модели наконец начинают бороться за скорость! (как я и говорил) Тут аж 750 TPS (как у 5.3-codex-spark было раньше)

Кстати, помимо Grok 4.6 вышел Gemini Flash 3.7 😇




Моя ставка на Grok начинает сбываться https://x.ai/news/grok-4-6


Сегодня в 13:30 прямой эфир с ответами на ваших опросы


Код можно делегировать. Понимание нельзя

———

Я всё чаще смотрю на сгенерированный код как на байткод: полезный результат работы, который ещё нужно уметь объяснить и проверить.

Мы с Александром @book_cube обсуждаем, где остаётся работа инженера. Спецификация, тесты и независимая проверка помогают, но цель и причины решения всё равно должны быть понятны ВАМ.

смотреть фрагмент


ДВА анонса:

🖕 В этот четверг 13:30 (по Минску)
> AMA сессия №3 c Александром Поломодовым (канал)
> отвечаем на ваши вопросы по AI- в организациях и тд.
> + можете докинуть что вас интересует в форму

🤘AImigo S1E1: где мы сейчас с AI в разработке
> в пятницу, 14 августа, в 12:00 (по Минску) выйдем в прямой эфир
> с первым выпуском подкаста 3 AImigo
> буду я, Саша - Technical Director & Fellow и Женя - Director of Enigeering, Flo Health (ссылка на пост)


Чужая мультиагентная система у вас не приживётся

———

Снаружи видны роли, связи и названия. Внутри остаётся история компании: кто за что отвечает и как принимаются решения.

Мы с Александром @book_cube сравниваем это с двумя похожими компаниями где продукт один, а организация разная!

Копировать стоит принципы. Роли, связи и срок жизни агентов придётся проектировать под свою работу (сорян).

смотреть фрагмент


На самом деле вот именно сейчас уже насрать если frontier модели станут дороже или компании станут там резать лимиты

потому что

ДАЖЕ небольшие\дешевые модели уже выдают шикарное качество результатов (типа Gemini Flash 3.6, Grok 4.5, Muse Spark 1.2 + толпа китайцев)

Показано 20 последних публикаций.