TGStat
TGStat
Type to search
Advanced channel search
  • flag English
    Site language
    flag Russian flag English flag Uzbek
  • Sign In
  • Catalog
    Channels and groups catalog Regional compilations Thematic compilations Платные каналы Search for channels
    Add a channel/group
  • Ratings
    Rating of channels Rating of groups Posts rating
    Ratings of brands and people
  • Analytics
  • Search by posts
  • Telegram monitoring
  • Promotion
    Advertising through Yandex Business Advertising in channels through TGStat Agency Advertising on TGStat.ru website
Slava Pospelov (кельва.рф)

10 Apr, 17:27

Open in Telegram Share Report

Пайплайн из 50 нод n8n внешне выглядел рабочим. На деле — молча падал на части запросов, и узнал я об этом не из логов, а после письма клиента: «результат пустой».

Речь про генератор комментариев для медиа. n8n берёт новость, пишет комментарий от лица клиента, целится в 1500 символов. Всё кажется прозрачным, пока не пытаешься понять, куда уходит половина запросов.
Первое, что всплыло — тихие ошибки. Если в n8n нода падает без Error Trigger, пайплайн замирает в статусе "processing" и молчит. Нет коллбэка, нет алерта — клиент ждёт, а пайплайн просто висит. Решил это просто: поставил Error Trigger, добавил retry на слабых местах и ввёл клиентский таймаут в 5 минут. Теперь хотя бы понятно, где сыплется.

Но интересное началось дальше. Оказалось, LLM не умеет считать символы. Просил Claude Sonnet: "сделай ровно 1500 символов" — получал 1129, терялись целые абзацы. GPT-5-nano выдавал 3432 символа, проигнорировав ограничение. Оба — без ошибок, API возвращает 200, pipeline считает задачу завершённой. Проблема в токенизации: LLM работает с subword tokens (BPE, WordPiece), а не с символами. Для модели "символ" — абстракция, не единица счёта. RLHF-обучение добавляет verbosity bias: длинный ответ модели предпочитают, коротким инструкциям сопротивляются даже при явных ограничениях.

Решение оказалось не в промпте, а в структуре. Я стал оборачивать каждый абзац на входе в теги: [P1]...[/P1], [P2]...[/P2] и так далее, и просил модель сохранять их в выводе. Теперь теги якорят текст — модель не может выбросить блок, не нарушив структуру. После этого Claude и GPT перестали терять абзацы. Счёт символов по-прежнему неидеален — модель не считает, — но структура не разваливается, и это главное.

Суть такая: если LLM не может выполнить инструкцию напрямую (как с подсчётом символов), надо менять саму задачу и давать структуру, которую модель способна удержать. Промпт-инжиниринг не обходит архитектурные ограничения, но правильная разметка входа решает настоящую проблему.

#ИИ #n8n #Debugging #LLM #AIAgents #Автоматизация

100 0 0 1
Catalog
Channels and groups catalog Channels compilations Search for channels Add a channel/group
Ratings
Rating of Telegram channels Rating of Telegram groups Posts rating Ratings of brands and people
API
API statistics Search API of posts API Callback
Our channels
@TGStat @TGStat_Chat @telepulse @TGStatAPI
Read
Академия TGStat Telegram Research 2019 Telegram Research 2021 Telegram Research 2023
Contacts
Справочный центр Support Email Jobs
Miscellaneous
Terms and conditions Privacy policy Public offer
Our bots
@TGStat_Bot @SearcheeBot @TGAlertsBot @tg_analytics_bot @TGStatChatBot