Такс, после некоторого отсутствия - я тут.
Было прям много всего за последний месяц, времени совсем нет.
Но, о чем же сегодняшний пост?
Об искуственном тугодуме ии.
Посмотрел я видео Ричарда Девиса с 13cubed о том как он видет работу с ИИ в криминалистике и о тех подводных камнях, которые за этим стоят.
Основные тезисы:
• Если мы используем общедоступные модели, мы не можем гарантировать что не вскроется потом какая-то уяза или недостаток (когда например как недавно окажется что чаты допустим индексируются поисковыми системами) и как следствие не можем быть уверены что данные заказчика не утекут.
• Так же сами по себе ИИ достаточно плохо понимают что происходит, тут могу добавить что одно дело когда оно ищет флаг на ctf, другое дело когда флаг сборный и надо ответить на пару вопросов - даже opus4.7 плывет.
То есть сказать что можно условного опуска натравить на несколько триажей и он смог бы решить и найти хотя бы большую часть зла в триажах - ну нет, он скорее найдет самое явно и будет кричать об этом. Опять же опыт на ЦБ CTF который мы делали когда я юзал его для речека показывал это. Короче я б не стал ставить хоть какие-то деньги что эта штука может провести хоть какой-то IR
Ну допустим не IR - мб можем автоматизировать работу?
Ну как посмотреть.
Если задача написать какой-то вайбкод инструмент - то как пример могу привести иногда очень специфичные временные метки - не факт что таймстепы специфичные инструмент ии сможет перевести верно, как следствие вы получите не те временные метки и будете дальше искать не там. С другой стороны а зачем? Есть инструменты уже многократно проверенные, которым доверяет мировое сообщество, зачем делать квадратные колеса нашему МТБ?
Окей - инструменты старые, но автоматизация допустим извлечения. Проблем нет - кроме разве что индексации чата, но допустим это решается тем что агент очень ограничен и может запускать только команды по триажу. В таком случае вы тратите токены на достаточно глупую работу, которую спокойно можно было выполнить скриптом, без подписок, без токенов и ВПН.
Вот и получается что по большому счету на данный момент это просто не работает - тебе иишка не дает не гарантий безопасности заказчика, не гарантий качественного ir, а автоматизации не много смысла. Думаю что возможно в траблшутинге может быть применение и есть - об этом кстати и автор видео сказал, приведя пример что как поисковик универсальный под форзу очень даже то.
Так же на канале есть еще видос про локальные модели - так мы решаем проблемы конфеденциальности заказчика, так что это как будто можно уже использовать например для подсвечивания и перепроверки своего анализа - что вы ничего не пропустили например.
Вообщем хочется сказать что как говорится - все не так однозначно. Агенты не дают весомого приемущества, но имеют минусы. Ну и в целом пока в сфере я лично не видел чтоб кто-то публично говорил что респонсить иишкой стал, хотя мб 2026 нам чета новое покажет.
Важно знать один принцип всех агентов - если есть возможность налажать, он обзательно это сделает.
Важно - я не поднимал тему mcp, мини ембендинг моделей и графов с локал агентами. Это совершенно другое.
Еще думал чучуть сказать про модуль MaxPatrol BAD - но тут анлак, пост не резиновый.
Оригинальное видео 13cubed -
https://www.youtube.com/watch?v=lvkBtIhvThk