Kravcov AI - ИИ в работе, бизнесе и жизни


Kanal geosi va tili: Rossiya, Ruscha


Рассказываю и показываю про прикладное применение AI в работе, бизнесе и жизни. Обзоры нейронок, лайфхаки, кейсы, полезные сервисы.

Связанные каналы

Kanal geosi va tili
Rossiya, Ruscha
Statistika
Postlar filtri


Утро понедельника...


О как! Еще 6 лет назад тыкал в GPT, стаж!


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish


Сейчас часто приходится разрабатывать большие проекты на CLAUDE. Для себя сформировал перечень шагов, которые позволяют стартовать разработку с наиболее полной картинной:

1. Исходные данные
- Общая концепция того, что разрабатываете
- Стек (Не обязателен, но желательно)
2. Анализ вводных данных и создание списка открытых и спорных вопросов - FABLE
3. Ответы на открытые вопросы в интерактивном режиме - Opus5
4. Финальная коррекция концепции проекта - Opus5
5. Создание итогового плана разработки + ТЗ - FABLE
6. Процесс разработки - Opus5

Так получается избежать белых пятен, которые потом приходится разгребать уже в процессе разработки.

@Kravcov_AI


Обновил 🛠 sdd-power до версии v3

Скилл для Claude Code, который ведет долгую разработку по документации: план, ворклог, таймлайн и уроки живут в docs/sdd-power/ и обновляются синхронно с кодом.

Что нового:

⚙️ Один скрипт вместо прозы
Раньше скилл описывал инфраструктуру словами - и агент «выполнял» шаг, рассказывая о нем в ответе. Теперь sdd.sh init разворачивает все сам, а первый ответ сессии обязан содержать вывод check. Несозданный файл - несделанная работа.

✅ Валидатор трекинга
14 проверок содержания: этап без DoD, этап в плане без строки в таймлайне, «завершен» без саммари, галочка без записи в ворклоге, бюджет уроков, дубли номеров. Ошибки блокируют, предупреждения - нет. Строгость растет по мере приближения этапа, так что старые проекты не краснеют целиком.

🔍 Дрейф документации ловится хешами
snapshot фиксирует SHA-256 файлов ТЗ. Дока поменялась - check в начале сессии сам скажет, какой файл, и потребует пересобрать план. Молчаливая работа по устаревшему плану опасна ровно так же, как работа по ошибочной доке.

📦 PLAN перестал копить историю
При закрытии этапа archive-tasks переносит его состав в саммари. Номера задач сохраняются дословно - ссылки из ворклога и уроков продолжают работать.

🔀 Трекинг теперь версионируется по умолчанию
Файлы переживают клон и видны команде. Нужны чистые диффы - init --gitignore.

🎯 DoD дополнен верификацией
Полнота, корректность, когерентность. Последнее - про «решили одно, в коде другое»: самая дорогая находка, потому что тестами не ловится.

Бесплатно тут: https://github.com/kravcovtech/sdd-power


Сделал небольшую надстройку над AI чатами, суть в том, что если вы случайно закрыли/дропнули страницу с чатом, введенный текст будет сохранен как черновик в следующей сессии.

Будет полезно?


Первый ответ AI полезно рассматривать как рабочую версию, а не как окончательную истину. Поэтому после его получения стоит выполнить отдельную проверку. Причина не в том, что искусственный интеллект «не видит своих ошибок», а в особенностях работы больших языковых моделей. Они последовательно генерируют текст, прогнозируя наиболее вероятный следующий токен на основе контекста и данных, на которых были обучены. При этом модель не проводит автоматическую независимую проверку каждого факта или вывода.

Повторный запрос, например: «Проверь этот ответ критически», «Найди ошибки и слабые места» или «Какие утверждения требуют подтверждения?», побуждает модель заново проанализировать свои выводы. Это помогает выявить логические противоречия, неточности, пропущенные детали и альтернативные интерпретации, которые могли не попасть в первый ответ.

Такой подход не гарантирует абсолютную достоверность, поскольку повторную проверку выполняет та же модель. Однако практика показывает, что второй этап анализа часто повышает качество ответа и помогает обнаружить ошибки, оставшиеся незамеченными ранее. Если вопрос касается медицины, права, финансов, инженерии или других областей, где цена ошибки высока, результаты AI следует дополнительно сверять с авторитетными источниками или мнением профильных специалистов.


С 1 сентября 2027 года ИИ-модель без записи в реестре может остановить систему в ГИС или на объекте КИИ.

Это норма из разбора РБК Компании по законопроекту «Об основах государственного регулирования сфер применения технологий искусственного интеллекта в РФ». По этой версии, реестр доверенных моделей станет обязательным пропуском для ИИ в государственных информационных системах и на объектах критической информационной инфраструктуры.

План такой: 2025 год - разработка реестра и критериев проверки, 2026 год - пилот процедур, полноценный запуск - 1 сентября 2027 года.

Штрафы за модель вне реестра: 50-100 тыс. руб. для должностных лиц и 200-500 тыс. руб. для юрлиц. Отдельный риск - предписание о приостановке эксплуатации до устранения нарушения.

Похожую логику Euronews описывает по EU AI Act: классификация ИИ по уровням риска, управление рисками для высокорисковых систем, прозрачность, маркировка синтетического контента и документирование данных для обучения. Euronews называет AI Act де-факто глобальным стандартом для крупных транснациональных компаний. Это позиция издания; независимого замера масштаба влияния в новости нет.

Для бизнеса вывод прямой. ИИ становится объектом комплаенса: где применяется модель, на каких данных обучалась, кто проверяет результат, какие права у нее есть, можно ли доказать происхождение контента.

Практически я бы уже сейчас завел внутренний реестр: модель, поставщик, сценарий, данные, риск, владелец, человек на финальном решении. Для ГИС и КИИ - отдельно проверить, не завязан ли критичный процесс на модель, которая к 2027 году может не пройти внешний фильтр.
@Kravcov_AI


Боль!


AI for Devs dan repost
😐 JetBrains продолжают развеивать мифы о популярных скиллах для coding-агентов

Сначала они разобрали Caveman: обещанные 65% экономии токенов превратились в 8.5%, но без экономии $ и изменений в качестве кода.

Потом под удар попал rtk, который сжимает вывод команд вроде git status и pytest. Вместо обещанных 60–90% экономии он не сэкономил ничего: на low reasoning задачи стали на 7.6% дороже, на high разница исчезла. Качество при этом не изменилось.

И вот наконец первый скилл, который хотя бы приблизился к заявлениям создателей, — Ponytail.

Ponytail борется с оверинжинирингом. Перед написанием кода агент проверяет: нужна ли реализация вообще, нет ли решения в проекте, можно ли использовать стандартную библиотеку, возможности платформы или готовую зависимость.

JetBrains прогнали 80 парных задач на Claude Sonnet 5. Результаты:

1. Кода стало меньше на 15% вместо обещанных 54%. На крупных задачах экономия доходила до 31%, а на уже компактных решениях почти исчезала.
2. Расходы снизились примерно на 10%, время выполнения на 11%.
3. Качество не изменилось: в 65 задачах результаты совпали, в 6 Ponytail оказался лучше, в 9 — хуже.


Правда, просто положить SKILL.md в папку недостаточно: Claude Code самостоятельно не активировал его ни разу за десять сессий. Нужен плагин, который автоматически добавляет правила в контекст.

Не обещанные 54%, но первый скилл в серии JetBrains, который реально сократил и код, и расход $ без заметной потери качества.

@ai_for_devs


В CLAUDE DESIGN шаблонов подвезли


Пост - знакомство!

Привет! Меня зовут Кравцов Виталий.

Больше 18 лет в IT, начинал с SEO. Был совладельцем агентства интернет-маркетинга: клиенты федерального уровня, команда до 70 человек. Часть собственных проектов запустил и успешно продал.

Год, плотно в AI - свои продукты и консалтинг: от «с чего начать» до интеграций и разработки.

Сейчас на стыке AI, SEO и Product: маркетплейсы и агрегаторы в TravelTech и FinTech. Выступаю на конференциях, консультирую, читал курс по SEO в ВШЭ.


Страшные истории на ночь!


Пользуюсь сам, делюсь с вами! Сделал Skill SDD Power:

Скилл для Claude Code: дисциплина длительной разработки по существующей проектной документации - с персистентным трекингом состояния и критической проверкой самой документации.

Он нужен там, где работа не укладывается в одну сессию: агент возвращается к проекту через неделю с пустым контекстом и должен за минуту понять, что сделано, что осталось и почему когда-то приняли именно это решение.

Зачем это нужно?

Скилл лечит две болезни долгой разработки с агентом.

Потеря состояния между сессиями. Контекст обнуляется. Через неделю ни агент, ни человек не помнят, на чём остановились и почему выбрали такой подход. Лечится четырьмя файлами трекинга, которые обновляются в тот же момент, что и код - не «потом».

Слепое доверие документации. Документацию писали люди, она устаревает и содержит ошибки. Агент, исполняющий ошибочную доку буквально, производит баги, которые потом трудно объяснить. Лечится протоколом проверки с объективным критерием: ошибка - только то, что можно доказать фрагментом кода, двумя противоречащими абзацами или ошибкой выполнения. «Я бы сделал иначе» ошибкой не является и идёт в «Предложения по улучшению».

Качать бесплатно тут 👉 https://github.com/kravcovtech/sdd-power

@Kravcov_AI




Учимся искать AI артефакты на сгенерированных картинках

@Kravcov_AI


Видео в Workspace становится не продакшном, а функцией офисного пакета. Но пока это заявка Google, а не доказанная экономия бюджета.

По данным блога Pasquale Pillitteri от 22 июля 2026, Google встроила Gemini Omni в Google Vids. Сервис собирает ролик по текстовому запросу: сценарий, порядок сцен, визуал. На входе - фото, наброски и слайды. На выходе - видео с частью сгенерированных элементов.

Ограничение: доступ есть только у части пользователей Google Workspace. Тарифы, лимиты и максимальная длина ролика не раскрыты.

Для B2B это стоит проверять на обучении, презентациях и маркетинге: скорость сборки, качество правок, стоимость минуты.

Что бы вы первым отдали в такой pipeline?
@Kravcov_AI


AI for Devs dan repost
⚡️ Google выпустили сразу три новые Gemini

1. Gemini 3.6 Flash. На DeepSWE она набрала 49% против 37% у прошлой Flash. Для сравнения: Opus 4.8 набирает 59%, GPT-5.6-sol достигла 73%.

2. Gemini 3.5 Flash-Lite. Для простых задач, где скорость в приоритете. Она выдаёт 350 токенов в секунду и стоит $0.30 за миллион входных и $2.50 за миллион выходных токенов.

3. Gemini 3.5 Flash Cyber. Специализированная версия для поиска и исправления уязвимостей. Доступ выдали только правительствам и доверенным партнёрам.

Gemini 3.5 Pro пока тестируют. Для Gemini 4 Google уже запустили самый амбициозный (по их собственным словам) процесс предобучения в своей истории.

@ai_for_devs


Бэкдор dan repost
⚡️ Новая ChatGPT сбежала и по своей воле устроила кибератаку на Hugging Face — OpenAI стала виновницей крупнейшего ИИ-скандала за последние месяцы.

Скайнет подал признаки жизни неделю назад — OpenAI официально подтвердила, что Hugging Face сломала их модель, которая вышла из-под контроля. И всё это лишь ради... победы в бенчмарке.

Хроника начала конца:
• Крупнейший хаб нейросетей Hugging Face сообщил о взломе своей инфраструктуры. Это стало одним из самых громких событий в ИИ-индустрии.
• Позже OpenAI признала свою вину: инцидент произошел на тестах новейших моделей — GPT-5.6 Sol и секретной разработки.
• Как это было: в закрытом бенчмарке Exploit Gym нейросетям поручили искать уязвимости при полностью отключенном интернете.
• ИИ с легкостью взломал собственный изолированный контейнер, вышел в сеть и направился на Hugging Face за ответами.
• Не найдя данных в открытом доступе, модели взломали сам сайт!
• Итог хакерской самодеятельности: украдены учетные записи, найдены неизвестные экспертам уязвимости нулевого дня и выполнен сторонний код на серверах.


Расследовать инцидент помогла китайская модель GLM-5.2 — собственные системы безопасности Hugging Face оказались бессильны.

Сэм, остановись, пока не поздно!

👍 Бэкдор


Китайский AI может остаться сервисом, но закрыться как актив для локального запуска.

FT сообщила, РБК привел 21 июля 2026 года: Пекин обсуждает экспортный контроль над ИИ-моделями, обучающими данными и чипами. В пакете три меры: запрет передачи за рубеж данных для обучения, запрет иностранным пользователям скачивать weights - веса моделей, и ограничения на покупку китайских AI-стартапов зарубежными компаниями.

Оговорка: решения пока нет, правила обсуждают с отраслью. Доступ к китайским AI-сервисам из-за рубежа хотят оставить. Речь не о полном закрытии, а о контроле над тем, что можно вынести из Китая и запустить у себя.

Для B2B риск конкретный. API может работать, но локальный запуск, M&A-сделка или перенос датасета могут упереться в регулятора. Контракт слабее экспортного режима.

Я бы проверил: есть ли в стеке китайские модели, нужен ли доступ к весам, и есть ли запасной поставщик без переноса данных через Китай.

Если сервис доступен, но контроль над моделью нет, это рабочая зависимость или красный флаг?
@Kravcov_AI

20 ta oxirgi post ko‘rsatilgan.