Кисель в АйТи | AI и технологии


Гео и язык канала: Россия, Русский
Категория: Технологии


Я – Александр, и это мой авторский канал, где я пишу про разработку, AI и работу в айти.
Купить рекламу: https://telega.in/c/kisel_it

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


Пополняем фонд золотых цитат


За вчерашний вечер продвинулся на 7 место в BlueSec. До первой тройки еще далековато, но время есть


Если вас забанил Anthropic или вы просто устали от ИИ - вот идея для кухни


https://www.instagram.com/reel/DeKNxr7gNcb/?stkn=MW1hdmVrODV0OXNlcA==

https://youtube.com/shorts/dEllrDW-wz8?si=v95jnaqnKVmYk0Yu

Начал тут челендж по 3 рилса в неделю. Хочу научиться это делать регулярно, быстро и качественно. В тот раз был провал по звуку. В этот раз подрубил свою любимую петличку, стало лучше.

Так же дальше прокачал ИИ монтаж. Субтитры, инфографика - выглядит хорошо. Очень понравилось, как Клод может подрезать лишний момент или вырезать слово по команде 👍

Оказывается ролики с графикой из Клода это новый тренд, а я и не знал.

Давайте дружно навалим лайков в Инсте и Ютубе. А то алгоритмы будут меня душить до скончания веков. Ну ка, не ленитесь, я все вижу!)


Кажется, я нашёл, где можно нормально проверить своих ИИ-агентов в бою 😅

Сегодня зарегистрировался на BlueSec от Positive Technologies - соревнование, где нужно собрать агента, который расследует реальные и смоделированные киберинциденты. В том году были алгоритмы и ИИ, а в этом году уже посоревнуемся в реальных задачках кибербеза 😎

И да, я всё откладывал на потом и еще не начал готовиться... Ну ничего, наверстаем.

Вкратце что это вообще такое: на входе агент получает одну улику: например, подозрительный процесс на сервере. Дальше сам ходит по данным, ищет связанные события, восстанавливает цепочку атаки и пытается понять, кого взломали, какие учётки скомпрометированы и что вообще произошло. Причём тупо завалить модель контекстом не получится. За каждый лишний вызов инструмента снимают баллы. Так что стратегия поиска реально важный момент.

Всё будет проходить и офлайн и онлайн. Я уже по традиции пойду офлайн, благо мне тут не очень далеко.

Регистрируемся тут: https://bluesec.team/

До 10 октября тренируемся, а уже 10 октября - финал.


Кажется, OpenAI тихо докрутили multi-agent режим на декстопе в ChatGPT.

Сегодня дал ему задачу и внезапно увидел, как работа сама разъехалась по ролям: Maintainer backend и Maintainer ui. То есть вместо разных однотипных агентов Desktop самостоятельно генерирует маленькую команду. Как я понял это ещё и помогает не конфликтовать им при одновременной работе. Ты вот пили ui, а я пойду бэкенд делать.

Сама механика уже не новая. Но вот такую автоматическую разбивку на человеческие роли я раньше не видел.


Антропики настолько переживают за будущее человечества и неконтролируемую гонку ИИ, что решили выпустить Fable 5.5 на следующей неделе 😂


Видео недоступно для предпросмотра
Смотреть в Telegram
Я уже давно хотел завести рубрику про дни рождения людей, которые сильно повлияли на программирование, кибернетику, нейросети и вообще всё то, что мы с вами так сильно любим.

И каждый раз происходило примерно одно и то же. Я собирался подготовить пост, благополучно забывал про дату, вспоминал слишком поздно и откладывал идею до следующего раза :)
Но теперь отмазок больше нет.

В свободное время я занимаюсь своей контент-платформой, и она наконец-то научилась заранее присылать мне напоминания по всем заданным инфоповодам. Теперь я в курсе митапов, dev-конференций, релизов и, наконец-то, дней рождений великих людей.

Первым героем рубрики стал Алексей Андреевич Ляпунов.

Если вы интересуетесь историей программирования, имя очень важное. В 1950-х Ляпунов занимался одними из первых работ по программированию в СССР, активно развивал и популяризировал кибернетику, а позже фактически создал направление теоретической кибернетики в Новосибирске. Причём он не ограничивался большой наукой: в начале 70-х Ляпунов даже преподавал программирование школьникам. Очень хочется иногда вытаскивать из истории именно таких людей, про которых мы почему-то говорим сильно реже, чем про технологии, выросшие из их работ.

Оставался вопрос, в каком формате всё это делать.
Просто написать большой текст можно, но после пары экранов он начинает выглядеть как биография из учебника. Мне хотелось чего-то более наглядного, красивого и при этом интересного с инженерной точки зрения.

Поэтому я полез дорабатывать свой репозиторий every-frame-is-code.
Изначально я делал там красивую программно генерируемую инфографику и анимации. Теперь попробовал пойти дальше и научить весь пайплайн собирать уже длинные осмысленные видео с полноценной озвучкой.

И, кажется, получилось очень даже красиво :)

Озвучку делал гугловской моделью через OpenRouter. На все эксперименты, пробы и ошибки ушло примерно 20 центов.

Если интересно, могу отдельно разобрать весь флоу генерации: как собирается сценарий, сцены, визуал, озвучка и как всё это потом превращается в готовый ролик.

Ну и если вдруг для экспериментов с моделями нужно пополнить личный кабинет, это хороший повод протестировать виртуальную карту «Хочу Плачу».

По промокоду KISELIT дают скидку 500 ₽ на выпуск карты. Они, кстати, недавно обновили дизайн, выглядит очень классно :)
👉 https://hochuplachu.com


Так, ну этим я точно не могу не поделиться. Dot для себя сгенерировал целый пак анимаций по референсной картинке. Теперь у меня есть джун Кузя 😂


С Dot'ами интересно вышло. У них даже есть свой компьютер с gui, к которому можно подключиться. Эта штука периодически пишет с предложением что-нибудь сделать, имеет доступ в ГитХаб.


Еще завезли Appshot, который.... вы правильно угадали, не работает тоже. А должен по идее скриншотить по какому-то принципу открытое приложение сразу в чат, даже если оно не в фокусе.


Вот вам и новые "пространства"... В общем ничего пока не работает. Выглядит как Гугл Драйв с Notion, в котором есть ЧатГПТ. Если доведут до ума, то будет имбово. Если барьер между чатами на мобилке и с файлами на ПК полностью "падёт", то будет имбово х2.


Сегодня был OpenAI DevDay. Не то, чтобы прям вау, но интересные вещи представили.

• Dots - новый always-on агент. У него свой облачный компьютер и браузер, он подключается к вашим приложениям и может работать 24/7 в фоне. Ну, по крайней мере так заявлено. Поставил задачу, ушел пить пиво, потом проверил результат.
• GPT-6.1 Sol - не удержались от ответочки на Opus 5.5. OpenAI заявляет производительность близкую к Astra в кодинге, computer use и сложной работе, но примерно за 1/5 цены Astra. При этом базовые $2/$10 за миллион токенов остались как у GPT-6 Sol. Мне и шестой Сол нравился. Посмотрим как этот себя поведёт.
• ChatGPT Space - общее рабочее пространство, где люди, ChatGPT и Dots могут работать над одним проектом. Пока вообще не ясно зачем и для кого.
• Decisions API - ИИ принимает ограниченные решения из заранее заданного набора вариантов. Очень похоже на тот самый класс моделей/систем, который мы недавно обсуждали на примере Jev.
• И отдельная ракета: Ultrafast. До 300 токенов/сек, до 8× быстрее в Codex и 6× через API. Правда, API тоже стоит примерно в 6× дороже.

Всё потихоньку движется в сторону облака и постоянной среды с агентами, судя по всему. Это всё складывается с упором на "агентность" в последние месяцы. Думаю Dots это как раз первый шаг в сторону полностью автономных агентов, которые всегда на связи. Пока с ними многое не ясно, еще разберёмся.


Sonnet 5.5 вышел. Одним словом - вкусно.


Репост из: Эмоции успеха | Елена Логачева
😂👍👍❤️👌😅😊😊😍😘

28 сентября в 18.00 ч.

🎙️ Успешные, приглашаю вас на новый прямой эфир. «Мышление в IT подорожало: какие компетенции стали дефицитными, когда код подешевел?»

В IT меняется ценность профессиональных навыков. Обсудим, какую новую гибридную роль эксперта ищут компании и почему пока сложно назвать ее однозначно. Поговорим о критическом мышлении, системном видении и способности удерживать смысл — навыках, которые влияют на конкурентоспособность специалистов, руководителей и бизнеса.

У меня в гостях:

➡️ Константин Доронин - независимый консультант по искусственному интеллекту и разработчик, эксперт по внедрению ИИ в рабочие процессы, созданию продуктов и обучению команд. В разработке с 2009 года, управляет командами с 2012-го, занимается прикладным ИИ с 2021-го.

➡️ Александр Киселев - Python-разработчик, автор канала об ИИ и технологиях, экспериментирует с применением ИИ в разработке, аналитике, проектировании и автоматизации процессов.

Сегодня компании сталкиваются сразу с двумя новыми задачами. С одной стороны, нужен человек, который видит систему целиком: связывает инструменты и процессы, а не просто пишет промпты. С другой — всё больше времени уходит на синхронизацию работы команд и согласование решений.
Это две разные роли или постепенно они объединяются в одну? Какие компетенции нужны такому специалисту? И кого выберет бизнес, если прямо сейчас может позволить себе найм только одного специалиста?

🔥 Эфир будет особенно полезен:
• разработчикам и системным аналитикам;
• руководителям IT-команд, продуктов и проектов;
• специалистам и руководителям, которые хотят понять, какие компетенции становятся ключевыми в эпоху ИИ.

Не забывайте проходить РЕГИСТРАЦИЮ. Так вы получите ссылку на zoom-встречу, где сможете задать вопросы напрямую экспертам, разобрать ваш кейс с гостями эфира и оставить комментарии.

До встречи завтра в 18.00 ч. 👋


Внимание! Пропали бусты! Помочь найти можно по ссылке: https://t.me/boost/kisel_it

Хотел добавить вам кастом эмодзи и ничего не получилось... Выручайте.


Кто какие инструменты использует для поиска мёртвого кода?
Мне ничего достойного не попадалось. Vulture тупой как пробка, а если в проекте DI, динамические импорты и другое "волшебство", то всё совсем печально. Учитывая, что Клод/ГПТ могут за одну фичу родить 5-10 тысяч строк проблема стала прям очень актуальной.


Видео недоступно для предпросмотра
Смотреть в Telegram
Every frame is code 🎬

Собрал и выложил motion-kit: набор знаний для AI-агентов, которые делают графику кодом. Это анимационные ролики, эксплейнеры, кинетическая типографика, переходы, 3D-сцены и браузерные игры с хорошим game feel.

Прям кайфую с того, как это работает. Последнее время было много роликов с возможностями того же Опуса, но каких-то прям готовых промптов и гайдов не нашел. А из коробки "сделай красиво" не работало от слова совсем. Надеюсь кому-то пригодится. Сам планирую использовать для небольших гайдов и демок, в том числе и по работе. Ну а что, выглядит очень эффектно!)

Идея простая: модель не генерирует пиксели, а пишет программу, которая рисует каждый кадр. Получается красиво и предсказуемо т.к каждый кадр просто функция от времени, поэтому ролик можно перемотать на любую секунду, быстро поправить одной строкой и перерендерить без потери качества.

Прикрепленный ролик сделан именно так: один HTML-файл, ни одной внешней картинки и ни одного аудиофайла.

▪️ Canvas 2D: огонь из 650 частиц, гравюра с «дрожащей» линией, 12 палитр в одной композиции
▪️ Three.js: сфера, bloom и 20 000 частиц на шейдере
▪️ GLSL-переходы: прожиг, волна, luma-вайп
▪️ Game feel: hitstop, тряска, squash & stretch, speed ramp
▪️ Музыка и звуки синтезируются в том же файле на Web Audio и привязаны к тем же событиям, что и картинка
▪️ Покадровый рендер в MP4 через Chrome и ffmpeg, проверка по контакт-листу

Репо тут - с вас по звёздочке. Если есть идеи, что можно улучшить - пишите.

P.S Выложил еще и на Pages, там красивее - https://kiselas.github.io/every-frame-is-code/


Сбросов не было, так что активировались мошенники. Будьте бдительны!


Кажется, мы неправильно представляли себе будущее ИИ-агентов.

Не одна огромная модель будет думать над каждым чихом. Скорее наоборот: дорогую LLM будут звать только туда, где действительно нужно думать, а сотни мелких решений отдадут быстрым специализированным моделям.

И Jev уже начинают проверять именно в таких сценариях.

Например, ему дали Minecraft. Каждые ~600 мс модель получает состояние мира: здоровье, голод, врагов рядом, позицию и текущую цель — и решает, что делать дальше: драться, убегать, есть или продолжать задачу. Причём несколько таких решений она принимает параллельно за один вызов.

Есть похожие эксперименты с Doom: вместо длинных рассуждений модель несколько раз в секунду выбирает буквально одно действие - влево, вправо, стрелять, искать аптечку. Это уже гораздо ближе к реальному управлению системой, где ответ нужен сейчас, а не через 10 секунд после красивого chain-of-thought.

Появились и браузерные агенты, Minecraft-моды, шахматы, 2048, NPC и даже футбольный матч, где каждый из 22 игроков управляется отдельным Jev.

И вот тут идея становится понятнее.

Большая LLM может сказать:
«Нужно добыть ресурсы, построить укрытие и пережить ночь».

А дальше Jev сотни раз решает:
бежать или драться?
есть сейчас или потом?
куда повернуть?
продолжать цель или реагировать на угрозу?


То есть архитектура постепенно становится такой:
LLM планирует → Jev принимает быстрые локальные решения → обычный код исполняет.

И мне кажется, именно это сейчас самое интересное в Jev. Своего рода попытка сделать рефлексы для ИИ-агентов.

Показано 20 последних публикаций.