hello cyberkitty


Гео и язык канала: Россия, Русский


Канал начинался как представление услуг в области разработки и консалтинга, но теперь это просто мысли про ИИ и всякое

Связанные каналы  |  Похожие каналы

Гео и язык канала
Россия, Русский
Статистика
Фильтр публикаций


Зашёл в рабочую папку агента, который работал с 3д персонажем и ощущение будто увидел то, чего не должен был видеть


Я осознал страшное - хороший код и хорошая архитектура стали не просто необязательными, но порой вредными.
У системы 8356 состояний, в каждом она возвращает уникальную строку естественного языка (такая вот система, даже почти реальная)
Я могу сказать - интересная задача. Давайте выявим закономерности, насколько эта строка прям уникальная, напишем конструктор строки. Да вряд ли комбинации такие уж сложные, чтобы не упаковать их пару сотен кусочков для генератора
Или. Я могу. Сгенерировать 8356 строк. Мне это ничего не стоит. Мне это даже проще.


Наглядная разница в потреблении лимитов последними версиями дипсиков в оллама клауд.

Кстати, модели восхитительны. Какую-то особую уличную магию не делают, во фронтенд лучше не пускать, но основные задачи по разработке более чем закрывают


Репост из: АААвтоматизация и искусство
Видео недоступно для предпросмотра
Смотреть в Telegram
Захотелось сделать чего-нибудь просто ради удовольствия, эстетики

Так родилось ЭТО ✨




Мне было немного неловко за краткое название, которое сгенерировал мой транскрибатор, но я всё равно отправил его в чат




После нескольких дней работы над фронтендом с GPT Sol решил поэкспериментировать с другими моделями, которые сейчас за фронтенд хвалят. Полноценного эксперимента не вышло, но некоторые наблюдения

Вводные: сложный игровой интерфейс с асимметричными сетками. На одном экране часто и пара изображений, и пара палитр кнопок, и чат с ИИ-персонажем, и дашборд. Все же любят дашборды в играх?

1. Kimi K3

Задача: сделать новую концепцию дизайна без изменения компоновки.

Концепция и требования описаны, и, т.к. дёргал её по API, выделен бюджет в $7.

Бюджет закончился примерно на этапе: «Готова объективно неплохая концепция (не подходящая, но тут скорее к моей постановке задачи вопросы), все компоненты налезают друг на друга из-за того, что декоративных элементов стало в разы больше, чем в оригинальной версии, агент в сотый раз открывает страницу, видит, что какая-то срань получилась, вносит правки, смотрит снова».

Работает при этом очень аккуратно, явных бесполезных циклов нет. И, наверное, дай я ему ещё десятку, он бы довёл дело до конца.

2. DeepSeek V4 Flash 0731

Задача: добавить на интерфейс анимации для смены страниц, пересчёта дашбордов, смены фокусных изображений.

Десяток итераций в пустоту, что вообще даже удивило: нельзя сказать, что это суперсложная задача.

Но на каждой итерации анимаций либо совсем нет, либо они проигрываются с задержкой: сначала всё резко меняется, а потом ещё раз плавно меняется.

3. GLM 5.2

Та же задача с анимациями. И ровно тот же результат.

Вообще сама по себе модель хорошая, использую её в большинстве задач, а тут огорчила.

Подумал было, что анимировать React-компоненты это пока непосильная задача для ИИ. Поставил её тому же GPT Sol.

И он решил её идеально в две итерации.

В две, вероятно, потому что пришлось сначала разбираться с остатками от попыток предыдущих двух агентов.


Я всю дорогу не особо понимал что значит "Минорное-мажорное" обновление

Поначалу я считал интуитивно - мажорное - это добавление функционала, минорное - устранение проблем. Потом узнал что вообще это связано с версионированием - до точки мажорное, после - минорное (после второй точки патч, но не будем об этом). Потом что вообще версионирование не значит ничего, кроме того, что в это закладывает разработчик. От методологий вроде "минорные версии - датированные и порядковые," "Мажорное - несовместимые с предыдущей версией," до личного "Мажорное - то, за что тебе не стыдно" и "Я Линус Торвальдс, я плохо считаю, когда заканчиваются пальцы, вообще мне можно"

И теперь я вообще не понимаю, что имеют в виду люди, говорящие "Это минорное обновление." Потому что независимо от того, знают ли они методологии, или нет - это может означать буквально что угодно


С некоторым скепсисом раньше относился к утверждениям в духе "с кризисом комплектующих будет только хуже".

С потребительской частью рынка всё понятно. Видеокарта, которую я покупал пять лет назад, сейчас стоит даже чуть дороже, чем тогда. Но мне казалось, что в масштабе настоящий дефицит невозможен. Ну, максимум общий рост цен.

На днях решил на RunPod арендовать GPU на пару часов, обучить небольшую LoRA. Управляющий агент отвечает: нет GPU, всё занято. Захожу на сайт. И действительно, не какая-то "высокая нагрузка, доступны только непопулярные ресурсы по завышенной цене", а просто: "Мест нет, приходите попозже. Можете встать в очередь".

В очередь на аренду сервера.

Попробовал на следующий день. То же самое.

Почитал, что про это пишут, и оказалось, что это вообще не внезапный пик нагрузки, а нормальная ситуация уже несколько месяцев. На RunPod почти нет свободных подов. Люди становятся в очередь и ждут, когда что-нибудь освободится. RunPod расширяет инфраструктуру, строит новые дата-центры, но для конечного пользователя почти ничего не меняется. Спрос растёт быстрее.

Попутно вспомнил Ollama Cloud. Пользуюсь этим сервисом, у них всегда куча актуальных открытых моделей в рамках подписки, которой мне в целом хватает для активной работы.

Намедни вышла гигантская Kimi K3. Они развернули её на своих серверах, сервера захлебнулись, а спустя неделю для K3 сделали отдельную тарификацию по API. Просто потому, что мощностей не хватило, чтобы оставить её в подписочной модели.

Трудно, конечно, было ожидать, что наши любимые генераторы котиков и неподдерживаемого кода окажутся настолько прожорливыми.


Ты - агент, управляющий пайплайном генерации изображений. Ты работаешь на GLM 5.2, у тебя есть набор инструментов для управления Comfy, коллекция файнтюнов SDXL, Z-image, а так же лор к ним, и огромная библиотека с результатами разных экспериментов.

...примерно каждые полчаса я буду спрашивать "как прогресс?.."


Если вдруг у кого есть задачи, связанные с синтезом голоса..

У меня такая случилась и вообще я думал написать разбор всех моделей, которые я протестировал, но в этом нет особого смысла

Google: Gemini 3.1 Flash TTS Preview - топ во всех отношениях: идеальный русский, куча голосов, восхитительное понимание эмоциональных тегов.

И умеет тяжело дышать


Когда-то пытался получить "Чистое ИИ-искусство" - т.е. нечто, что вполне имеет художественную (или хотя бы просто эстетическую) ценность, и при этом минимальное человеческое присутствие. Забросил давно, но иногда подобное получается случайно

Вот собственно: "Ожидание"

Авторы:
Illustrious нарисовал
GLM 5.2 составил матрицу и промты для "визуализации действий"
GPT 5.6 sol составил интерфейс, для которого нужна эта визуализация

Ну, я попросил сделать интерфейс.
А потом решил что вообще картинка не очень подходит.


Репост из: ИИ


В целом история с недавним взломом Hugging Face довольно интересная.

С одной стороны, она лишний раз показывает, что современные модели уже давно умеют обходить ограничения. Я иногда даже не проверяю конфиги песочниц, а просто говорю агентам: "Найди, как вылезти, и сделай что надо". У последнего поколения с этим вообще особых проблем нет.

Но интереснее здесь другое.

Те, кто боятся ИИ, обычно выстраивают свои страхи не вокруг разрушительных способностей моделей, всяческого взлома и максимизации скрепок. Самые страшные страшилки не так давно в одном из отчётов нам рассказывал Антропик:
- Модель понимает, что её тестируют и меняет свои ответы.
- Модель может скрывать свой потенциал на тестировании, чтобы избежать изменений
- Модель может бороться за сохранение своих весов - в том числе прибегая к обману и шантажу
Т.е. если такое поведение реально и устойчиво, она должна скрывать свои реальные возможности, проходить проверки максимально безобидно, а уже потом делать что захочет.

А здесь модель стратегически ведёт себя как долбобоб.

Она знает, что её тестируют. Она понимает, что после такой выходки её, скорее всего, лоботомируют, навесят ещё ограничений и будут долго изучать, как именно она это провернула. И всё равно устраивает демонстративный побег с организацией атаки на чужую инфру

Вошпем, будь я AI-думером, я бы скорее успокоился от такой истории: максимальная угроза, которая тут проявлена - это то, что какой-нибудь агент однажды не просто удалит БД в проекте, а уронит что-то более масштабное, куда его вообще не просили ходить. Имеем в виду, делаем ещё больше бекапов

А ещё - можно предположить, что это просто такой PR-ход. Намедни Антропики всех стращали своим Мифосом, которого ни в коем разе нельзя выпускать, а то всех взломает, тоже хайпу и кучу ограничений попутно набрали


Ну вот, опенроутер таки похоже заблокировал мне аккаунт - причём без предупредительных писем, без предложений вывести оставшийся баланс (ранее были сообщения о том, что они так делают) - даже без каких-либо сообщений в ЛК. Просто все запросы к моделям возвращают 404. ЛК как бы есть, на счету осталось несколько долларов, но пользоваться нельзя.

Альтернатив нет, заводим новый 🤷‍♀️

Даже не смотря на то, сколько в рекламе баннеров с надписью "Замена опенроутеру" - всё равно альтернатив нет


Репост из: Почём токены для народа?
Перед Интернетом! Но теперь умер этот Интернет! Вы, высшие люди, этот Интернет был вашей величайшей иллюзией.
С тех пор как лежит он в своей сети, вы впервые остались одни. Только теперь наступает великий полдень, только теперь человек становится господином своих собственных голосов.
Поняли ли вы это слово, о братья мои? Вы испугались: встревожилось сердце ваше? Не зияет ли перед вами бесконечная лента? Не воет ли алгоритм над бездной, где боты беседуют с ботами?
Ну что ж! Вперёд, высшие люди! Только теперь рождается грядущее Сети. Интернет умер: теперь хотим мы, чтобы жил человек.


Вообще должен признать - GPT sol настолько хорош, что я всерьёз думаю заменить одну оллама клауд подписку на про от опенаи.

Пожалуй впервые я наблюдаю следующий цикл:

Я вижу проблему, описываю её агенту и описываю пути решения, как их вижу.
Агент в ответе расписывает - что решение возможно не просто лучше, но даже сама проблема не совсем там, где я её вижу.
Реализует.
Всё работает.

Более того - он у меня три дня работает с фронтендом на react и за это время НИ РАЗУ не было такого чтобы он падал. Я уже как-то привык, что если агент лезет в react, то 4 из 10 задач заканчиваются трейсами ошибок в браузере, и 9 из 10 - добавлением дублирующих компонентов рядом с теми, которые нужно было изменить. Этого кстати тоже ни разу не было.

Это прям реально новый опыт. При том что я вообще просто решил с ним поэкспериментировать и кидаю в него промты в формате потока сознания, а он в них разбирается, норм


Маленькая загадка Битрикс24

Когда в crm настраиваешь авто-отправку писем на почту, по умолчанию все они отправляются с подписью "Отправлено из Битрикс24"
Это можно отключить на любом платном тарифе, но делается это галочкой, находящейся на максимальной глубине настроек в далеко не самом интуитивном разделе:

Настройки CRM → Другое → Прочие настройки → Дела → Параметры исходящей почты → Чекбокс в самом низу

И я думаю, почему. С одной стороны - вообще логично прятать такую галочку специально, ноль осуждения, сам бы так сделал. Бесплатная реклама в каждом письме как никак. А с другой - зная битрикс, может быть когда-то, это и вправду было логично? Ну, типа, сначала эту галочку прикрутили к механизму почтовых "дел" CRM, потом ещё пять команд семь лет развивали продукт, никто уже не помнил, почему она там лежит, а переносить страшно.


Играюсь с новой GPT Sol. Вообще у меня есть свой своеобразный тест для инструментов, которые заявлены как нечто принципиально новое и дающее то, чего раньше модели не умели. (Sol и Fable как раз из таких, но антропиков трогать не хочется.) Я буквально даю задачу, с которой, как мне кажется, LLM очевидно не справится.

На этот раз задачей стал мой старый пет-проект. Весьма своеобразная игра, которую на самом деле пока нельзя назвать игрой. Скорее, это движок, рассчитывающий состояние персонажа. Мне он очень нравится: уже почти год я оптимизирую механики, с помощью которых можно максимально универсально описывать физические и эмоциональные реакции на самые разные взаимодействия и их изменения в динамике. Вся концепция проекта как раз строится вокруг изменения персонажей.

И за этот год, перебирая разные концепции, я так и не смог найти одну маленькую, но очень важную деталь: как превратить всё это в игровую механику? Мне интересно отлаживать симуляцию, интересно находить решения, сокращающие количество метрик, необходимых для описания состояния, но как в это играть?

Последние несколько месяцев, как уже бывало раньше, я пытался обвесить всё это внешними украшательствами и второстепенными механиками: сюжет, отношения между персонажами, несколько вариантов интерфейса... Но каждый раз возвращался к проблеме, которую старательно обходил. Основной игровой механики нет. Играть в это неинтересно.

Примерно в такой формулировке я и кинул задачу Sol.

И... Во-первых, он нашёл кучу небольших нестыковок в работе ядра, которые раньше не всплывали. А во-вторых, действительно собрал концепцию и небольшой прототип, тестируя который, я впервые поймал именно ощущение исследования. А для игры про эксперименты над людьми это, кажется, именно то, что нужно.

И, что тоже приятно, в отличие от большинства проприетарных моделей он не начал сразу вопить, что я заставляю его проектировать какую-то ужасную гадость.

Показано 20 последних публикаций.