very vibe coding


Гео и язык канала: Россия, Русский
Категория: Технологии


Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций






Если интересуетесь разговорными агентами, например, для организации службы поддержки, посмотрите на Grok Voice Think Fast 2.0 - видимо, это новая SOTA


Видимо, скоро нас ждет Haiku 5 и еще одна новая модель. С хайку давно пора что-то делать, да и Соннет вышел совсем неудачным - вместо дешевых моделей Антропика я использую GLM, DeepSeek или GPT Luna.


Пошел слушок, что новый мак мини запустят в сентябре. У Apple были планы в младшую версию ставить М6 - это интересно, но самое интересное для меня, сколько будут стоить большие версии, на которых можно гонять Qwen 3.8 27B и DeepSeek v4 Flash..


Сбросили, как и обещали ))


В твиттере уже какое-то время прогревается история про модель SubQ, которая обещает решить проблему квадратичного масштабирования контекста, а значит, помимо длинны конекста, еще и скорости и цены токенов. Сейчас открыли запись на тестирование модели. И если это действительно прорыв, думаю, скоро мы все об этом услышим. Это может быть действительно геймченжером


Завтра вечером сбросят лимиты Кодекса, так что можно сегодня гонять gpt на максималках


Ну да, все больше свидетельств, что бесплатная модель в опенроутере - GLM 5.3 Flash. Конечно, ни с каким Sol она не конкурирует. Главный конкурент DeepSeek V4 Flash. Думаю, именно это заставило Дипсик мальца сбросить цены.

Эти модели интересны тем, что на них можно посадить несложные рутинные задачи или такие вещи как построение онтологий и графов. Маленькие модели не справляются, большие - дорого.

У меня сейчас подписка на GLM за $60 - в принципе, GLM 5.3 нормальная модель, использую ее, но токенов маловато - OpenAI щедрее, их подписка в этом плане самая большая. Думал снизить лимит до $20, но посмотрю на флэш и там буду решать.

PS. Использую разные модели для проверки друг друга - нравится мне эта тема, разные нейронки находят разные ошибки




Чудес не бывает. Новая моделька, которая бесплатно лежит на опенроутере, работает, но есть впечатление, что это маленькая модель. Условно, GLM Flash. На фронтир не тянет и далеко. С другой стороны, дареному коню в зубы не смотрят, есть задачки и для таких моделей…


Попробовал в Клоде команду /doctor - сделал вывод, что харнесы для поддержания своих скриптов в порядке, чистка памяти и пр. как отдельный скилл не нужно - надо просто раз в неделю запускать доктора и все будет хорошо.


DeepSeek Pro может и хорошая модель, и харнесс интересный, но на уровне МАХ размышляет она бесконечно. 20 мин на две реплики, там, где Клод справляется за минутку, это, конечно, кого угодно из себя вывести может. Для тех, кто никуда не торопится


Кстати, если захотите задешево попрограммировать - есть моделька от Меты - Спарк 1.2, которую можно гонять по $0,2 за выходящий токен (по цене DeepSeek Flash). Нюанс один - все данные отдаются Мета для обучения. В общем, не жалко - кого только можно обучить на таких данных? )) Разве что вайбкодера..

https://openrouter.ai/meta/muse-spark-1.2-contributor

Любопытно, что Qwen3.8 27B стоит в инференсе 3 доллара - и вот этого я не понимаю, тот же DeepSeek Flash, который почти в 10 раз больше размером стоит в 10 раз дешевле. Какая-то странная экономика..

Ну а в экономику ИИ лучше всего раскрывают в этом видосике. Порадовали..






Я тут как раз пытался пересадить скрипт по подготовки презентаций с Клода на DeepSeek, да еще и его харнесс. Но было не особо, так как писать презентации он мог, а видеть - нет. Как Бетховен.

Так что, то, что у Дипсика появилось зрение - очень даже кстати.

https://t.me/dealerAI/1903


Qwen3.8 стал хитом, и под него тут же появилась нецензурированная версия, о ней много кто писал, но есть и другие интересные варианты - например, ускоренная модель, которая выдает а пару раз больше токенов..




Репост из: Tips AI | IT & AI
Видео недоступно для предпросмотра
Смотреть в Telegram
Если вы часто отлаживаете UI-анимации, и ловите проблему когда OCR клода не может понять что именно не так

Попробуйте поюзать terminal-browser, вернее его функцию Agent Recordings для создания визуального баг-репорта:

1/ Она записывает содержимое открытой вкладки
2/ Запись открывается в покадровом редакторе
3/ Ты находишь кадр с багом
4/ С помощью стрелок и коментов показываешь агенту что не так
5/ На выходе получается папка с видео, кадрами, аннотациями и JSON-манифестом

В остальном это такой же обычный браузер как и в любом IDE, только в терминале:
- Агент и человек работает в одной и той же среде: агент управляет через команды а человек видит это в реальном времени
- Внутри полноценный Chromium, а не кастрированный текстовый браузер


Установить: terminal-browser.com

Пока работает только на macOS & Linux и нужен терминал с поддержкой картинок (например ghostty или cmux)

@tips_ai #tools

Показано 20 последних публикаций.