Posts filter


Forward from: noble
Video is unavailable for watching
Show in Telegram
^ #стратегия by noble

часть 1


Video is unavailable for watching
Show in Telegram


Forward from: Глебсмит
С понедельника DeepSeek поднимает цены на API, то есть на коммерческое использование своей модели. Не на проценты, а сразу в 12 (!) раз. DeepSeek, который полтора года назад обвалил американские техбумаги одним фактом своего существования и стал главным аргументом в споре «а точно ли эта штука стоит триллион». Пока пострадают все, кто уже встроил модель внутрь своего продукта и посчитал экономику по старой цене. Потом думаю и до физлиц руки дойдут.

DeepSeek был не просто компанией, а аргументом. Он доказывал, что фронтирная модель собирается относительно дёшево, что монополия на дорогое железо не абсолютна и что веса моделей можно просто выложить. На этом выстроили целую идеологическую линию: открытые модели против закрытых, свободный доступ против корпоративного огораживания.

Проблема в том, что деньги берут не за файл. «Открытую модель» действительно можно скачать. И работая с ней обнаружишь, что нужны чипы, которых нет, электричество, которое дорожает, и инженеры, которых не найти. Поэтому подавляющее большинство крупных пользователей открытой модели идут ровно туда же, куда и пользователи закрытой: в чужой дата-центр, по счётчику. «Всякое распределение предметов потребления есть всегда лишь следствие распределения самих условий производства», - дедушка Маркс. Модель ИИ - предмет потребления. Дата-центр - условие производства. Раздать первое «бесплатно», не раздав доступа к второму, означает не раздать ничего.

Мантра последних лет звучала как intelligence too cheap to meter – интеллект в эпоху ИИ настолько дешёвый, что считать его бессмысленно. Формулировку Альтман позаимствовал у Льюиса Штрауса, председателя Комиссии по атомной энергии США, который в 1954-м обещал это про электричество из атома. Обещание не сбылось ни разу. Зато счётчики поставили везде.

Альтман в 2021 году написал эссе, где Маркс не упомянут ни разу, а сказано следующее. Программы, умеющие думать и учиться, будут делать всё больше работы, которую сейчас делают люди. Цена труда упадёт к нулю. Богатство сконцентрируется в двух вещах: в компаниях и в земле, потому что земли фиксированное количество. Сегодня он ведёт на биржу компанию, которая всё это и осуществляет.

Отдельно интересно, что параллельно с повышением цены у «бесплатных» китайцев, «платные» американцы делают ровно противоположное. OpenAI повышает лимиты и раздаёт ChatGPT бесплатно - чтобы увеличить количество пользователей перед осенним размещением. Google выкатывает Gemini Flash вдвое дешевле предыдущего. Anthropic режет прайс. Американцы дешевеют, китаец дорожает.
Отсюда вывод. Дешевизна не была свойством технологии. Она была позицией. Пока требовалось доказать, что американская модель переоценена, китайцы раздавали свое почти даром. Доказали, народец пришел, счётчик включили. Американцам сегодня требуется показать инвестору кривую роста пользователей, и раздают даром уже в Сан-Франциско. Покажут - подорожает и там.

Цена никогда не отражает издержки. Она отражает стадию. Когда один уже начинает выжимать, другой ещё наливает бесплатно. И меняются по очереди. Вопрос то не в щедрости, а в фазе одного и того же процесса. Выжмут досуха и открытые, и закрытые модели, потому что открытость и закрытость это просто наименования способа и подхода к выжиманию.

Всякий, кто сейчас считает экономику своего дела по нынешним ценам на ИИ, пишет вилами по воде. Потому что по сути продают не «интеллект», а право войти в чужой дата-центр тогда. Это рента, которая растет по нашей зависимости. Первое время показывали, как дёшево может быть. Потом будут показывать, как дорого может стать ровно с той скоростью, с какой человечество разучивается работать без ИИ.


Forward from: Вайб-кодинг
Video is unavailable for watching
Show in Telegram
Liquid AI выпустила лёгкую и быструю зрительно-языковую модель LFM2.5-VL-3B.

Зрительная модель всего на 3 млрд параметров, которая обгоняет модели более чем вдвое крупнее и при этом работает прямо на Galaxy S26 Ultra со скоростью около 20 токенов в секунду.

LFM2.5-VL-3B умеет работать с мобильными, веб- и настольными интерфейсами, читать экраны, документы и изображения из реального мира, а также точно привязывать объекты к координатам.

На ScreenSpot-v2 модель набирает 80,7 против 51,2 у Gemma-4-E4B.

При этом она превосходит заметно более крупные модели в задачах по интерфейсам, привязке объектов и распознаванию текста.

На M5 Max скорость достигает 228 токенов в секунду, а для работы требуется всего около 3 ГБ памяти.

Модель уже доступна на Hugging Face:

https://huggingface.co/LiquidAI/LFM2.5-VL-3B


Forward from: Alex Parker Returns
Кровь не водица. Отсюда и.


Заменил модель.
Правильно мне сказали:
- Qwen2.5? Удали его нахуй!

Поставил qwen3.6:27b
По сравнению с 2.5 - просто летает.
И контекст 120к+ против 32к у старой версии.

Код от 2.5 приходилось перепроверять у облачных моделей. С небольшими задачами он справлялся, но взять и перенести 500 строчный html в другой стек - он не мог.

А 3.6 смог. Но код всё равно перепроверю.


Video is unavailable for watching
Show in Telegram


Video is unavailable for watching
Show in Telegram


Получилось. Он парсит авито.


Video is unavailable for watching
Show in Telegram


Снёс WSL2 😒

Поставил чистую Ubuntu 🤟

Накатил Gemma 4:12b abliterated
+ Qwen3.5:35b

Всё с huggingface брал разумеется

Результатом пока доволен.

Гему выпустил в интернет, он сходил на сайт ЦБ РФ, взял курсы валют и вернул точные данные. Указав источники.

В настройках Open-webui (это такой чатик с локальными моделями) можно установить количество источников к которым обращаться.

На самом деле очень много тонких настроек предусмотрено и это конечно же кайф.

"А когда ты зарабатывать с этим начнёшь? " - спросите вы. А вот хуй его знает. Может даже сегодня.

🦧


Теперь у меня своя AI группировка. Теперь совсем другая карта пойдёт. 🤣

Уже развернул 5 штук и научил одну видеть.

Пока на Ubuntu в WSL2

Кто хочет свою такую станцию - пишите, дам способ как получить деньги от государства и как купить себе AI-станцию.


Forward from: Двач
❗️Xiaomi выпустила убийцу Claude Code

Это MiMo Code, который превосходит тулзу от Anthropic сразу в трёх тестах:
🟠В основе работает модель уровня Claude Sonnet 4.6 с безлимитным контекстом, благодаря чему нейросеть может обрабатывать крупные проекты на миллионы строк кода;
🟠Всё работает без потери данных;
🟠Нейронка способна дообучаться прямо во время работы с проектом;
🟠MiMo Code имеет полностью открытый исходный код – он совместим с моделями от Anthropic, OpenAI, DeepSeek и других разработчиков;
🟠И всё это полностью бесплатно.

Протестировать можно тут:

mimo.xiaomi.com/coder


Forward from: Alex Parker Returns
Слабого добей. MAX перестал работать через браузеры. У домена отозвали SSL-сертификат, поэтому браузеры реагируют на сайт враждебно. Кстати, уважаемые партнеры по духу Анкориджа поступили очень коварно и не стали сразу же удалять запрещенный мессенджер. Они выждали пока на его продвижение потратят огромные бюджеты, а затем уже нанесли свой подлый удар, чтобы нанести максимальный ущерб тем, кто его внедрял. И ведь и подумать никто не мог. Пыпа, итоги.


Хорошо пишет, с юмором











20 last posts shown.