Postlar filtri


Метаверсище и ИИще dan repost
Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
LTX бахнули отдельную IC-LoRA Layout to Render для LTX-2.5 22B.

Она весит около 1.31 GB,rank 128 и обучена специально воспринимать 3D viewport/playblast как control signal.

Нейрорендер в действии и опенсорсе.

Заодно лежит готовый двухпроходный ComfyUI workflow:

LTX-2.5_ICLoRA_Layout_To_Render_Two_Stage_Distilled.json

Первый проход - 960x544, 8 steps.
Второй - 1920x1088, ещё 3 steps после x2 latent upscale.

Для запуска нужны базовые distilled-веса LTX-2.5, Gemma 4 12B encoder, video/audio VAE и spatial upscaler. Официальные ComfyUI-ноды и workflows тоже есть.

Что на входе? Плейбласт из Blender, и первый кадр в нужном стиле. Лучше всего брать первый кадр плейбласта и прогонять его через какой-нибудь image-to-image.

У них также есть Alpha Gen, SDR->HDR, Native Resolution, Refine/Restore и Layout to Render, то есть Lightricks явно пытаются застолбить опенсорсную поляну как post-production/VFX toolkit.

Ссылки:

LoRA:
https://huggingface.co/Lightricks/LTX-2.5-22b-IC-LoRA-Layout-To-Render

Файлы LoRA + готовый JSON workflow:
https://huggingface.co/Lightricks/LTX-2.5-22b-IC-LoRA-Layout-To-Render/tree/main

Сам workflow:
https://huggingface.co/Lightricks/LTX-2.5-22b-IC-LoRA-Layout-To-Render/blob/main/LTX-2.5_ICLoRA_Layout_To_Render_Two_Stage_Distilled.json

@cgevent


Русский ИТ бизнес dan repost
Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Помните первые видео, где неуклюжий гуманоид обрабатывал посылки, переворачивая их этикетами в нужную сторону?

Вот его более продвинутый собрат: вместо неудобного антропоморфного форм-фактора - две клешни, вместо неуверенных движений - эффективная выверенная механика действий...

В общем, путь в сортировку кожанным (нам) тоже закрыт.

tg / max


Пет-проект dan repost
Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Google переселяет ИИ в космос — сегодня компания выпустила на орбиту прототип спутника Project Suncatcher, чтобы начать обучение нейросетей в космосе.

Отправлять ИИ в космос грозился ещё Илон Маск, но Google оказалась первее. Дата-центры начнут питаться от Солнца — это в 8 раз энергоэффективнее и дешевле, чем построить и запитать огромный дата-центр на Земле.

В скором времени над нашими головами будут летать целые ИИ-созвездия.

В удивительное время живём 😶

Пет-проект


Метаверсище и ИИще dan repost
Объяснятор по Госту

После написания предыдущего поста мне, конечно, стало интересно, как это всё адаптировать под наши нужды, под русский язык. И да, действительно, нашлась замена для английского стандарт.

Самый близкий прямой аналог для русского языка существует и называется УТР - упрощенный технический русский язык.

Он закреплен в ГОСТ Р 58049-2017 “Перевод эксплуатационной документации на изделия авиационной техники с/на иностранные языки”. Более того, сам ГОСТ прямо ссылается на Simplified Technical English и формулирует УТР как контролируемый технический язык с той же основной задачей - сделать текст однозначным, простым для восприятия и удобным для перевода.

Среди правил УТР:

- простой и однозначный текст;
- прямой порядок слов;
- преимущественно действительный залог;
- для инструкций - повелительное наклонение: “Установите крышку”, а не “Крышка должна быть установлена”;
- один термин для одного понятия - не прыгать между синонимами;
- запрет метафор, жаргона и образных сравнений;
- предпочтение коротких и простых терминов;
- не рекомендуется ставить подряд три и более существительных;
- сложные перечисления лучше оформлять вертикальными списками. Tdocs

Поэтому для ИИ можно бахнуть такой промпт:

Объясни это на русском языке по принципам УТР
(упрощенного технического русского языка, ГОСТ Р 58049-2017).
Используй прямой порядок слов, короткие предложения,
действительный залог и единообразную терминологию.
Одна мысль - одно предложение.
Не используй канцеляризмы, метафоры и лишние синонимы.
Не упрощай технический смысл.


Или, по аналогии с Карпатым, покороче:

Напиши примерно на 80% в стиле УТР по ГОСТ Р 58049-2017:
ясно, коротко и однозначно, но без чрезмерно формального языка.


@cgevent


Метаверсище и ИИще dan repost
Офигенный новый пост от Андрея Карпатого. Грех его не разобрать.

Потому что, наверное, многих из вас немножко приподдостала многословность, по крайней мере SOL 5.6, и необходимость просить его сокращать и вообще выдавать ему разные инструкции.

А тут сразу о том, как сразу получать хорошо и не только текстом, а "мультимедийно".

Пойду ваять системный промпт.

Дисклаймер: это не для написания литературных текстов и креативов. Это для объясняторов и помогаторов.

Смысл поста не в ASD-STE100 (см ниже). Он предлагает гораздо более интересную идею: перестать воспринимать текст как основной формат ответа LLM.

Его иерархия:

текст -> схема -> интерактивная HTML-страница -> персональное объясняющее видео.

И чем сильнее становятся модели, тем чаще кожаный будет не сам “делать работу”, а проверять, понимать и направлять результат. Поэтому формат, в котором модель объясняет свою работу человеку, становится почти так же важен, как качество самой работы.

Что такое ASD-STE100

Андрюша пишет, что просто попросите: “Explain this in ASD-STE100”

ASD-STE100 Simplified Technical English - реальный стандарт контролируемого английского языка. Его начали разрабатывать для авиационной технической документации, чтобы инструкции одинаково хорошо понимали специалисты с разным уровнем английского.

Там довольно жесткие механические правила:

- словарь примерно из 900(шта?) разрешенных общеупотребительных слов плюс специализированная техническая терминология;
- по возможности один термин -> одно значение;
- вместо цепочки синонимов выбирается одно слово, например start, а не begin / commence / initiate;
- максимум 20 слов в процедурном предложении и 25 в описательном;
- максимум 3 слова в noun cluster;
- в процедурных инструкциях используется active voice;
- ограничен набор допустимых форм глагола;
- один шаг или инструкция должны быть сформулированы максимально однозначно.

Можно смягчать, чтобы не разговаривать с робатом:

“80% of the way to ASD-STE100”

Идем дальше. Мультимедия: diagrams -> HTML -> video

Здесь Андрюша фактически описывает переход от LLM как генератора текста к LLM как генератору интерфейса объяснятора.

Например, вместо ответа на 3000 слов модель может сама решить, что конкретную тему лучше показать через:

* интерактивный(!) график
+ slider
+ несколько переключателей
+ анимацию
+ короткие пояснения

И сгенерировать для этого одноразовую HTML-страницу.

Раньше писать специальное приложение, чтобы объяснить кожаным один вопрос, было абсурдно дорого. Теперь его можно дажененавайбкодить, а просто попросить за минуту и выбросить после одного использования.

Это он называет “large, custom, discardable software artifacts”.

Мне кажется, это центральная мысль поста.

Короче:

> “Объясни мне трансформеры”

> Апажалуйста! На тебе одноразовый интерактивный учебник именно для тебя, после прочтения можешь выбросить. Следующий будет новее и лучше.

На итоге: Сам ответ может быть не текстом, как мы привыкли, а приложением, симуляцией, схемой или видео.

Остается одна проблема. Кожаный должен во все это вникнуть и понять. А кожаный ленив и туп. Никакой разжеватор не поможет. Поэтому остается вопрос: а может вы за меня и понимать будете?

ПС. Русский вариант в след посте.

@cgevent


Книжный куб dan repost
ingress-nginx: как маленький API оброс собственным языком (Рубрика #PlatformEngineering)

Разбирался с закрытием ingress-nginx. Эту историю можно пересказать как драму open source: компонент примерно для половины cloud-native окружений, по внутренним данным Datadog, годами поддерживали один-два человека в свободное время. Но мне интереснее механизм, сделавший его несопровождаемым.

Ingress API намеренно оставили маленьким: host, path, backend, TLS. В production быстро понадобились таймауты, повторные попытки, canary, внешняя авторизация, заголовки и WAF. ingress-nginx добавлял всё это аннотациями - к июлю 2026 года документация насчитывала около 130 уникальных ключей. Snippet-аннотации позволяли вставлять произвольные фрагменты NGINX-конфига.

Так обходной путь превратился в неформальный DSL. API выглядел простым, но реальный контракт жил в строках metadata, зависел от контроллера, плохо валидировался и расширял поверхность атаки. В 2025 году Wiz раскрыл IngressNightmare - цепочку уязвимостей с неаутентифицированным RCE.

В марте 2026 года поддержка ingress-nginx закончилась: больше нет релизов, исправлений ошибок и security-патчей. Существующие установки продолжают работать - просто без будущих исправлений. Сам Ingress API не закрыт и не deprecated: он заморожен, а развитие ушло в Gateway API.

Gateway API не обязательно меньше или проще. В нём больше явных ресурсов, ролей, связей и политик. Но в этом и смысл: сложность получила типы, владельцев и проверяемые границы вместо сотни строковых исключений.

Если смотреть на эту историю с точки зрения проектирования API, то видно, что важно не просто сделать его минимальным, но и оставить заделы на контролируемое расширение и понятные пути миграций. Если же этого не сделать, то люди начнут строить вокруг второй, скрытый язык вокруг минимального API и наращивать сложность. А закончится все тем, что первую версию придется похоронить под тяжестью сложности и невозможности расширения и поддержки.

#PlatformEngineering #Kubernetes #Architecture #DevOps #Security


Типичный программист dan repost
Разработчик превратил JPEG в одностороннюю гифку

Помните, как на медленном интернете картинка сначала грузилась мыльной и постепенно проявлялась? Это фича JPEG: формат отдаёт сначала грубую версию, а детали догружает потом.

Разработчик maurycyz решил: раз картинка грузится слоями, по этим слоям можно разложить разные изображения. В низкоразрешённый слой ушла одна картинка, а когда приходят данные высокого разрешения, поверх проявляется вторая, никак с первой не связанная. GIF, который крутится только в одну сторону.

Ложка ограничений: влезает примерно девять кадров, а тайминг не закодировать, так что на быстром соединении «мультик» пролетит быстрее, чем вы его разглядите.

И всё же трюк прекрасен. Как это устроено — в разборе на Hackaday: повод посмотреть на необжитые уголки формата, который до сих пор крепко держит картинки всего интернета.


PRO РОБОТОВ КАНАЛ dan repost
Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Hasta la vista, F.02! В Figure увольняют красиво. Очень красиво.


Метаверсище и ИИще dan repost
Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Инфлюенсеры, маркетинг и робаты.

Помните знаменитое «А кушать вы тоже за меня будете?»

Вот с цифровыми инфлюенсерами мы вроде разобрались. В принципе есть уже много разных однокнопочных решений вплоть до "создать цифровую тварь по брифу, открыть ей тикток\инсту, и наливать туда контент".

Сейчас уже более половины трафика в интернетике генерится ИИ. Будет больше. Я не знаю долю цифровых тварей с соцсетях по сравнению с кожаными, но она явно будет расти.

Пока мы влажно следуем парадигме content(трафик) is the king, ИИ будет наливать нам этого контента сколько захотим.

Возникает вопрос, а кто это все будет потреблять? Подразумевается, что кожаные.

А вот и нет! Робаты!

Робаты будут кушать за вас контент. Ибо кожаные ужасно смешные: сами придумали метрики (просмотры, досмотры, свайпы, енгейджмент). И сами же - а ну накручивать!

А чтобы тик-ток и инста не отслеживали виртуальные клики (на компе это просто, на телефоне сложнее, но у эппле есть слой для этого) кожаные зовут робатов (на видео).

Ну и получается, одни кожаные заливают контент с помощью ИИ, а вторые(поумнее) заставляют робатов его типа "потреблять". Первые такие: вау, у нас метрики-шметрики растут, вторые - ставим вторую ферму.

Третьи, самые умные, делают и то, и другое. Залили, накрутили, и..

Пошли к рекламодателям (ибо плата за просмотры будет стремиться к нулю).

Рекламодатели: а кто ваша аудитория?

Кожаные: ну, ээ, кхгм, робаты (только мы вам о них не расскажем)

Вот такой инфлюенс маркетинг.

Интересно, когда рекламодатели прозреют?

И первые, и вторые, и третьи жгут электичество как не в себя. Не производя ничего. Раньше считалось, что они производят, на минуточку "экономику внимания".

А теперь?

Пойду у Димы спрошу, как устроен щас людской инфлюенс маркетинг.

@cgevent


PRO РОБОТОВ КАНАЛ dan repost
Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
🟢Южнокорейский стартап Diden Robotics разрушил стереотип о том, что автоматизация угрожает только офисным профессиям. Компания представила четвероногого робота-сварщика Diden Spider, который уже трудоустроен на судостроительных верфях.

🟢Устройство весом 45 кг способно нести полезную нагрузку до 30 кг и передвигаться по вертикальным стальным поверхностям и потолкам благодаря магнитным лапам. Робот легко преодолевает балки и проникает в узкие отверстия. Робот уже умеет контролировать качество швов, а в планах - обучение его покраске корпусов судов.

Прощаемся со сварщиками или пока рано?
—————————
✔️Подписывайтесь на лучший  канал PRO Роботов

🥲Мы в Max


Русский ИТ бизнес dan repost
GPT-6.1 Sol вышла — Альтман дропнул мощнейшую модель для кодинга и профессиональных задач.

По производительности она совпадает с Astra, но стоит значительно дешевле.


Русский ИТ бизнес dan repost
Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Роботы всё больше проникают в нашу реальность — в Калифорнии уже какое-то время работает сервис Tau Robotics, который привозит гуманоидных роботов для уборки дома. Один обходится в $30 за час — обычно берут двух за $60. Они могут протирать поверхности, пылесосить и выносить мусор. Правда, прямо сейчас ими дистанционно управляют люди...

tg / max


MrGips • Про LLM dan repost
Strata добавила полноценный multi-GPU режим

Главная идея - не tensor parallelism, а разделение модели по слоям. Один GPU считает первые слои, второй - следующие, третий при необходимости - оставшиеся. При этом каждая карта держит expert cache только для своих слоёв, поэтому суммарно в VRAM помещается намного больше экспертов и модель реже обращается к CPU/RAM.

Что важно:
• NVLink не нужен;
• PCIe x4/x1 тоже допустим;
• поддерживаются RTX 30/40/50;
• каждая карта должна иметь минимум 8 ГБ VRAM;
• первая карта в списке считается основной;
• лучший режим — --layer-split auto, Strata сама подбирает оптимальное распределение слоёв;
• vision, KV streaming, checkpoints и control vectors работают и в multi-GPU.

Запуск простой:
START-HERE.bat --gpus 0,1 --layer-split auto
или вообще без параметров - установщик сам покажет подходящие GPU и предложит объединить их.

По тестам авторов на RTX 5080 + RTX 3090:
• обработка prompt ускорилась примерно на 18–20%;
• decode остался примерно на уровне более быстрой карты;
• генерация кода стала быстрее, потому что почти все нужные routed experts помещались в GPU-кэш.

То есть multi-GPU здесь - это не «в 2 раза быстрее». Основной выигрыш в том, что больше expert weights остаётся в VRAM, меньше данных приходится брать из CPU pool, а длинные prompt’ы обрабатываются быстрее.

Ещё важный момент: добавлять много слабых карт не всегда полезно. В тестах дополнительная медленная GPU, наоборот, ухудшила decode - каждый новый pipeline stage добавляет свои накладные расходы.

Итог: multi-GPU в Strata имеет смысл прежде всего тогда, когда routed experts одной большой MoE-модели не помещаются в VRAM одной карты. Тогда вторая карта может заметно снизить зависимость от RAM/CPU и ускорить работу без необходимости иметь одинаковые GPU.

Линк: https://github.com/Niko1221/Strata/blob/main/docs/MULTI_GPU.md

MrGips • Про LLM / НАШ ЧАТ


MrGips • Про LLM dan repost
Велосипед в Blender на Strata и Qwen 3.8 Flash Next IQ3_S

Он немного корявый, потому что при генерации вылезла какая-то ошибка и генерация оборвалась.

Я делал через DeepSeek Harness, не особо его настраивал, видимо в контекст уперся раньше времени и не смог его сжать.

Но результат мне нравится. Очень много мелких деталей, которые Qwen 3.8 27B пропускал.

Держу в курсе!

MrGips • Про LLM / НАШ ЧАТ




MrGips • Про LLM dan repost
🚀 Появился новый движок Strata, который запускает огромную Qwen3.8 Flash Next даже на видеокартах с 12 GB VRAM

Думаю вы уже знаете что Qwen3.8 Flash Next большая MoE-модель, которая требует очень много памяти. Но разработчик нового inference-движка Strata смог распределить её между GPU, оперативной памятью и SSD.

В результате модель уже запускают даже на обычных игровых видеокартах.

На RTX 5070 12 GB при контексте 128K разработчик получил:

• Q2_0 - около 65 tok/s
• IQ2_XS - около 52 tok/s
• IQ3_XXS - около 45 tok/s
• IQ3_S - около 42 tok/s

На коротком контексте скорость ещё выше.

Появились и тесты от других пользователей:

• RTX 5070 Ti - около 86 tok/s на IQ3_XXS при 64K
• RTX 4090 - примерно 58–70 tok/s на IQ3_S при 262K
• даже RTX 2070 8 GB удалось запустить примерно на 20 tok/s

Как это работает?

Strata не пытается полностью загрузить огромную модель в видеопамять.

Самые востребованные части модели находятся на GPU, остальные MoE-эксперты - в RAM, а большая PLE/n-gram память может храниться на SSD.

Таким образом, Flash Next можно запускать даже при относительно небольшом объёме VRAM.

Ещё одна важная функция — кеширование диалога. После первого запроса Strata сохраняет состояние и при следующих обращениях обрабатывает только новый контекст, что особенно важно для AI-агентов и программирования.

Пока у проекта есть ограничения: нет полноценного multi-GPU.

Но сам факт уже интересный: Qwen3.8 Flash Next постепенно превращается из огромной модели для дорогих серверов в LLM, которую можно запускать на обычном домашнем ПК.

Я сам еще не пробовал, но в НАШЕМ ЧАТЕ люди потихоньку запускают, скорость реально повыше.

Линк на движок: https://github.com/Niko1221/Strata

Модели, которые нужны Страте: https://huggingface.co/ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-GGUF

Пробовали уже?

MrGips • Про LLM / НАШ ЧАТ


Метаверсище и ИИще dan repost
Локальный Виспер без питонга.

Продолжение нашего вчерашнего разговора про транскрибацию с помощью ChatGPT.

У кого нет ChatGPT или у кого аллергия на ChatGPT, можно пользоваться вот такой вот штукой.

Это полностью локальная транскрибация звука на вашем компе.

Есть клиент для Винды, для Мака и для Линукса. И всё это скачивается вот по этой ссылке.
https://sourceforge.net/projects/buzz-captions/files/
Для Винды не подписано, Винда будет бессильно ругацца.

Для тех, кто хочет в код, есть ссылка и на код.
https://github.com/chidiwilliams/buzz

Для меня тут основная новая фишка - это то, что он умеет выводить субтитры и различать говорящих, а также принимать на вход видеофайлы.

И да, там есть CUDA и MLX ускорение.

Полный список фич:

- Транскрибация аудио- и видеофайлов, а также видео по ссылкам YouTube
- Транскрибация аудио в реальном времени с микрофона
- Отдельное окно для отображения текста во время мероприятий и презентаций
- Разделение речи перед транскрибацией для повышения точности на записях с шумом
- Определение говорящих в транскрибированных аудио и видео
- Поддержка нескольких бэкендов Whisper
- CUDA-ускорение на видеокартах NVIDIA
- Поддержка Apple Silicon на Mac
- Vulkan-ускорение Whisper.cpp на большинстве GPU, включая встроенную графику
- Поддержка нескольких семейств моделей Transformer через Hugging Face в режиме Whisper
- Экспорт транскрипций в TXT, SRT и VTT
- Расширенный просмотрщик транскрипций с поиском, управлением воспроизведением и регулировкой скорости
- Горячие клавиши для быстрой навигации
- Отслеживаемая папка (Watch Folder) для автоматической транскрибации новых файлов
- Интерфейс командной строки (CLI) для скриптов и автоматизации
- Система плагинов, включая AI-суммаризацию и автоматическое изменение размера/форматирования транскриптов

@cgevent


MrGips • Про LLM dan repost
7 сентября - День который я буду отмечать ежегодно.

Это можно сказать День монетизации. Потому что у меня заказали рекламу. Да не просто рекламу, а рекламу по теме. Спасибо что не казик.

Никогда бы не подумал что мои монотонные разговоры в микрофон про каких-то хомяков и аквариумы принесет не только счета за электроэнергию, а еще и деньгу.

Наконец-то я трачу драгоценные киловатты на свое хобби с пользой.

Кстати, загляните в тг-канал СLODEX и в Чат ВАЙБКОДЕРОВ.

А так же, подписывайтесь на НАШ LLMповый ЧАТ

А я, пойду закину деньгу за коммуналку, ведь 5090 сама себя не оплатит. Выключаю!


MrGips • Про LLM dan repost
💳Как платить за Spotify, Cursor, ChatGPT и другие любимые подписки?…

Если ты читаешь это, скорее всего, у тебя уже была проблема: надо оплатить подписку или купить иностранный софт, а российскую карту не принимают.

Mirocard решает это за пару минут:

Это сервис, где можно выпустить виртуальную карту, пополнить рублями через СБП и платить за:

- Midjourney
- ChatGPT
- Figma
- ElevenLabs
- Claude
- Netflix
- Spotify и еще сотни подписок...

По промокоду “PROCOMFY” выпуск карты со скидкой 50%

Оформление из любой точки мира за пару кликов!⚡️

ОТКРЫТЬ КАРТУ


MrGips • Про LLM dan repost
Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Безумная сборка для 5090 - скорость доходила до 175 т/с

Наконец-то я чуть пощупал вот это чудо:
https://huggingface.co/neroued/Qwen3.8-27B-nvfp4-NInfer

А все началось с этого поста на Reddit, после которого я загорелся проверить действительно ли такие цифры можно выдавить или снова кликбэйт.

И каково мое было удивление, мало того что скорость генерации отправляет в космос, так еще и префилл достигает безумных 7 660 ток/с

Но я слишком мало потестил, буквально на пару промтах, в прикрепленном видео 'https://t.me/LLM4at/26551/45171' rel='nofollow'>это один из них.

Остальные тесты в НАШЕМ ЧАТЕ

Держу в курсе и продолжаю наблюдение. Всем быстрых токенов!

20 ta oxirgi post ko‘rsatilgan.