LITVINOV


Channel's geo and language: Russia, Russian
Category: Technologies



Channel's geo and language
Russia, Russian
Statistics
Posts filter


Forward from: Метаверсище и ИИще
Video is unavailable for watching
Show in Telegram
LTX бахнули отдельную IC-LoRA Layout to Render для LTX-2.5 22B.

Она весит около 1.31 GB,rank 128 и обучена специально воспринимать 3D viewport/playblast как control signal.

Нейрорендер в действии и опенсорсе.

Заодно лежит готовый двухпроходный ComfyUI workflow:

LTX-2.5_ICLoRA_Layout_To_Render_Two_Stage_Distilled.json

Первый проход - 960x544, 8 steps.
Второй - 1920x1088, ещё 3 steps после x2 latent upscale.

Для запуска нужны базовые distilled-веса LTX-2.5, Gemma 4 12B encoder, video/audio VAE и spatial upscaler. Официальные ComfyUI-ноды и workflows тоже есть.

Что на входе? Плейбласт из Blender, и первый кадр в нужном стиле. Лучше всего брать первый кадр плейбласта и прогонять его через какой-нибудь image-to-image.

У них также есть Alpha Gen, SDR->HDR, Native Resolution, Refine/Restore и Layout to Render, то есть Lightricks явно пытаются застолбить опенсорсную поляну как post-production/VFX toolkit.

Ссылки:

LoRA:
https://huggingface.co/Lightricks/LTX-2.5-22b-IC-LoRA-Layout-To-Render

Файлы LoRA + готовый JSON workflow:
https://huggingface.co/Lightricks/LTX-2.5-22b-IC-LoRA-Layout-To-Render/tree/main

Сам workflow:
https://huggingface.co/Lightricks/LTX-2.5-22b-IC-LoRA-Layout-To-Render/blob/main/LTX-2.5_ICLoRA_Layout_To_Render_Two_Stage_Distilled.json

@cgevent


Forward from: Русский ИТ бизнес
Video is unavailable for watching
Show in Telegram
Помните первые видео, где неуклюжий гуманоид обрабатывал посылки, переворачивая их этикетами в нужную сторону?

Вот его более продвинутый собрат: вместо неудобного антропоморфного форм-фактора - две клешни, вместо неуверенных движений - эффективная выверенная механика действий...

В общем, путь в сортировку кожанным (нам) тоже закрыт.

tg / max


Forward from: Пет-проект
Video is unavailable for watching
Show in Telegram
Google переселяет ИИ в космос — сегодня компания выпустила на орбиту прототип спутника Project Suncatcher, чтобы начать обучение нейросетей в космосе.

Отправлять ИИ в космос грозился ещё Илон Маск, но Google оказалась первее. Дата-центры начнут питаться от Солнца — это в 8 раз энергоэффективнее и дешевле, чем построить и запитать огромный дата-центр на Земле.

В скором времени над нашими головами будут летать целые ИИ-созвездия.

В удивительное время живём 😶

Пет-проект


Forward from: Метаверсище и ИИще
Объяснятор по Госту

После написания предыдущего поста мне, конечно, стало интересно, как это всё адаптировать под наши нужды, под русский язык. И да, действительно, нашлась замена для английского стандарт.

Самый близкий прямой аналог для русского языка существует и называется УТР - упрощенный технический русский язык.

Он закреплен в ГОСТ Р 58049-2017 “Перевод эксплуатационной документации на изделия авиационной техники с/на иностранные языки”. Более того, сам ГОСТ прямо ссылается на Simplified Technical English и формулирует УТР как контролируемый технический язык с той же основной задачей - сделать текст однозначным, простым для восприятия и удобным для перевода.

Среди правил УТР:

- простой и однозначный текст;
- прямой порядок слов;
- преимущественно действительный залог;
- для инструкций - повелительное наклонение: “Установите крышку”, а не “Крышка должна быть установлена”;
- один термин для одного понятия - не прыгать между синонимами;
- запрет метафор, жаргона и образных сравнений;
- предпочтение коротких и простых терминов;
- не рекомендуется ставить подряд три и более существительных;
- сложные перечисления лучше оформлять вертикальными списками. Tdocs

Поэтому для ИИ можно бахнуть такой промпт:

Объясни это на русском языке по принципам УТР
(упрощенного технического русского языка, ГОСТ Р 58049-2017).
Используй прямой порядок слов, короткие предложения,
действительный залог и единообразную терминологию.
Одна мысль - одно предложение.
Не используй канцеляризмы, метафоры и лишние синонимы.
Не упрощай технический смысл.


Или, по аналогии с Карпатым, покороче:

Напиши примерно на 80% в стиле УТР по ГОСТ Р 58049-2017:
ясно, коротко и однозначно, но без чрезмерно формального языка.


@cgevent


Forward from: Метаверсище и ИИще
Офигенный новый пост от Андрея Карпатого. Грех его не разобрать.

Потому что, наверное, многих из вас немножко приподдостала многословность, по крайней мере SOL 5.6, и необходимость просить его сокращать и вообще выдавать ему разные инструкции.

А тут сразу о том, как сразу получать хорошо и не только текстом, а "мультимедийно".

Пойду ваять системный промпт.

Дисклаймер: это не для написания литературных текстов и креативов. Это для объясняторов и помогаторов.

Смысл поста не в ASD-STE100 (см ниже). Он предлагает гораздо более интересную идею: перестать воспринимать текст как основной формат ответа LLM.

Его иерархия:

текст -> схема -> интерактивная HTML-страница -> персональное объясняющее видео.

И чем сильнее становятся модели, тем чаще кожаный будет не сам “делать работу”, а проверять, понимать и направлять результат. Поэтому формат, в котором модель объясняет свою работу человеку, становится почти так же важен, как качество самой работы.

Что такое ASD-STE100

Андрюша пишет, что просто попросите: “Explain this in ASD-STE100”

ASD-STE100 Simplified Technical English - реальный стандарт контролируемого английского языка. Его начали разрабатывать для авиационной технической документации, чтобы инструкции одинаково хорошо понимали специалисты с разным уровнем английского.

Там довольно жесткие механические правила:

- словарь примерно из 900(шта?) разрешенных общеупотребительных слов плюс специализированная техническая терминология;
- по возможности один термин -> одно значение;
- вместо цепочки синонимов выбирается одно слово, например start, а не begin / commence / initiate;
- максимум 20 слов в процедурном предложении и 25 в описательном;
- максимум 3 слова в noun cluster;
- в процедурных инструкциях используется active voice;
- ограничен набор допустимых форм глагола;
- один шаг или инструкция должны быть сформулированы максимально однозначно.

Можно смягчать, чтобы не разговаривать с робатом:

“80% of the way to ASD-STE100”

Идем дальше. Мультимедия: diagrams -> HTML -> video

Здесь Андрюша фактически описывает переход от LLM как генератора текста к LLM как генератору интерфейса объяснятора.

Например, вместо ответа на 3000 слов модель может сама решить, что конкретную тему лучше показать через:

* интерактивный(!) график
+ slider
+ несколько переключателей
+ анимацию
+ короткие пояснения

И сгенерировать для этого одноразовую HTML-страницу.

Раньше писать специальное приложение, чтобы объяснить кожаным один вопрос, было абсурдно дорого. Теперь его можно дажененавайбкодить, а просто попросить за минуту и выбросить после одного использования.

Это он называет “large, custom, discardable software artifacts”.

Мне кажется, это центральная мысль поста.

Короче:

> “Объясни мне трансформеры”

> Апажалуйста! На тебе одноразовый интерактивный учебник именно для тебя, после прочтения можешь выбросить. Следующий будет новее и лучше.

На итоге: Сам ответ может быть не текстом, как мы привыкли, а приложением, симуляцией, схемой или видео.

Остается одна проблема. Кожаный должен во все это вникнуть и понять. А кожаный ленив и туп. Никакой разжеватор не поможет. Поэтому остается вопрос: а может вы за меня и понимать будете?

ПС. Русский вариант в след посте.

@cgevent


Forward from: Книжный куб
ingress-nginx: как маленький API оброс собственным языком (Рубрика #PlatformEngineering)

Разбирался с закрытием ingress-nginx. Эту историю можно пересказать как драму open source: компонент примерно для половины cloud-native окружений, по внутренним данным Datadog, годами поддерживали один-два человека в свободное время. Но мне интереснее механизм, сделавший его несопровождаемым.

Ingress API намеренно оставили маленьким: host, path, backend, TLS. В production быстро понадобились таймауты, повторные попытки, canary, внешняя авторизация, заголовки и WAF. ingress-nginx добавлял всё это аннотациями - к июлю 2026 года документация насчитывала около 130 уникальных ключей. Snippet-аннотации позволяли вставлять произвольные фрагменты NGINX-конфига.

Так обходной путь превратился в неформальный DSL. API выглядел простым, но реальный контракт жил в строках metadata, зависел от контроллера, плохо валидировался и расширял поверхность атаки. В 2025 году Wiz раскрыл IngressNightmare - цепочку уязвимостей с неаутентифицированным RCE.

В марте 2026 года поддержка ingress-nginx закончилась: больше нет релизов, исправлений ошибок и security-патчей. Существующие установки продолжают работать - просто без будущих исправлений. Сам Ingress API не закрыт и не deprecated: он заморожен, а развитие ушло в Gateway API.

Gateway API не обязательно меньше или проще. В нём больше явных ресурсов, ролей, связей и политик. Но в этом и смысл: сложность получила типы, владельцев и проверяемые границы вместо сотни строковых исключений.

Если смотреть на эту историю с точки зрения проектирования API, то видно, что важно не просто сделать его минимальным, но и оставить заделы на контролируемое расширение и понятные пути миграций. Если же этого не сделать, то люди начнут строить вокруг второй, скрытый язык вокруг минимального API и наращивать сложность. А закончится все тем, что первую версию придется похоронить под тяжестью сложности и невозможности расширения и поддержки.

#PlatformEngineering #Kubernetes #Architecture #DevOps #Security


Forward from: Типичный программист
Разработчик превратил JPEG в одностороннюю гифку

Помните, как на медленном интернете картинка сначала грузилась мыльной и постепенно проявлялась? Это фича JPEG: формат отдаёт сначала грубую версию, а детали догружает потом.

Разработчик maurycyz решил: раз картинка грузится слоями, по этим слоям можно разложить разные изображения. В низкоразрешённый слой ушла одна картинка, а когда приходят данные высокого разрешения, поверх проявляется вторая, никак с первой не связанная. GIF, который крутится только в одну сторону.

Ложка ограничений: влезает примерно девять кадров, а тайминг не закодировать, так что на быстром соединении «мультик» пролетит быстрее, чем вы его разглядите.

И всё же трюк прекрасен. Как это устроено — в разборе на Hackaday: повод посмотреть на необжитые уголки формата, который до сих пор крепко держит картинки всего интернета.


Forward from: PRO РОБОТОВ КАНАЛ
Video is unavailable for watching
Show in Telegram
Hasta la vista, F.02! В Figure увольняют красиво. Очень красиво.


Forward from: Метаверсище и ИИще
Video is unavailable for watching
Show in Telegram
Инфлюенсеры, маркетинг и робаты.

Помните знаменитое «А кушать вы тоже за меня будете?»

Вот с цифровыми инфлюенсерами мы вроде разобрались. В принципе есть уже много разных однокнопочных решений вплоть до "создать цифровую тварь по брифу, открыть ей тикток\инсту, и наливать туда контент".

Сейчас уже более половины трафика в интернетике генерится ИИ. Будет больше. Я не знаю долю цифровых тварей с соцсетях по сравнению с кожаными, но она явно будет расти.

Пока мы влажно следуем парадигме content(трафик) is the king, ИИ будет наливать нам этого контента сколько захотим.

Возникает вопрос, а кто это все будет потреблять? Подразумевается, что кожаные.

А вот и нет! Робаты!

Робаты будут кушать за вас контент. Ибо кожаные ужасно смешные: сами придумали метрики (просмотры, досмотры, свайпы, енгейджмент). И сами же - а ну накручивать!

А чтобы тик-ток и инста не отслеживали виртуальные клики (на компе это просто, на телефоне сложнее, но у эппле есть слой для этого) кожаные зовут робатов (на видео).

Ну и получается, одни кожаные заливают контент с помощью ИИ, а вторые(поумнее) заставляют робатов его типа "потреблять". Первые такие: вау, у нас метрики-шметрики растут, вторые - ставим вторую ферму.

Третьи, самые умные, делают и то, и другое. Залили, накрутили, и..

Пошли к рекламодателям (ибо плата за просмотры будет стремиться к нулю).

Рекламодатели: а кто ваша аудитория?

Кожаные: ну, ээ, кхгм, робаты (только мы вам о них не расскажем)

Вот такой инфлюенс маркетинг.

Интересно, когда рекламодатели прозреют?

И первые, и вторые, и третьи жгут электичество как не в себя. Не производя ничего. Раньше считалось, что они производят, на минуточку "экономику внимания".

А теперь?

Пойду у Димы спрошу, как устроен щас людской инфлюенс маркетинг.

@cgevent


Forward from: PRO РОБОТОВ КАНАЛ
Video is unavailable for watching
Show in Telegram
🟢Южнокорейский стартап Diden Robotics разрушил стереотип о том, что автоматизация угрожает только офисным профессиям. Компания представила четвероногого робота-сварщика Diden Spider, который уже трудоустроен на судостроительных верфях.

🟢Устройство весом 45 кг способно нести полезную нагрузку до 30 кг и передвигаться по вертикальным стальным поверхностям и потолкам благодаря магнитным лапам. Робот легко преодолевает балки и проникает в узкие отверстия. Робот уже умеет контролировать качество швов, а в планах - обучение его покраске корпусов судов.

Прощаемся со сварщиками или пока рано?
—————————
✔️Подписывайтесь на лучший  канал PRO Роботов

🥲Мы в Max


Forward from: Русский ИТ бизнес
GPT-6.1 Sol вышла — Альтман дропнул мощнейшую модель для кодинга и профессиональных задач.

По производительности она совпадает с Astra, но стоит значительно дешевле.


Forward from: Русский ИТ бизнес
Video is unavailable for watching
Show in Telegram
Роботы всё больше проникают в нашу реальность — в Калифорнии уже какое-то время работает сервис Tau Robotics, который привозит гуманоидных роботов для уборки дома. Один обходится в $30 за час — обычно берут двух за $60. Они могут протирать поверхности, пылесосить и выносить мусор. Правда, прямо сейчас ими дистанционно управляют люди...

tg / max


Forward from: MrGips • Про LLM
Strata добавила полноценный multi-GPU режим

Главная идея - не tensor parallelism, а разделение модели по слоям. Один GPU считает первые слои, второй - следующие, третий при необходимости - оставшиеся. При этом каждая карта держит expert cache только для своих слоёв, поэтому суммарно в VRAM помещается намного больше экспертов и модель реже обращается к CPU/RAM.

Что важно:
• NVLink не нужен;
• PCIe x4/x1 тоже допустим;
• поддерживаются RTX 30/40/50;
• каждая карта должна иметь минимум 8 ГБ VRAM;
• первая карта в списке считается основной;
• лучший режим — --layer-split auto, Strata сама подбирает оптимальное распределение слоёв;
• vision, KV streaming, checkpoints и control vectors работают и в multi-GPU.

Запуск простой:
START-HERE.bat --gpus 0,1 --layer-split auto
или вообще без параметров - установщик сам покажет подходящие GPU и предложит объединить их.

По тестам авторов на RTX 5080 + RTX 3090:
• обработка prompt ускорилась примерно на 18–20%;
• decode остался примерно на уровне более быстрой карты;
• генерация кода стала быстрее, потому что почти все нужные routed experts помещались в GPU-кэш.

То есть multi-GPU здесь - это не «в 2 раза быстрее». Основной выигрыш в том, что больше expert weights остаётся в VRAM, меньше данных приходится брать из CPU pool, а длинные prompt’ы обрабатываются быстрее.

Ещё важный момент: добавлять много слабых карт не всегда полезно. В тестах дополнительная медленная GPU, наоборот, ухудшила decode - каждый новый pipeline stage добавляет свои накладные расходы.

Итог: multi-GPU в Strata имеет смысл прежде всего тогда, когда routed experts одной большой MoE-модели не помещаются в VRAM одной карты. Тогда вторая карта может заметно снизить зависимость от RAM/CPU и ускорить работу без необходимости иметь одинаковые GPU.

Линк: https://github.com/Niko1221/Strata/blob/main/docs/MULTI_GPU.md

MrGips • Про LLM / НАШ ЧАТ


Forward from: MrGips • Про LLM
Велосипед в Blender на Strata и Qwen 3.8 Flash Next IQ3_S

Он немного корявый, потому что при генерации вылезла какая-то ошибка и генерация оборвалась.

Я делал через DeepSeek Harness, не особо его настраивал, видимо в контекст уперся раньше времени и не смог его сжать.

Но результат мне нравится. Очень много мелких деталей, которые Qwen 3.8 27B пропускал.

Держу в курсе!

MrGips • Про LLM / НАШ ЧАТ




Forward from: MrGips • Про LLM
🚀 Появился новый движок Strata, который запускает огромную Qwen3.8 Flash Next даже на видеокартах с 12 GB VRAM

Думаю вы уже знаете что Qwen3.8 Flash Next большая MoE-модель, которая требует очень много памяти. Но разработчик нового inference-движка Strata смог распределить её между GPU, оперативной памятью и SSD.

В результате модель уже запускают даже на обычных игровых видеокартах.

На RTX 5070 12 GB при контексте 128K разработчик получил:

• Q2_0 - около 65 tok/s
• IQ2_XS - около 52 tok/s
• IQ3_XXS - около 45 tok/s
• IQ3_S - около 42 tok/s

На коротком контексте скорость ещё выше.

Появились и тесты от других пользователей:

• RTX 5070 Ti - около 86 tok/s на IQ3_XXS при 64K
• RTX 4090 - примерно 58–70 tok/s на IQ3_S при 262K
• даже RTX 2070 8 GB удалось запустить примерно на 20 tok/s

Как это работает?

Strata не пытается полностью загрузить огромную модель в видеопамять.

Самые востребованные части модели находятся на GPU, остальные MoE-эксперты - в RAM, а большая PLE/n-gram память может храниться на SSD.

Таким образом, Flash Next можно запускать даже при относительно небольшом объёме VRAM.

Ещё одна важная функция — кеширование диалога. После первого запроса Strata сохраняет состояние и при следующих обращениях обрабатывает только новый контекст, что особенно важно для AI-агентов и программирования.

Пока у проекта есть ограничения: нет полноценного multi-GPU.

Но сам факт уже интересный: Qwen3.8 Flash Next постепенно превращается из огромной модели для дорогих серверов в LLM, которую можно запускать на обычном домашнем ПК.

Я сам еще не пробовал, но в НАШЕМ ЧАТЕ люди потихоньку запускают, скорость реально повыше.

Линк на движок: https://github.com/Niko1221/Strata

Модели, которые нужны Страте: https://huggingface.co/ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-GGUF

Пробовали уже?

MrGips • Про LLM / НАШ ЧАТ


Forward from: Метаверсище и ИИще
Локальный Виспер без питонга.

Продолжение нашего вчерашнего разговора про транскрибацию с помощью ChatGPT.

У кого нет ChatGPT или у кого аллергия на ChatGPT, можно пользоваться вот такой вот штукой.

Это полностью локальная транскрибация звука на вашем компе.

Есть клиент для Винды, для Мака и для Линукса. И всё это скачивается вот по этой ссылке.
https://sourceforge.net/projects/buzz-captions/files/
Для Винды не подписано, Винда будет бессильно ругацца.

Для тех, кто хочет в код, есть ссылка и на код.
https://github.com/chidiwilliams/buzz

Для меня тут основная новая фишка - это то, что он умеет выводить субтитры и различать говорящих, а также принимать на вход видеофайлы.

И да, там есть CUDA и MLX ускорение.

Полный список фич:

- Транскрибация аудио- и видеофайлов, а также видео по ссылкам YouTube
- Транскрибация аудио в реальном времени с микрофона
- Отдельное окно для отображения текста во время мероприятий и презентаций
- Разделение речи перед транскрибацией для повышения точности на записях с шумом
- Определение говорящих в транскрибированных аудио и видео
- Поддержка нескольких бэкендов Whisper
- CUDA-ускорение на видеокартах NVIDIA
- Поддержка Apple Silicon на Mac
- Vulkan-ускорение Whisper.cpp на большинстве GPU, включая встроенную графику
- Поддержка нескольких семейств моделей Transformer через Hugging Face в режиме Whisper
- Экспорт транскрипций в TXT, SRT и VTT
- Расширенный просмотрщик транскрипций с поиском, управлением воспроизведением и регулировкой скорости
- Горячие клавиши для быстрой навигации
- Отслеживаемая папка (Watch Folder) для автоматической транскрибации новых файлов
- Интерфейс командной строки (CLI) для скриптов и автоматизации
- Система плагинов, включая AI-суммаризацию и автоматическое изменение размера/форматирования транскриптов

@cgevent


Forward from: MrGips • Про LLM
7 сентября - День который я буду отмечать ежегодно.

Это можно сказать День монетизации. Потому что у меня заказали рекламу. Да не просто рекламу, а рекламу по теме. Спасибо что не казик.

Никогда бы не подумал что мои монотонные разговоры в микрофон про каких-то хомяков и аквариумы принесет не только счета за электроэнергию, а еще и деньгу.

Наконец-то я трачу драгоценные киловатты на свое хобби с пользой.

Кстати, загляните в тг-канал СLODEX и в Чат ВАЙБКОДЕРОВ.

А так же, подписывайтесь на НАШ LLMповый ЧАТ

А я, пойду закину деньгу за коммуналку, ведь 5090 сама себя не оплатит. Выключаю!


Forward from: MrGips • Про LLM
💳Как платить за Spotify, Cursor, ChatGPT и другие любимые подписки?…

Если ты читаешь это, скорее всего, у тебя уже была проблема: надо оплатить подписку или купить иностранный софт, а российскую карту не принимают.

Mirocard решает это за пару минут:

Это сервис, где можно выпустить виртуальную карту, пополнить рублями через СБП и платить за:

- Midjourney
- ChatGPT
- Figma
- ElevenLabs
- Claude
- Netflix
- Spotify и еще сотни подписок...

По промокоду “PROCOMFY” выпуск карты со скидкой 50%

Оформление из любой точки мира за пару кликов!⚡️

ОТКРЫТЬ КАРТУ


Forward from: MrGips • Про LLM
Video is unavailable for watching
Show in Telegram
Безумная сборка для 5090 - скорость доходила до 175 т/с

Наконец-то я чуть пощупал вот это чудо:
https://huggingface.co/neroued/Qwen3.8-27B-nvfp4-NInfer

А все началось с этого поста на Reddit, после которого я загорелся проверить действительно ли такие цифры можно выдавить или снова кликбэйт.

И каково мое было удивление, мало того что скорость генерации отправляет в космос, так еще и префилл достигает безумных 7 660 ток/с

Но я слишком мало потестил, буквально на пару промтах, в прикрепленном видео 'https://t.me/LLM4at/26551/45171' rel='nofollow'>это один из них.

Остальные тесты в НАШЕМ ЧАТЕ

Держу в курсе и продолжаю наблюдение. Всем быстрых токенов!

20 last posts shown.