Neuro ☣ Syndicate Top Content


Гео и язык канала: Россия, Русский
Категория: Технологии


#underground база Виджеев, визуальные артисты, цифровое искусство.
/NeuroSyndicate
Доп.проекты и поддержка:
Исследования с применением нейросетей, реализация в сфере Творчества и Науки. ТСХР "Отель Россия", мастерская и видео-ателье РаскатовАРТ.

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций




Мультимодальный художник. Тут есть такие ?


Репост из: 🇷🇺 The Club 100 - Криптовалютый окоп, нейро полигон, геймерская усадьба, технический момент
Бутерин заявил, что Ии скоро взломает цифровые подписи крипто кошельков, хакеры даже без сид фраз смогут спокойно переводить ваши деньги

И как быть?


Антропик запретил юзерам агрить свои нейросети 🎶

*Нейробулинг один из приемов активировать буст промптинга, часто срабатывал увеличивая потенциал ответов, при этом возникает проблема с дообучением и контролем моральной стороны ответов нейросетей.




Интересный отчёт кого могут заменить нейросети уже сейчас.

Но всегда останется опция для кожаных цифровых художников! Это презварие не заменить, так как уникальность творческого труда человека в искусстве оценивается по другим параметрам...

https://www.anthropic.com/research/what-work-can-robots-do


😎


Репост из: Baza
Фейковым нейро-докладом за 4,5 млн рублей отчиталась российская компания перед Минэкологии — фирма придумала новые виды животных и увеличила популяцию млекопитающих вдвое.

Как узнала «База», одна местная организация получила 4,5 млн рублей от Минэкологии Башкортостана за исследование озера Асликуль: нужно было выяснить, почему оно мелеет, оценить состояние экосистемы и предложить способы её восстановления. Но госзаказчик работу не принял — эксперты нашли многочисленные ошибки, противоречия и признаки использования ИИ.

Например, в одном месте авторы указали 42 вида млекопитающих в природном парке, а через несколько страниц — уже 20. В отчёте также появилась «Гордая чайка» — такой вид птицы эксперты Минэкологии не нашли на Земле.

Кроме того, в исследовании не хватало обязательных данных об уровне воды, осадках и температуре, а текст был полон грамматических, смысловых и пунктуационных ошибок. Минэкологии расторгло контракт. Компания попыталась оспорить решение в суде, но сторона поддержала госзаказчика.

BAZA в Telegram
BAZA в MAX


Репост из: Техномотель
Художники-аниматоры идут НА ЗАВОД — китайцы дропнули модель для анимации 3D-модель через текст.

Технологию назвали Unimate, и она может сделать мультипликацию доступной для всех. Нейронке нужно скормить модельку персонажа, а она сгенерирует анимацию по описанию с учётом строения его скелета.

Unimate сама учитывает связи между суставами, исходную позу и расстояние вдоль цепочек костей. Благодаря этому модель получается универсальной, и её не надо учить анимации каждого типа персонажа с нуля.

Что с лицом, Pixar? 🫵


Репост из: VozDooh
⚡️Открытый конкурс для цифровых художников: ваша работа на медиафасадах

10 октября 2026 года музею на медиафасаде VozDooh исполнится 2 года. По этому случаю мы готовим выставку «ОШИБКА. Искусство неточности». В экспозицию войдут работы 8 цифровых художников, которые будут отобраны кураторами по результатам Открытого конкурса. Условия участия ищите в конце поста.

КОНЦЕПЦИЯ ВЫСТАВКИ:
Мы привыкли воспринимать ошибку как сбой или отклонение от нормы, как то, что должно быть исправлено или скрыто. Но так ли это на самом деле?
Для науки, искусства и новаторства зачастую именно ошибка становилась точкой бифуркации - началом нового открытия, неожиданного поворота, гениальной догадки. Пенициллин, Америка, теория относительности - всё это плоды «неправильных» наблюдений. В искусстве случайное пятно, сдвиг перспективы, искажение формы не раз порождали целые направления. С этой точки зрения ошибка - начало пути.
Сегодня мы живём в эпоху ИИ, когда генеративные модели, обученные на миллиардах образцов, выдают виртуозно точные изображения. Их «правильность» поражает, но в ней есть что-то безупречно-стерильное, почти мёртвое. Совсем иное - те моменты, когда сеть сбивается: в багах, глитчах, артефактах, в странных сращениях форм и смыслов. В этих ошибках вдруг проступает что-то непредсказуемое, а от того - живое. И эстетика сбоя приравнивается к эстетике подлинности.
Выставка «Ошибка», приуроченная ко второму Дню рождения музея цифрового искусства на медиафасаде VozDooh предлагает цифровым художникам совершить намеренное отступление от совершенства.
Вдохновляясь самим принципом обучения ИИ, - который, как известно, строится на ошибках и обратной связи, - мы приглашаем авторов обратиться к тому материалу, который обычно помещают в корзину: к «испорченным» генерациям, к «неудачным» промптам, к галлюцинациям нейросетей. И сделать этот брак основой для произведения, когда ошибка перестаёт быть дефектом и становится методом. Она - главный учитель, и именно через неё мы можем увидеть ту самую «рукотворность» цифры, искру, творческий порыв.


ФОРМАТ И УСЛОВИЯ УЧАСТИЯ:
▫️8 работ цифровых художников, которые из присланных отберут кураторы VozDooh, будут транслироваться на медиафасадах RGB Graphics 10 дней с 10 по 19 октября каждые 5 минут.
▫️Ваш арт должен отвечать Концепции (см. выше), а также цензурным нормам для показа на экранах в городе.
▫️Чтобы стать участником выставки, оставляйте заявку по форме.
👉 Срок приема заявок по форме: до 2 октября (23:59) 2026 года.

Мы ждём работы, где баги превращаются в образы, глитчи становятся ритмом, а бессмыслица оборачивается новой поэтикой. Выставка «Ошибка» - это попытка полюбить несовершенство в эпоху машинной точности. И напоминание о том, что путь к великому всегда начинается с проб и ошибок.

#открытыйконкурс #опенколл #opencall #vozdooh


Репост из: Нейронавт | Нейросети в творчестве
Vlo

Локальный видеоредактор с открытым кодом и AI-фичами. Песочница для новых инструментов — ротоскопинг, семантическое аудио, детекция битов, live-мост в #ComfyUI

• SAM2-редактор масок с автообрезкой и сшивкой для video inpainting
• Live ComfyUI-мост — любые воркфлоу на таймлайне
• Встроенные коррекции — цвет, аудио, layout, фильтры
• Ключевые кадры и сплайны для всех трансформаций
• Бит-детекция, снайп-маркеры
• Организация ассетов — горячие группы, избранное
• Mask algebra — объединения, пересечения
• Draggable motion paths
• Sam-audio — разделение аудио на стемы
• Adjustment clips — операции на весь таймлайн
• Блендинг-модели, цветокоррекция, переходы
• Генерация и #upscale через ComfyUI
• Extension SDK

Спасибо @m_franz

#videoediting

MAX


Репост из: AI Product | Igor Akimov
Новинки с OpenAI DevDay

Пока кратенько, надо детальнее изучать

– Dots – постоянно работающие агенты, которые изучают, что вам важно, и сами берут задачи. Типа могут баги разгребать или на почту отвечать. Пока в Pro и Business Premium, для Enterprise – бета, выключенная по умолчанию
– GPT-6.1 Sol – почти уровень Astra, но в 5 раз дешевле по токенам. Сильный апгрейд в агентном кодинге и computer use. Уже доступно.
– Ultrafast – премиальный тариф скорости: до 8x в Codex (300 токенов/сек) и до 6x в API. Пока только для GPT-6 Astra.
– Pro 500 – новый тариф с лимитом в 25 раз больше Plus и доступом к Ultrafast за 500 баксов.
– Agents API с computer use – плюс мультиагентность из Codex, tool search и сжатие контекста. Инфраструктуру держит OpenAI. Параллельно с Amazon сделали Bedrock Managed Agents – те же агенты OpenAI, но целиком внутри AWS
– Decisions API – модель отвечает на заранее заданные вопросы с фиксированными вариантами ответа. Классификация, роутинг, выбор следующего шага агента. Агааа! Говорил я скоро Jev скопируют!
– Codex – облачный запуск с любого устройства, голосовое управление в CLI, ревью кода в десктопе и Codex Security Cloud, который сканирует репозитории и готовит фиксы, пока ноут закрыт. Скоро за вас и задачи ставить будет.
– Плагины – ChatGPT открывает свою внутреннюю платформу: панели в сайдбаре, просмотрщики файлов, автоматизации через MCP Events. Очередной маркетплейс:-/
– Офис – Space для команд, Pages как совместные документы людей и агентов, совместные слайды с экспортом в PowerPoint/Google Slides, @ChatGPT в Slack и Teams, плагин для записи встреч. Это прям супер-жесткий наезд на все типичные рабочие инструменты сразу, от таск-менеджеров до мессенджеров.
– Sign in with ChatGPT – подписка работает как кошелёк у 16 партнёров (Devin, Notion, Vercel и др.), с лимитами на каждого. Полезненько. По сути подписки на других в подарок.
– Marketplace – энтерпрайз может тратить уже законтрактованный бюджет OpenAI на софт 32 партнёров: Adobe, Figma, Salesforce, Harvey, CrowdStrike и т.д. Тоже типичный вариант привязать к себе финансовые потоки.

Прикол, что Notion одновременно партнёр в Sign in with ChatGPT – и прямой конкурент Pages и Space :)

Короче, у ChatGPT 1.2 млрд пользователей в неделю, и OpenAI явно хочет, чтобы там же происходила вся работа – документы, встречи, код, агенты, подписки. Для разработчиков самое практичное – Sol за 1/5 цены Astra и computer use в Agents API, ну и Decisions.

https://openai.com/index/devday-2026-recap/


Jev: модель, которая не пишет текст, а принимает решения

Источник: Хабр. https://share.google/J5HKi1H8Sx7dvM6WI


Репост из: NLP Wanderer
Halo: почти год моей работы в White Circle теперь в опенсорсе

Почти год я веду в White Circle разработку Halo - фреймворка для тренировки LLM, на котором мы учим все свои модели. Внутри он работал давно как замена Мегатрона, но до публичного релиза пришлось догнать transformers, TRL и vLLM, добавить модели и упростить адопшен - образы, CLI, документация. Подробный блогпост - на сайте White Circle (https://whitecircle.com/research/halo).

Если вы файнтюните открытые модели, то наверняка упирались в: модель уже не лезет в TRL и обычный FSDP, но связываться с Megatron и конвертацией чекпоинтов еще рано или просто не хочется. С MoE все еще хуже, без Expert Parallelism их по большому счету не потренировать. Halo добавляет EP, Context, Tensor и Expert-Tensor Parallelism прямо поверх обычных классов HuggingFace: на вход HF модель, на выходе HF модель. Новое MoE семейство подключается оберткой меньше 140 строк (у Megatron-Bridge на то же самое уходит 600-1900), сейчас их 15.

Немного цифр, все на B300, воспроизводимы из репо:
- 2.3-2.8x throughput относительно стокового TRL на gpt-oss-20b при тех же кернелах, loss совпадает в пределах ~1%.
- Gemma 4 26B-A4B на 2 GPU: 7.2k tok/s против 3.2-5.0k у NeMo AutoModel, Axolotl, Megatron Bridge, MS-SWIFT и Unsloth.
- Оптимизатор целиком в bf16 со стохастическим округлением: 120 GB состояния вместо 240 для 20B.

Все это првоерялось на реальных кластерах B300/B200/H200/H100 а топология заложена вплоть до NVL72: невалидные раскладки отбрасываются еще на этапе конфига. Запускается через torchrun, accelerate или halo CLI, в репо есть рецепты под SLURM, SkyPilot, RunPod и Nomad. Большая часть года ушла на то, чтобы все это не разваливалось на всех комбинациях моделей и параллелизмов - тестов в репозитории больше, чем кода. При этом работать будет также и на современных консьюмерских GPU.

Отдельная моя гордость - Async RL. vLLM или SGLang живут в отдельном контейнере, роллауты идут асинхронно через Ray, веса уезжают по NCCL (по EFA 53-80 GB/s, gpt-oss-120b обновляется за 3-4 секунды), а генерации во время синка не обрываются. Внутри routing replay, importance sampling с масками, обучение на токенах, которые насэмплил движок, и 11 встроенных сред - от code contests и SWE до тулов через MCP. По механикам это сопоставимо с verl и Miles, только на HF-моделях и без Megatron.

Для студентов и тех, кто только начинает, Halo, мне кажется, хорошая точка входа. Все запускается из одного docker-образа: halo launch sft config.yaml, а QLoRA Qwen3-4B занимает 7.9 GB и должна работать на 3090/4090. Документации больше 170 страниц, отдельно советую прочитать лекцию GPU Training Theory: база того как работают такие фреймворки, почему эксперты в MoE упираются в память, а не в compute, и почему в EP-шаге 88% времени - это all-to-all. Там же честно написано, что не помогает и что тихо ломает, например TF32 по умолчанию в NGC-образе, портящий RoPE после 2048 токенов.

Выложили и модель - GLM-4.7-Flash-Coder, 30B MoE под агентские скаффолды: SFT на 7.8k успешных траекторий GLM-5.1, на SWE-rebench-V2 pass@1 вырос с 33.2% до 41.7%, а модель сама научилась вызывать тулы параллельно. Она уже слегка устарела, но как гайд по агентскому SFT актуальна.

Код мы пишем с агентными скаффолдами и сильными моделями вроде Claude Fable и Opus, репозиторий под это спроектирован. Контрибьт приветствуется, но через фильтр: сначала issue и approve мейнтейнера, потом PR. Главное правило - понимать свой код: с AI писать можно, но это нужно раскрыть, а тесты должны падать, когда ломается поведение.

Дальше больше: Pipeline Parallelism (все уже в коде, но докатим после полных тестов) и серия блогов про тренировку, например про async RL для code contests. Лицензия Apache 2.0.

P.S. Если помните такую вещь как SMPO из времен Vikhr, то он теперь тоже живет там, но уже с EP и CP и улучшениями.


Репост из: РассветAI
Видео недоступно для предпросмотра
Смотреть в Telegram






Репост из: Нейронавт | Нейросети в творчестве
Видео недоступно для предпросмотра
Смотреть в Telegram
AGORA

Проект над которым работал наш подписчик @ramazan2k

Генерация анимируемых 3D аватаров голов на 3DGS, работает в реальном времени прямо на телефоне (60 FPS), обучается только на обычных 2D фотках без видео и multi-view.

Гитхаб - Код ждем до конца мая после ревью

#avatar #head #gaussian #portrainanimation #image2avatar


Репост из: Psy Eyes
Runway: выпустили плагин для DaVinci Resolve, Adobe Premiere и After Effects.

Он позволяет генерить, расширять и апскейлить видео / картинки прямо на таймлайне. Редактирование видео, включая апгрейд до HDR, тоже есть и делается через Aleph 2. Доступные модели для видео: Runway Gen-4.5, Veo 3.1, Seedance 2.5, и Kling 3.0 Pro. Для картинок: Gen-4 Image, Nano Banana и GPT Image 2.

Плагин есть на Windows и MacOS. На линукс попроси Клода.

Анонс
Сайт


"Квантовый прыжок" из цикла "Многомерный реализм".
Работа в процессе..

Многомерный коллаж различных цифровых техник и элементов генераций , в концепте Нейроклектика.

Показано 20 последних публикаций.