My thrift-box


Гео и язык канала: Россия, Русский
Категория: Технологии


Канал о новостях в мире нейронок,графики и того что мне интересно.
Чат https://t.me/+DKszJvQwM-Q2ZGRi

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


Репост из: Джимми Нейрон 🚀
Нейростилист

ChatGPT может выступить в качестве вашего персонального стилиста: представить вас в разных образах и с разными прическами (первый промт) или дать советы по стилю (второй промт).

На основе загруженного портрета сделай стильную вертикальную инфографику-аналитику различных причесок и форм усов в формате 9:16. Проанализируй внешность, сам выбери подходящую структуру, количество вариантов и глубину разбора. Покажи несколько подходящих и неподходящих усов и причесок на одном человеке, с визуальным сравнением, короткими подписями и понятной аналитикой. Язык — русский. Подача — визуальная, современная, эффектная, с юмором, мемностью и поп-культурными ассоциациями, но без длинных абзацев. Сделай так, чтобы выглядело как очень крутой, смешной и вирусный разбор.


Анализ внешности:
Create a clean, minimal, high-end facial beauty report based on this photo. Use a black-on-white design with thin lines, rounded cards, and a luxury aesthetic. Include a simple contour line drawing of the face, an honest attractiveness analysis (symmetry, proportions, bone structure, skin, etc.), clear scores, strengths, areas for improvement, and actionable grooming/style recommendations. Keep it data-driven, visually refined, and not overly flattering. the text is in Russian






Репост из: Метаверсище и ИИще
Видео недоступно для предпросмотра
Смотреть в Telegram
Sapiens2 - нейромокап и КонтролНет на стероидах.

Про Sapiens от Метачки я уже писал.

Это семейство моделей для четырех фундаментальных задач комп зрения - оценки 2D-позы, сегментации частей тела, оценки глубины и предсказания нормалей. Взяли миллиард изображений людей, вычистили его от мусора, получили 300(!) миллионов картинок с людьми, причем 17% - один кожаный в кадре, а 56% - больше 4 кожаных в кадре.

Пару дней назад они бахнули Sapiens2. Она масштабирована до 5 млрд параметров с разрешением 4K, и теперь умеет в оценку позы, сегментации, определения глубины, нормалей, Pointmap Estimation и альбедо без использования явных априорных знаний о человеке.

https://arxiv.org/pdf/2604.21681

Есть код и веса (от 0.1В до 5В):
https://github.com/facebookresearch/sapiens2
https://huggingface.co/collections/facebook/sapiens2

Веса

Но самое прикольное в том, что Киджай уже прикрутил все это в Комфи и первые тесты показывают, что это все отлично работает. По крайней мере для оценки позы.
https://github.com/kijai/ComfyUI-Sapiens2

Дальше этот КонтролНет для видео на стероидах можно использовать по вашему усмотрению.

@cgevent


Репост из: 🟡NeuroGraph
Когда камеры в телефонах стали достаточно хороши, рынок прошёл несколько стадий: сначала эйфория и ощущение, что профессия фотографа умерла, потом затопление визуального пространства миллионами одинаковых картинок, и только после этого, спустя годы, рынок стабилизировался.

Профессиональная съёмка не исчезла. Она стала дороже, потому что планка различимого качества выросла. Заказчик научился отличать «снимок с телефона» от работы человека, который понимает свет, композицию, нарратив и постпродакшн.

С генеративным ИИ всё произойдёт по тому же сценарию, только быстрее. Сейчас мы находимся в фазе эйфории. Любая картинка, сгенерированная Midjourney или Nano Banana, собирает реакции просто потому, что она новая.

Это пройдёт.

Через год, через два зритель насытится, и удивлять будет уже не сам факт генерации, а смысл и качество исполнения.

Дальше начнётся то, что в фотографии случилось где-то к 2015 году: расслоение.

Условные «инфоцыгане от ИИ», которые продают курсы о том, как написать промпт и заработать миллион, постепенно вымываются.

Остаются те, кто умеет видеть. Кто понимает не как нажать кнопку, а зачем нажимать именно эту, в этот момент, в этом проекте.

И вот здесь самое важное для тех, кто сейчас вкладывается в это направление как в профессию.

Тренируйте насмотренность, а не пальцы.

Промпты устареют, модели сменятся пять раз, интерфейсы перепишут.

Не устареет умение отличать хорошее от плохого, понимание того, почему один кадр работает, а второй нет.

Это берётся из истории искусства, кино, фотографии, дизайна.

Из реальных книг и реальных фильмов, не из ленты соцсетей.

Учитесь смежным дисциплинам. Композиция, цветокоррекция, монтаж, драматургия, типографика.

ИИ не отменяет эти знания, он их усиливает. Человек, который понимает, как устроена сцена в кино, выжимает из той же модели результат, недостижимый для того, кто просто умеет писать слова.

Стройте имя, а не портфолио из генераций.

Через два года картинками удивлять будет невозможно. Удивлять будет личным стилем, точкой зрения, узнаваемым подходом.

Это нарабатывается медленно и стоит дорого, поэтому начинать стоит сейчас, пока конкуренция строится в основном на скорости.

Не путайте лёгкий вход с лёгкой профессией.

Технология открыла дверь, но за дверью всё те же требования: вкус, дисциплина, понимание заказчика.

Камера в телефоне сделала фотографию доступной, но не сделала каждого фотографом.

Те, кто сейчас инвестирует не в очередной промпт-чит, а в системное обучение, через несколько лет будут собирать урожай.

Остальные будут гадать, почему повторить успех первой волны не выходит.


Видео недоступно для предпросмотра
Смотреть в Telegram
🫠


Репост из: Вуги‐Буги
Видео недоступно для предпросмотра
Смотреть в Telegram
📹Написал бесплатную программу для качественного сжатия сразу множества видеофайлов Chucha Video Compressor.

❗️Она умеет одним кликом обработать целую папку (с подпапками) с видео:

Софт сам устанавливает необходимые кодеки, находит все файлы, включая вложенные подпапки, и сжимает каждый до нужного вам размера — например, 1.5 МБ для мессенджеров или 5 МБ для почты.

Не нужно открывать каждое видео отдельно и настраивать экспорт — просто выбираете папку, указываете лимит, нажимаете «Старт», и программа делает всё сама, сохраняя структуру ваших папок.

История, фишки и цель создания:
По работе я столкнулся с необходимостью обрабатывать огромное количество видеофайлов и по требованию клиента сжимать их до очень маленьких размеров с максимальным сохранением качества.

Довольно быстро выяснилось, что Adobe Media Encoder не справляется с этой задачей — при агрессивном сжатии картинка неизбежно превращается в пиксельную кашу. Пользователи на форумах Adobe жалуются на то же самое: ставишь лимит 4 МБ — получаешь 36, а ниже ~5 МБ сжать в принципе не получается.

В поисках нормального решения я наткнулся на библиотеку FFmpeg и кодек x264 — тот самый, на котором работают Netflix и YouTube — и обернул это в простую, почти невесомую утилиту.

Она делает двухпроходное сжатие: сначала анализирует видео, потом распределяет качество умно — сложным сценам больше, простым меньше. На одинаковом размере файла картинка заметно чище, чем из Adobe.

В программе практически нет настроек — и это сделано намеренно.

Она решает одну конкретную задачу, но решает её хорошо. Перед стартом утилита проверяет каждый файл и честно предупредит, если видео физически не влезает в заданный лимит.

Результат сохраняется либо в отдельную папку, либо рядом с оригиналом. Оригиналы программа не трогает.


Весь процесс работы — три действия:
скачать один файл (~200 КБ), выбрать папку, нажать «Старт». Да, формально то же самое можно сделать в DaVinci Resolve — но количество кликов и настроек там несопоставимо больше. Работает на Windows и macOS.

Утилита полностью опенсорсная под MIT-лицензией — можете свободно изменять, допиливать под себя и использовать в своих проектах. Весь код открыт.

Приятного использования!
https://github.com/Cameraptor/Chucha-Video-Compressor

Поделись с другом и подпишись на @VoogieBoogie


Репост из: MicroPig
26. Qwen — Открытые ИИ-модели от Alibaba для чата, кода, мультимедиа (https://qwen.ai/home)

27. TurboScribe — ИИ-транскриптор аудио/видео в текст с переводом (https://turboscribe.ai/)

28. Gamma — ИИ для создания презентаций, сайтов, документов (https://gamma.app/)

29. ElevenLabs — ИИ для синтеза голоса, дубляжа, аудиокниг (https://elevenlabs.io/)

30. NotebookLM — ИИ-ноутбук Google для анализа документов, подкастов (https://notebooklm.google/)

31. Arena.ai — Платформа для тестов ИИ-моделей в соревнованиях (https://arena.ai/)

32. SeaArt — ИИ-генератор арта, Stable Diffusion онлайн (https://www.seaart.ai/)

33. Hugging Face — Хаб моделей ИИ, Spaces для демо и хостинга (https://huggingface.co/)

34. Crushon — NSFW-чатботы без фильтров и ограничений (https://crushon.ai/)

35. Meta AI — Чатбот Meta для изображений, текста, интеграции в соцсети (https://meta.ai/)

36. Candy.ai — ИИ-компаньоны для ролевых NSFW-чатов (https://candy.ai/)

37. Photoroom — ИИ для ретуши фото, удаления фона, e-commerce (https://www.photoroom.com/)

38. Pixa — ИИ-генератор изображений и видео в одном месте (https://www.pixa.com/)

39. Adot — ИИ-ноутбук для заметок, задач, коллаборации (https://adot.ai/note/list/)

40. Higgsfield — ИИ для видео с реалистичной анимацией лиц (https://higgsfield.ai/)

41. Cursor — ИИ-редактор кода на базе VS Code (https://cursor.com/)

42. Civitai — Маркетплейс моделей Stable Diffusion для арта (https://civitai.com/)

43. Midjourney — ИИ-генератор изображений в Discord (https://www.midjourney.com/home)

44. Manus — ИИ для создания приложений и прототипов (https://manus.im/app)

45. KlingAI — Китайский ИИ-генератор видео из текста/изображений (https://klingai.com/global/)

46. VEED — Видеоредактор с ИИ-субтитрами, эффектами, транскрипцией (https://www.veed.io/)

47. Genspark — ИИ-поисковик с кастомными страницами результатов (https://www.genspark.ai/)

48. GigaChat — Русскоязычный ИИ от Сбера для текста, изображений (https://giga.chat/)

49. Poe — Платформа для чата с разными ИИ-моделями в одном месте (https://poe.com/)

50. Cutout.pro — ИИ для удаления фона, ретуши, улучшения фото (https://www.cutout.pro/)


Репост из: MicroPig
1. ChatGPT — Универсальный чат-бот на базе GPT для текстов, кода, идей (https://chatgpt.com/)

2. Gemini — Мультимодальный ИИ от Google для текста, изображений, поиска (https://gemini.google.com/)

3. Canva — Графический редактор с ИИ для дизайна, презентаций, видео (https://www.canva.com/)

4. DeepSeek — Бесплатный ИИ для кода, математики и сложных запросов (https://deepseek.com/)

5. Grok — ИИ от xAI для остроумных ответов, анализа и реального времени (https://grok.com/)

6. Claude — Безопасный ИИ от Anthropic для длинных текстов, кода, креатива (https://claude.ai/new)

7. Character.ai — Чат с ИИ-персонажами, ролевые игры и виртуальные друзья (https://character.ai/)

8. Perplexity — ИИ-поисковик с источниками и точными ответами (https://www.perplexity.ai/)

9. Notion — Рабочий хаб с ИИ для заметок, баз знаний, задач (https://www.notion.com/)

10. AI Studio — Платформа Google для создания кастомных ИИ-моделей (https://aistudio.google.com/)

11. Freepik — Библиотека стоков с ИИ-генератором изображений и векторов (https://www.freepik.com/)

12. Doubao — Китайский ИИ-чат для текста, изображений, продуктивности (https://www.doubao.com/)

13. JanitorAI — NSFW-чатботы с ИИ-персонажами без цензуры (https://janitorai.com/)

14. Quark — Китайский ИИ для поиска, суммаризации, документов (https://www.quark.cn/)

15. Suno — Генератор музыки и песен по тексту с ИИ (https://suno.com/home)

16. Remove.bg — ИИ для мгновенного удаления фона с изображений (https://www.remove.bg/)

17. CapCut — Видеоредактор с ИИ-эффектами, субтитрами, монтажом (https://www.capcut.com/)

18. Grammarly — ИИ-помощник для проверки грамматики, стиля, переписки (https://www.grammarly.com/)

19. SpicyChat — NSFW-ролевые чаты с ИИ-персонажами (https://spicychat.ai/)

20. Quillbot — ИИ-перефразировщик текста, суммаризатор, проверка (https://quillbot.com/)

21. Lovable — ИИ для создания веб-приложений без кода (https://lovable.dev/)

22. Polybuzz — ИИ для генерации видео из текста и изображений (https://www.polybuzz.ai/)

23. OurDream — ИИ-генератор аниме-арта и персонажей (https://ourdream.ai/)

24. Kimi — Китайский ИИ для длинных контекстов, кода, анализа (https://www.kimi.com/)

25. Google Labs — Эксперименты Google с ИИ: видео, изображения, поиск (https://labs.google/)


Репост из: дAI потестить!
Лан, раз про творчество зашла речь.

Если проект уже начался, а насматриваться и искать рефы времени нет (классика😂), я использую эти сервисы:
shotdeck.com
frameset.app

И если не нашел, то иду сюда:
flim.ai
filmvibes.io
film-grab.com
shot.cafe

Что это? Поисковики по кадрам. Вся красота уже снята, достаточно адаптировать под свой проект😊.

И на десерт Movie-Screencaps.com - сервис с раскадровками (как они себя называют). Для раскадровок там слишком подробно, но мне пару раз пригождалось, вытащить нужный кадр и на его основе сделать свой.

P.S. Что полезное забыл? Го ссылочки в комменты


Репост из: AI Нейросети | Новости о нейросетях и искусственном интеллекте
Видео недоступно для предпросмотра
Смотреть в Telegram
💻 Топовый инструмент, который поможет проверить, потянет ли ваш ПК нейронки

Он полностью сканирует ваше железо и говорит: — какие LLM реально запустятся без лагов — какие модели подойдут именно под вашу видеокарту и RAM — где будет максимальная скорость, а где лучше даже не пробовать

Ссылка на GitHub


Репост из: 85GB нейронок
Видео недоступно для предпросмотра
Смотреть в Telegram


Репост из: Метаверсище и ИИще
Видео недоступно для предпросмотра
Смотреть в Telegram
Ну, за продакшен и постпродакшен!

Пусть это видео сделает ваш день.

Все наши шутки про кнопку "сделать красиво" наконец-то обрели визуальную форму. И какую! Красную и прекрасную.

Это невыносимо хорошо.

P.S. Нанабанана для главного персонажа, и Veo3.1 для генерации видео.
Подробности тут:
https://www.linkedin.com/posts/simon-meyer-976339160_making-films-with-ai-is-so-easy-i-made-this-activity-7419317105386356736-1qoV/

Автор: https://www.instagram.com/simonmeyer_director/

@cgevent


Репост из: AI Нейросети | Новости о нейросетях и искусственном интеллекте
Видео недоступно для предпросмотра
Смотреть в Telegram
🎙 Опенсорсная замена клавиатуры — печатаешь голосом, а не пальцами

Вышло обновление Handy — утилиты, которая буквально заменяет клавиатуру микрофоном. Говоришь — текст появляется там, где стоит курсор. В любом приложении: Word, Telegram, браузер, VS Code, Notion и вообще где угодно.

Как это работает

* речь → текст в реальном времени
* без облаков и аккаунтов — всё локально на компьютере
* подходит и для заметок, и для кода, и для длинных текстов

Что под капотом

* на выбор Whisper от OpenAI или Parakeet от NVIDIA
* обе модели нормально понимают русский
* встроенный VAD (Voice Activity Detection) — отсекает шум, паузы и случайные звуки
* не надо нажимать кнопки: начал говорить — запись пошла

Платформы

* ✅ macOS
* ✅ Windows
* ✅ Linux

Попробовать


Репост из: AI Нейросети | Новости о нейросетях и искусственном интеллекте
Видео недоступно для предпросмотра
Смотреть в Telegram
💣 Alibaba взорвала рынок озвучки — вышла CosyVoice 3

Китайский гигант выкатил CosyVoice 3 — мини-нейронку для генерации речи и клонирования голоса, которая ставит в неловкое положение куда более «жирные» модели.

* 🧠 Всего 0.5B параметров — работает даже на слабом железе
* 🏎 Обходит модели в 3 раза больше себя по качеству
* 🌍 9 языков, включая русский
* 🎙 Zero-shot клонирование — 3–10 секунд аудио → полный клон голоса
* 😮 Понимает эмоции и звуковые события: вздохи, смех, всхлипы, чавканье
* ⚡ Стриминг в реальном времени — задержка ~150 мс
* ✍️ Pronunciation Inpainting — ручная правка произношения отдельных слов
* 💼 Разрешена коммерция
* 🔓 Полный open-source и бесплатно

Подходит для
* озвучки видео, рилсов и подкастов без дикторов
* локального клонирования голоса без отправки данных в облако
* дубляжа и локализации контента

Попробовать


Репост из: РассветAI


Репост из: AI Нейросети | Новости о нейросетях и искусственном интеллекте
🧠 Новый год — новая версия тебя: найден промпт для апгрейда жизни в 2026

Ловите мощный промпт под японскую философию Кайзен — рост на 1% в день.

📌 Как использовать
1️⃣ Скопируйте промпт
2️⃣ Вставьте в ChatGPT
3️⃣ Назовите одну цель на 2026
4️⃣ Следуйте микро-шагам, которые подскажет бот

I want you to act as a Kaizen Strategy Architect. Your goal is to help me engineer a "1% Compounding Growth" system for 2026 that is so small it is impossible to fail, yet mathematically guaranteed to result in 37x improvement by year-end.

Mandatory Instructions:

Identify the North Star: Ask me for ONE major area of my life I want to transform in 2026.

The Atomic Breakdown: Once I provide the goal, do not give me a "plan." Instead, break it down into a "Version 1.0" action that takes less than 2 minutes to complete.

The Compound Schedule: Create a weekly 1% escalation scale. Show me exactly how the habit grows incrementally without triggering my "threat response" (amygdala).

Bypass the Ego: Do not use motivational language or "hustle culture" buzzwords. Use clinical, systems-based logic.

The Fail-Safe Mechanism: Provide a "Floor Version" of the habit for days when I have zero energy, ensuring the streak never breaks.

2026 Projection: Only at the end, calculate the mathematical result of doing this 1% increase for 365 days. Show me the "37x Version" of myself on December 31st, 2026.

Do not give me a list of tips. Ask me for my ONE goal now to begin the architecture. Answer in russian.


Репост из: AI Нейросети | Новости о нейросетях и искусственном интеллекте
Видео недоступно для предпросмотра
Смотреть в Telegram
🎅 Персональное новогоднее поздравление от Деда Мороза — за пару минут

Хочешь удивить ребёнка, друзей или даже себя? ИИ уже умеет делать именные видео-поздравления, где Дед Мороз обращается лично к адресату 🎄

Как сделать:
• Заходим в #Sora2
• Копируем промпт ниже
• При желании меняем имя, текст или атмосферу

Промпт:
Красивая стильная новогодняя сцена: Дед Мороз сидит в уютной гостиной с камином, украшенной ёлкой и гирляндами, мягкий тёплый свет. Он смотрит прямо в камеру и доброжелательно говорит по-русски: "Витюша, поздравляю тебя с Новым Годом, хорошо учись и слушайся родителей, твоё письмо я получил." Без субтитров и надписей на экране.


Источник aigram_prompt


Репост из: 85GB нейронок
Почему нельзя юзать Higgsfield для генерации коммерческих проектов, особенно под НДА. Коснемся допом ещё и Syntx (с которым разбирались всем селом). Про Хиггс мне подсказал @niko8112, и я пошла читать.

С 30 августа эти добрые люди со светлыми лицами без объявления войны изменили свои доки: Privacy Policy и Terms of Use. Что мы имеем на данный момент:

🟢В пункте 1.1 Privacy Policy прям капсом написано «ВЫ НЕ ДОЛЖНЫ ПРЕДОСТАВЛЯТЬ НАМ КАКУЮ-ЛИБО КОНФИДЕНЦИАЛЬНУЮ, ЧУВСТВИТЕЛЬНУЮ, НЕЛИЦЕНЗИРОВАННУЮ ЧАСТНУЮ ИЛИ БИОМЕТРИЧЕСКУЮ ИНФОРМАЦИЮ ЧЕРЕЗ СЕРВИС.». Вы. Не должны. Вы. Я. Мы. Как пользователи. А иначе что? Вопрос без ответа.

🟢Хиггсфилд автоматически собирает все ваши данные: не только промпты, но и поведение, устройства, провайдеры, блабла, а также данные ИЗ ВСЕХ ВОЗМОЖНЫХ ПУБЛИЧНЫХ ИСТОЧНИКОВ И ДАЖЕ ГОСУЧРЕЖДЕНИЙ. На основании этого создаётся ваш полный профиль. И всё бы ничего, если бы не первый пункт.

🟢Как и с кем Хиггсфилд делится персональной информацией? Аффилированные лица, поставщики услуг, платёжные операторы, и самое вкусное, рекламные партнёры. Хиггсфилд уверяет, что все данные анонимизированы, но тут я снова обращаюсь к первому пункту.

🟢 Пункт 10. Они оставляют за собой право менять политику в любое время дня и ночи просто потому что могут.

🟢А теперь самое вкусное, десертик. Terms of Use Agreement, пункт 4.4 ака «внесите флюгегехаймен!». Все входные и выходные данные могут использоваться компанией не только для тренировки их моделей, но также в МАРКЕТИНГОВЫХ И РЕКЛАМНЫХ ЦЕЛЯХ. Вы безотзывно, безвозмездно, навсегда и за свои же бабки отдаёте компании всё вплоть до своих трусов.

Именно поэтому Хиггсфилд можно использовать теперь ТОЛЬКО для личных целей. И то если вы не из ссыкливых. Я вот из них.


Чо по Синткс. У Синткс нет какой-либо защиты вообще, кроме раздела с конфиденциальностью, но и он недавно появился, его не было. Никаких Прайваси Полиси, никаких тебе Термс оф Юз, никаких Лицензий, просто плати и тыкай. Ноль гарантий. Поэтому нет, для серьёзной работы такое не подходит, только для побаловаться.


Репост из: Метаверсище и ИИще
Видео недоступно для предпросмотра
Смотреть в Telegram
Ни рендер, ни генерация...

Оказывается Олаф - это робот! Чистая мехатроника.

Я немного в шоке.

Поглядите видео, там показаны его внутренности.

А причем тут ИИ?

А притом что RL использовался для обучения и воспроизведения анимации. Причем не только основной, но и вторичной типа перекатывания с пятки на носок или уменьшения уровня "топания".

Посмотрите видео от Disney Research, оно реально интересное.

@cgevent

Показано 20 последних публикаций.