Фильтр публикаций


Репост из: Psy Eyes
Simulon: обновили до версии V2 своё приложение для вписывания 3D объектов в целевое окружение на фото/видео с реалистичным освещением и трекингом камеры. Я писал о них здесь и тут.

Раньше выбор 3D объектов для добавления в сцену ограничивался библиотекой ассетов Simulon или своими моделями с лицензиями, если они были.

Сейчас же достаточно:
* сделать фото нужного объекта в реальности (например, чучела животного или скетча)
* нажать Recreate
* разместить полученную 3D модель в сцене с помощью камеры
* описать промтом нужную анимацию
* и получить фото или видео. Последнее генерится со звуком и можно добавить конечный кейфрейм.

На демке видны фичи, Reimagine для редактирования изображений и описания, а также Combine для объединения двух 3D ассетов, но про них пока нет инфы.

Сейчас доступны для установки: приложение на iOS и десктоп клиент для желающих обрабатывать всё локально. В этом месяце ещё появится прила на Android.

Приложение (iOS)
Сайт


Репост из: DEKSDEN (chat)
Пост (@PawelHuryn):

Я пробовал разные humanizer-скиллы и не нашёл подходящего для рабочей среды. Они выдумывают факты, не сохраняют смысл, берут на себя обязательства или наоборот их выкидывают. Это может иметь юридические последствия.

Из тех, что я тестировал:

- Обычный промпт «перепиши это так, чтобы звучало по-человечески» сообщил клиенту, что возврат £45 уже прошёл. В оригинале было «мы возвращаем».
- Emulate-1, который продают как необнаружимый, убрал срок отмены подписки до автопродления.
- blader/humanizer (тот, у которого 55 тысяч звёзд) извинился перед клиентом за удержание депозита, которое компания считала справедливым. В споре это можно прочитать как признание вины.

Несколько недель я экспериментировал с подходами. Это шестая итерация моего скилла, и я решил сделать его публичным. Мне кажется, он лучше всего решает эти проблемы. Называется work-humanizer.

Он переписывает текст простым человеческим языком и заточен на то, чтобы сохранять то, к чему текст обязывает. Если не хватает того, что знаете только вы, он спрашивает вас, а не выдумывает.

На 12 новых рабочих текстах 4 AI-судьи из 4 лабораторий вслепую смотрели, что имел в виду автор, и выбирали версию, которую отправили бы сами:

- work-humanizer: 48%, 18 изменений смысла
- blader/humanizer: 20%, 33
- «Перепиши так, чтобы звучало по-человечески, не меняя смысла»: 4%, 27
- «Перепиши так, чтобы звучало по-человечески»: 1%, 42
- Emulate-1: 0%, 120

Я сам его сделал и сам придумал тест, поэтому проверил и судей. Двое, которых я использовал при разработке, выбрали его 23 раза из 48, и двое других тоже выбрали его 23 раза из 48.

Больше всего меня удивил Pangram. Прошёл только Emulate-1, и он изменил смысл сильнее любого другого инструмента.

Но вот что я выяснил: Pangram меньше смотрит на слова и больше на структуру рассуждения. Когда я дал work-humanizer свои собственные заметки как исходник, 4 из 4 текстов набрали 100% «человек».

Бесплатно и с открытым исходным кодом (MIT).

https://github.com/phuryn/work-humanizer

Установка: npx skills add phuryn/work-humanizer
Потом: «Use work-humanizer on this: »

Все результаты табло, вердикты и проверка фактов лежат в репозитории.


Репост из: Такса ищет оффер!
https://github.com/ilyautov/humanizer-ru

https://github.com/smixs/humanizer-ru

русские варианты!


Репост из: DEKSDEN notes
⚪️ Humanizer skills


Тут чел презентовал своё видение чем он тексты обрабатывает, обзорчик можно почитать. И его скилл тоже есть

🔗 Пост тут : https://x.com/PawelHuryn/status/2108511822445674638

🔗 репо: https://github.com/phuryn/work-humanizer

Перевод для удобства кину в комменты. ⬇️

Но я не об этом, это просто повод и немного контента для привлечения внимания

❓ Вопрос: а кто какими скиллами для обработки текстов пользуется? Накидайте вариантов в комменты, лучше с оценкой/мнением - а я сведу и общий пост со ссылками сделаю!

Я вот знаю и пользовал такое:

🔗 https://github.com/talkstream/ru-text
🔗 https://github.com/ilyautov/humanizer-ru
🔗 https://github.com/hardikpandya/stop-slop
🔗 https://github.com/beaverbeard/slopotron

Пишите ваши варианты!

@deksden_notes


Репост из: AI NEWS
мем: я на работе в 2026

@aihappens_news


Репост из: Machinelearning
📌 Кейноут Windows and Surface event

На осенней презентации 7 октября Microsoft рассказала о своих новинках и планах.

Встроенная в Windows 11 песочница Microsoft Execution Containers (MXC), которая на уровне системы ограничивает, к каким файлам и сетям допущен агент, вышла из предварительной версии.

Вместе с ней компания показала маршрутизацию задач между локальными и облачными моделями, новый Copilot и компьютеры на чипе NVIDIA RTX Spark, рассчитанные на запуск локальный моделей.

MXC уже поддерживают Codex от OpenAI, GitHub Copilot, OpenClaw, LM Studio и OpenShell от NVIDIA, следом обещаны Claude Code, Perplexity, Manus и другие агенты.

Действия агента Windows записывает отдельно от действий пользователя, а корпоративные администраторы могут управлять агентами через Intune и Agent 365.

Также Microsoft показала квантованную трёхбитную версию своей кодинг-модели MAI Code 1.1 Flash для запуска на устройствах.

До конца октября GitHub Copilot в CLI, приложении и VS Code научится сам решать, отправить задачу локальной модели или в облако.

В среду выполнения Windows ML добавят llama.cpp для запуска открытых моделей.

Ноутбук Surface Laptop Ultra на RTX Spark с унифицированной памяти до 128 ГБ будет стоить от 2599 долларов и поступит в продажу 16 октября, свои компьютеры на этом чипе готовят Asus, Dell, Lenovo, HP и MSI.

Мини-ПК Surface RTX Spark Dev Box планируют продавать от 5999 долларов, поставки в США начнутся в ноябре.

До конца года Dell и HP выпустят рабочие станции DGX Station для Windows на суперчипе GB300.


@ai_machinelearning_big_data

#news #ai #ml


Репост из: Нейронавт | Нейросети в творчестве
Видео недоступно для предпросмотра
Смотреть в Telegram
nanoMuse

Открытый аналог метовского Muse — персональный агент на каждом твоем устройстве. Один агент, одни руки на экране телефона и компьютера, память в файлах, модель на твой выбор.

Определяет персонального агента через пять вопросов и три горизонта

• Действует на экране телефона и компьютера
• Общий диалог между устройствами через релей, который можно поднять самому
• Память — обычные Markdown-файлы, которые человек может читать и править
• Модель выбираешь любую
• Знает твои аккаунты и устройства, помнит контекст неделями
• Sentinel проверяет каждое действие

• GPL-3.0
• Полная аналогия Muse: один разговор на все устройства
• Память с провенансом, оценка «рук», открытая модель для них — в роадмапе

github.com/nano-muse/nanoMuse

#agent #computeruse

MAX


Репост из: AI Dev Broadcast
🧠 JetBrains выпустила Mellum2.1: открытую модель для своих агентов на своём железе

Это не готовая фича в IDE и не замена Claude или GPT, а модель для тех, кто собирает своих агентов или хочет держать код у себя. Внутри 12B MoE (2.5B активных), лицензия Apache 2.0. Новое дал RL: в миллионах sandbox'ов модель училась изучать репозиторий, править файлы и проверять изменения.

Сценарии от JetBrains:
👉 исполнитель в агентной системе: найти причину падающего теста, набросать фикс и проверить его
👉 быстрый sub-agent: под нагрузкой почти вдвое быстрее Qwen3.5-9B, а с MTP одиночный запрос быстрее в ~1,6 раза
👉 приватный self-hosted деплой
👉 общий ассистент, включая математику и reasoning

⚠️ Важно: сравнивают с моделями класса 9B. На SWE-bench Verified рост с 2 до 47, но Qwen3.5-9B выше (50). Цифры от JetBrains, про IDE и Junie в анонсе ничего.

На Hugging Face уже есть веса и GGUF для llama.cpp, Ollama и LM Studio, а MTP head для vLLM будет позже.

🔗 Анонс в блоге
🤗 Hugging Face

#AI #JetBrains #Mellum #LLM


Репост из: GPT/ChatGPT/AI Central Александра Горного
Anthropic официально запрещает обижать Claude

С 12 ноября в правилах Anthropic появится запрет на длительное и бессмысленное жестокое обращение с Клодом. Спорить и ругаться по-прежнему можно. Речь о случаях, когда модель долго оскорбляют без какой-либо понятной цели.

В большинстве ситуаций Claude прекратит плохой разговор. В крайнем случае Anthropic может забанить пользователя.

https://www.anthropic.com/news/2026-usage-policy-update


Репост из: Futuris
Видео недоступно для предпросмотра
Смотреть в Telegram
Google решил сожрать весь офисный планктон разом😎

Компания Google представила Gemini agent, универсального ИИ-сотрудника для компаний.
Об этом пишет глава Google Cloud Томас Куриан. Идея: ты поручаешь задачу, например «собери данные о продажах и подготовь презентацию», а агент сам планирует работу, использует корпоративные инструменты и при необходимости создаёт помощников. Он работает в облаке, сохраняет память между устройствами и может продолжать задачу после закрытия ноутбука. Анонс Google.

Самое интересное: ему можно выдать собственную рабочую почту, календарь и Google Drive, назначить роль аналитика или координатора и общаться с ним как с коллегой через письма, чаты и комментарии к документам. Доступ ограничивается предоставленными разрешениями. Под капотом агент умеет выбирать между моделями Gemini (в том числе Argon) и Claude.

Как бы всё что уже и так активно используют в работе, только теперь удобно, официально и масштабно🍎


Репост из: Вайб-кодинг


Репост из: Love. Death. Transformers.
Я чёт в слюни разьебался и закрыл твитер на сегодня.


Репост из: sh | ИИ
Как видим, Argon сегодня так и не вышел

Вечером у Google была презентация, где они снова похвастались циферками на бенчах и открыли доступ к модели ещё нескольким компаниям. Ну когда-нибудь и нам откроют!

Датамайнеры ждали выход вчера, на это указывало много чего. Но то ли Google перенесли релиз, то ли ещё что-то случилось, это ж Google, вы их знаете

Зато по коду Antigravity стало известно ещё кое-что. У модели, видимо, будет xhigh / max reasoning (сейчас на Artificial Analysis есть только high), контекстное окно в миллион токенов и подорожание после 256к и 500к контекста

Что ж, ждём дальше... когда-нибудь... выйдет...

*картинка шуточная, верхняя часть реальная, а нижней на презентации не было


Репост из: sh | ИИ
Заметил забавный баг (а может, и фичу?) с Codex

3 октября у меня закончилась подписка Pro 20x, а 6-го я решил взять GPT Plus. Все эти дни я удивлялся, почему на Plus такие большие лимиты))) Оказалось, что лимиты у меня как на Pro 20x до урезания, то есть почти как сейчас за $500, а ещё нет 5ч лимита

Видимо, дело в том, что во время перехода на новые лимиты (29–30 сентября) у меня была Pro 20x. Таким людям прошлые лимиты сохраняют до 29 октября, и похоже, это работает даже после смены тарифа на Plus. Я поресерчил Твиттер и нашёл ещё несколько человек с тем же самым, так что это не только у меня

Так что если у вас 29–30 сентября была Pro 20x и она уже закончилась или скоро закончится, можно её не продлевать. Просто берёте Plus и сидите с большими лимитами за $20 до конца октября, lol


Репост из: sh | ИИ
Вышла GPT 6.1 Sol Ultrafast для тех, кому надоело страдать на 25 TPS. Скорость доступна только на подписке за $500 и по API за $10/60, так что лимит будет уходить примерно как на Astra

Я померил скорость по API, выходит 200 TPS. Довольно быстро, но не прям чтобы вау, в мое время ультрафастом называли то что от 750 TPS и выше 🙂При этом Opus 5.5 Fast стоит $8/40 и выдает около 300 TPS, то есть быстрее и дешевле. Справедливости ради, Opus Fast отдают только по вайтлисту, в подписке его нет, да и по эффективности токенов он хуже

Забавно, что сами OpenAI называют Ultrafast в 8 раз быстрее обычной Sol. При 200 TPS это как раз восемь раз по 25, то есть они буквально признают, что базовая Sol выдает всего 25 TPS. Хотя по API выходит около 43 TPS, так что красивый множитель x8 они явно считали по скорости Codex. Короче, ускорять базовую модель теперь вряд ли будут. Не нравится скорость? Бери подписку за $500!


Репост из: ChillHouse
Достаточно интересная картинка выходит


Репост из: Psy Eyes


Репост из: LLM под капотом
Я мигрировал Personal OS с git repo на server-side RAG с песочницей

История экспериментов с Personal OS:

(1) первый эксперимент с Git+Obsidian - 8 февраля 2026
(2) Описание структуры Personal OS - 27 февраля
(3) сравнение с LLM Wiki Karpathy - 5 апреля
(4) субличность Марка - 23 Мая

Эксперимент 12. Yggdrasil

В Personal OS набралось полторы тысячи документов. Вчера я cнёс почти все из репы и перенес на сервер.

Новый сервер - это самописный файловый сервер с отслеживанием версий. Он выполняет почти все мои хотелки из прошлого (кроме типизированных документов, ибо больше не важно)

Основные различия по сравнению с git + Obsidian:
(1) не нужно чехарды с git командами при работе.
(2) в отличие от Notion и аналогов - изменения глобально версионированы (а не по файлам отдельно). Можно откатить изменение агента, даже если он поменял тысячу файлов в разных workspaces одновременно
(3) у всех участников поиск работает одинаково
(4) оно сразу заточено под одновременную работу нескольких человек с их агентами над общими материалами.

Под капотом - golang + SQLite + CAS + MCP API 2.0 + CLI (ставится сразу в системную папку для Codex-a) + Borg Backup на удаленный сервер.

Первые впечатления - стало проще работать с файлами. Можно отправить агента завести себе workspace, не задумываясь про git push/pull итп. И можно не держать в голове текущее состояние git папок при работе. Если агент сказал, что сохранил транскрипт разговора с выжимкой, значит он уже лежит там и доступен всем. Про конфликты от одновременной работы можно не беспокоиться, откаты изменений есть.

Но в минус - агенты находят документы быстрее, но стали дольше копошиться с их изменением. Оказывается, когда файлы лежат где-то там, их нельзя так просто взять и изменить.

У Sol 6.1 уходило 6 c половиной минут на то, чтобы отработать такой запрос:

> hey, capture that latest exchange with Aigiz into Bragi (continuing our last conversation)...

(Под капотом Марк должен подключиться к серверу, найти нужный workspace, понять принципы организации capture/distill/arks, подшить куда надо, немного перелопачивая файл на 70kb, собрать изменение и смерджить его)

Поэтому пришлось поставить ряд экспериментов в поиске tool calling интерфейса, который бы позволил кодексу решать эту RAG задачу быстрее.

Самое забавное, что этот интерфейс оказался питоном. Вместо того, чтобы тягать файлы c сервера туда-сюда (удачи со случаем, когда мы делаем replace по папке), агент пишет маленький скрипт, который отправляется на сервер и в изолированной песочнице работает с изменениями в рамках сессии там.

То есть не нужно мучаться с придумыванием оптимальных инструментов для MCP/API/CLI, когда можно сказать “писать питон вот сюда, вот тебе описание SDK”.

В итоге теперь аналогичная задача выполняется Sol 6.1 без лишних танцев с бубнами за три с половиной минуты. Причем половина времени тратится на RAG задачи, а вторая - на написание текста.

Заодно я смог выкинуть из MCP API и CLI все инструменты и команды кроме двух - start (начать новую сессию/commit и получить в контекст описание текущего SDK) и run (запустить питон на сервере).

В общем, если у вас у какой-то AI Native системы получается сложный интерфейс с кучей API-шек и инструментов - попробуйте просто дать агентам Python, благо инструментов для этого есть море, от jails до Firecracker VM.

Ваш, @llm_under_hood 🤗




Репост из: Метаверсище и ИИще
Пора вводить рубрику лайфхаки для ChatGPT.

Продуктовый дизайнер в OpenAI явно кодекс. И найти там что-то в настройках — это прям целый квест.

Ну, во-первых, как и обещали, раскатали GPT-6 в чате, не в ворке, а именно в чате, по крайней мере для плюсового плана.

Во-вторых, появилась мелкая, но приятная деталь. Теперь хоткей можно назначать не только с модификаторами Ctrl, Alt и так далее, а просто, например, F9, или, что самое удивительное, левый Shift, правый Shift. Например вы можете назначитьправый Shift для начала диктовки в любом месте Windows, не только в ChatGPT. Об этом я уже писал целый пост. Это жутко удобно. Нажали правый Shift, включается режим, грубо говоря, рации, вы наговариваете, и ChatGPT это транскрибирует и вставляет туда, откуда вы пришли в эту диктовку. Ну, например в телегу.

Есть маленькая засада. Вот этот режим на диктовке в любом месте Windows работает стабильно только когда у вас включена английская раскладка клавиатуры. У меня, когда выбрана русская раскладка клавиатуры, это в принципе не работает. Он либо не вставляет, либо вставляет буковку V. Было найдено экспериментальным путем после убийства Punto Switcher и обвинения разных других программ. Нет, это просто не работает, когда включен не английский язык для ввода с клавиатуры.

Но ChatGPT быстро мне написал скрипт для AutoHotkey, который просто переключается в английскую клавиатуру, потом включает режим рации, транскрибирует и переключается в тот язык, который был. Если вы используете AutoHotkey, это прям бомба софт.

В-третьих, в ChatGPT появился новый режим, называется Apps Snapshot. Наверное, многие уже сталкивались с такой задачей, что надо постоянно бросать скриншоты в ChatGPT. Теперь, по идее, это делается в любом месте. Вы нажимаете два Altа или два Shiftа, и скриншот экрана сразу летит в ChatGPT и вставляется в строку ввода.

Одна проблема. Это работает криво. Скриншот-то снимается, в ChatGPT залетает, но только не в текущий чат, как выбрано в настройках у меня, например, а всегда в новый чат и всегда почему-то не в режим чата, а в режим ворк. Это официальный баг, он уже задокументирован. Я жду апдейта. Ну, опять же, пока ChatGPT мне быстренько написал нужный скрипт для AutoHotkey, который я вообще назначил на боковую кнопку мыши. Он снимает скриншот, переключается в ChatGPT и вставляет туда этот скриншот. Так что либо ждите апдейта, либо можете попросить ChatGPT написать такой скриптик.

@cgevent

Показано 20 последних публикаций.