AI SETI - НЕЙРОСЕТИ, ИИ


Channel's geo and language: Russia, Russian
Category: not specified


Нейросети и способы заработка на них.
ЧАТ: https://t.me/+k0bRDnQ_PZUwNTk6
-
Сотрудничество: @vp_adm_bot

Related channels  |  Similar channels

Channel's geo and language
Russia, Russian
Statistics
Posts filter


Ideogram 4.5 научилась нормально редактировать одну картинку много раз подряд

Ideogram выпустила 4.5. Главный упор теперь не только на генерацию картинок с текстом, а на последовательное редактирование одного изображения без постепенного разрушения деталей.

У модели появилось два режима редактирования. Precise Edit меняет только нужную часть изображения и старается сохранить всё остальное без изменений. Обычный режим 4.5 может сильнее перестраивать исходную картинку.

Модель оптимизирована под такие цепочки правок, чтобы после каждого шага изображение не начинало заметно плыть.

Ideogram 4.5 умеет менять надписи прямо внутри готового дизайна, переводить их на другой язык с сохранением оформления, перекрашивать предметы, менять свет вместе с тенями и отражениями, переставлять мебель или отделку в фотографии комнаты.

Модель поддерживает генерацию и редактирование до 2K, маски и несколько референсных изображений.

Модель уже доступна в Ideogram, API и сервисах партнеров.


Video is unavailable for watching
Show in Telegram
GTA 5 запустили прямо в браузере — фанаты серии портировали игру в веб-версию.

Доступны песочница и сюжетный режим, так что всю кампанию теперь можно полноценно пройти в браузере.

Тестим прямо на рабочем месте — тут.


Video is unavailable for watching
Show in Telegram
Cursor научился строить графики и диаграммы прямо в чате

В Cursor появился /visualize. Команда позволяет отдать агенту данные и получить визуализацию результата прямо во время диалога.

Можно попросить проанализировать данные, сравнить показатели или показать связи между компонентами проекта. Вместо таблицы или длинного текстового ответа Cursor может собрать график или диаграмму. Функция уже доступна в Agents Window.


Video is unavailable for watching
Show in Telegram
HeyGen выпустила свою первую модель генерации видео

Она умеет генерировать видео по текстовому описанию, оживлять изображение и брать другое видео за образец для движения, композиции или визуального стиля. Звук создается сразу вместе с роликом, включая речь, фон и эффекты.

Под капотом MiniMax H3 и дополнительно обучена самой HeyGen. Можно создавать ролики длиной от 5 до 15 секунд в 480p или 768p и выбирать разные форматы кадра от широкого 21 на 9 до вертикального 9 на 16.

HeyGen также провела слепое сравнение с Seedance 2.5, Seedance 2.0, H3 Max и Kling 3.0. По данным компании, HeyGen Video заняла первое место по качеству после 4800 голосов.

Обычная стоимость генерации в 768p составляет $0.03 за секунду, а до конца октября действует скидка 50%. Видео по тексту или изображению сейчас стоит от $0.015 за секунду в 768p и от $0.01 в 480p.

Сейчас HeyGen Video доступна через API, OpenRouter, Runware и ComfyUI. В веб-версии HeyGen модель появится позже.


ElevenLabs выпустила Eleven v4

ElevenLabs представила новое поколение моделей синтеза речи Eleven v4 и v4 Turbo. Компания полностью поменяла архитектуру и сделала упор на актерскую подачу, эмоции и управление голосом прямо из текста.

Модель понимает контекст сцены, интонацию и роль каждого персонажа. В текст можно вставлять команды вроде [whispers], [laughs] или [shouts], а также звуковые события. v4 лучше удерживает такие инструкции и естественнее переключается между несколькими говорящими.

Сильно улучшили клонирование голосов. Instant Voice Clone можно сделать из короткого образца записи, а Professional Voice Clone точнее сохраняет тембр, манеру речи, громкость и акцент оригинального человека.

Есть две версии модели. Обычная Eleven v4 рассчитана на озвучку видео, аудиокниги, рекламу и персонажей. Eleven v4 Turbo предназначена для голосовых агентов и других сценариев в реальном времени, где важна минимальная задержка.

Eleven v4 и v4 Turbo уже доступны в ElevenCreative, ElevenAgents и через API.


Anthropic запустила отдельный сайт для разработчиков Claude

Claude.dev стал новым хабом с материалами от команд, которые сами создают Claude и Claude Code.

Там публикуют технические разборы, руководства по Claude Code и API, практические советы по работе с агентами, промптами и контекстом. Уже есть материалы о том, как Anthropic использует Skills, устроено кеширование промптов и как команда ускорила claude.ai примерно в три раза за две недели.

По сути, это отдельная техническая база знаний для тех, кто строит продукты и автоматизации на Claude. Материалы пишут сами инженеры Anthropic, а не сторонние авторы.


Вышел Grok 4.7 и его сильно прокачали в кодинге

SpaceXAI выпустила Grok 4.7, новую флагманскую модель для программирования и сложной интеллектуальной работы. Она получила более крупную базовую модель и дольше обучалась с подкреплением на задачах, которые могут занимать у агента несколько часов.

На CursorBench 4.0 результат вырос с 40,4% у Grok 4.6 до 46,3%. На Terminal-Bench 4.0 рост еще заметнее, с 20,3% до 38%. В тесте по электротехнике EEBench модель набрала 64%, против 53% у предыдущей версии.

Отдельный упор сделали на длинные агентные задачи. Grok 4.7 лучше проверяет собственную работу, дольше удерживает контекст и обучен работать непосредственно с агентной средой Grok Bot. Также улучшилась генерация документов и презентаций.

При этом цена относительно Grok 4.6 не изменилась. API стоит от $2 за миллион входных токенов и $6 за миллион выходных. Есть ускоренная версия с удвоенной скоростью генерации и удвоенной ценой.

Grok 4.7 доступен через API, Cursor, Grok Build, сторонние инструменты и облачны


Video is unavailable for watching
Show in Telegram
Google заменяет Gems на Skills в Gemini

Теперь в Gemini можно один раз сохранить набор инструкций для повторяющейся задачи и запускать его командой через /. Например, сделать отдельный навык для подготовки презентаций, текстов в нужном стиле или проверки идей с нескольких точек зрения.

Skills можно комбинировать между собой. К примеру, одновременно подключить навык с вашим стилем письма и навык с правилами бренда. К ним также разрешили прикладывать текстовые файлы, PDF и изображения.

Gemini умеет создавать такие навыки прямо из текущего чата и автоматически применять их, когда запрос подходит под сохраненный сценарий.

Функция уже появляется в Gemini по всему миру. В ближайшие недели она также придет пользователям Google Workspace.

При этом Google постепенно откажется от Gems. Для личных аккаунтов поддержку начнут отключать с ноября 2026 года, для бизнеса и некоммерческих организаций в Workspace с марта 2027 года, для образовательных аккаунтов с июня 2027 года.

Существующие Gems Google обещает автоматиче


Video is unavailable for watching
Show in Telegram
У Seedance появился достойный соперник — Kling 4.0

Kling 4.0 выйдет уже в октябре, а Flash-версию начали открывать для пользователей Ultra Yearly.

Главное обновление это генерация роликов до 30 секунд за один раз и управление сценой через 10 ключевых кадров. Можно точнее задавать развитие действия и собирать длинные сцены без нарезки на отдельные генерации.

Видео получат вывод до 4K, 10-bit HDR, стереозвук, более стабильное движение и улучшенный липсинк. Omni Reference расширят до 15 мультимодальных референсов, чтобы удерживать персонажей, объекты и стиль между сценами.

Также появятся продление видео, поддержка разных языков, акцентов и диалектов.


Black Forest Labs выпустила FLUX 3 Image

Можно заранее задать зоны для объектов и описать, что должно находиться в каждой. FLUX получает координаты этих блоков и старается разместить элементы именно там, а не интерпретировать расположение по обычному текстовому промпту.

Достаточно описать сцену одной фразой, после чего отдельная LLM сама составляет макет с координатами объектов. Получившиеся блоки можно передвигать перед генерацией.

Модель поддерживает до 10 референсных изображений. Можно отдельно передать одежду, обувь, человека и фон, а FLUX соберёт их в одну композицию и сам определит масштаб и положение каждого элемента.

Есть и точечное редактирование. Выделяешь конкретную область, меняешь объект, цвет или описание, а остальная часть изображения должна сохраняться без перерисовки.

FLUX 3 Image генерирует изображения нативно в 2K и 4K. В демонстрации BFL показан кадр 5456 × 3072 пикселей.

Модель уже доступна через Playground и API Black Forest Labs.


Xiaomi показала настольную лампу Mijia Desk Lamp 2 Clear View Edition

Лампа использует мягкий свет, имитирующий естественное освещение, а шарнир позволяет менять угол наклона. В приложении можно включить напоминания о перерывах.
Есть 6 режимов для разных задач.

Продажи стартовали 22 сентября.

Купить можно тут

Купон на 6$: AFS6


Claude Code теперь можно переделывать под себя

Anthropic запустила Mods для Claude Code. Это небольшие модули на JavaScript или TypeScript, которые могут вмешиваться почти в любое действие агента и менять его поведение прямо во время работы.

Mod подключается к событиям Claude Code. Он может перехватить вызов инструмента, изменить команду перед выполнением, запретить опасное действие, автоматически одобрить разрешение или удалить секреты из вывода до того, как их увидит модель.

Менять можно и сам интерфейс. Например, добавить панель рядом с диалогом, кнопки, поля ввода или строку над промптом. В примере Anthropic Token Weather показывает заполненность контекстного окна и обновляется после каждого хода.

Причём писать всё вручную необязательно. Можно просто попросить Claude Code создать нужный Mod. Он сам пишет код, устанавливает его и умеет перезагружать изменения прямо в текущей сессии.

Часть возможностей самого Claude Code уже построена таким способом. Например, поддержка AGENTS.md и встроенный просмотр изменений через /diff реализованы как Mods, а их исходники опубликованы.

Получается что-то вроде расширений для браузера, только для ИИ агента. Можно не ждать, пока Anthropic добавит нужную функцию, а встроить её самостоятельно прямо внутрь Claude Code.

Mods работают в Claude Code 2.1.287 и новее и включены по умолчанию. При этом ставить чужие модули стоит осторожно, поскольку они получают серьёзный доступ к среде Claude Code.

Список проверенных модулей тут.


Креативная смена одежды в Seedance 2.5

Промт в комментариях


Video is unavailable for watching
Show in Telegram
Suno запустила Speech Beta, отдельную модель для создания озвучки

Она генерирует голос и фоновую музыку сразу как единый аудиотрек, а не склеивает их по отдельности.

Можно вставить свой текст, стихотворение или просто описать идею, затем задать желаемый голос и музыкальный стиль. На выходе получится готовая озвученная композиция с автоматически созданным саундтреком.

Например, так можно делать аудиосказки под пианино, мотивационные речи под эпичную музыку, медитации, озвученные стихи или даже обычные голосовые сообщения с кинематографическим саундтреком.

Пока функция находится в бете. Suno предупреждает, что акценты и паузы иногда работают нестабильно.

Speech уже доступна всем пользователям на вебе и в мобильных приложениях.


Узнаём, что жрёт место на диске — нашли опенсорсную тулзу DiskTree для Linux. Её сделал основатель и CEO Shopify Тоби Лютке

Программа сканирует файлы и превращает их в интерактивную карту: чем больше блок, тем больше места он занимает. Можно зумить отдельные участки и быстро находить кэши и другие пожиратели диска.

Удаление тоже удобное: выбираете файлы прямо на карте, а DiskTree показывает, сколько места освободится.

Очищаем комп тут.


Dream — генерирует картины по текстовому запросу.

Сервис предназначен для создания уникальных обоев для смартфона, но в соцсетях его применяют для иллюстраций к книгам, комиксам и диссертациям.

Для генерации картинки достаточно ввести короткое описание на английском, выбрать один из стилей (или пункт «без определённого стиля») и нажать кнопку «Создать». Весь процесс занимает всего пару минут, после чего готовое изображение выводится на отдельной странице в стилизованной рамке.


Figma Weave — генератор всего на свете.

В приложение завезли возможность создавать рабочие доски для генерации картинок, видео, 3D-моделей и многого другого

Работает почти как ComfyUI, но только онлайн — круто!


AutoDraw — генерирует рисунок из каракулей

Искусственный интеллект и машинное обучение помогают превратить неаккуратные наброски в чёткие прорисованные изображения. Пользователю достаточно нарисовать несколько линий на холсте, чтобы алгоритм подсказал запланированный рисунок. Искусственный интеллект сравнивает изображения из обширной базы данных и выбирает подходящие варианты.


Video is unavailable for watching
Show in Telegram
Casberry — позволяет создавать визуальные 3D-эффекты в пару кликов.

— Выбираем фигуру, закидываем свою 3D-модель или генерим простым промтом;
— Настраиваем ползунки частиц, геометрии и освещения;
— Получаем готовый код под React или Three.js, который можно вставить в фронт любого сайта или приложения;
— Если лень заморачиваться — есть готовая библиотека стильных эффектов;
— Бесплатно и даже без регистрации.


У GPT-6 Astra обнаружился скрытый мега-режим — для этого нужно сказать, что… Claude справится лучше.

В соцсетях пишут, что это позволяет работать быстрее в 3 раза и выполнять даже те задачи, с которыми модель обычно не справляется.

Промты, которые мы заслужили.

20 last posts shown.