Bard AI | Нейросети & IT


Гео и язык канала: Россия, Русский
Категория: Технологии


Самое вкусное из мира нейросетей и IT.
Сотрудничество: @devmangx
Менеджер: @Spiral_Yuri, @neiromanager
РКН: clck.ru/3GKAXL

Зарегистрирован в РКН
Связанные каналы  |  Похожие каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


В ChatGPT появится реклама прямо во время генерации картинок

OpenAI запускает новый рекламный формат: объявления будут показывать пока пользователь ждёт, когда нейронка дорисует изображение.

Тестирование начнётся в октябре в США. В компании обещают, что реклама останется отдельно от ответов ChatGPT и никак не будет влиять на результат генерации.

Заодно рекламодателям дадут больше аналитики: можно будет отслеживать покупки и регистрации после показа объявления и оценивать, сколько дополнительных продаж принесла реклама.

📢 Bard & Gemini


Видео недоступно для предпросмотра
Смотреть в Telegram
Anthropic добавила в Claude Code агента, который следит за другим агентом

Новая фича называется You Should Know и работает как дополнительная пара глаз во время разработки.

Плагин запускает отдельного агента, который наблюдает за работой и подсвечивает то, что могли пропустить и Claude, и сам разработчик: ошибки, подозрительные решения и важные детали.

Включается одной командой: /plugin enable cc-plugin-you-should-know@builtin

📢 Bard & Gemini


Google прикрывает халяву: лучшие модели Gemini уходят за подписку

С 9 октября бесплатным пользователям оставят только Flash-Lite.

Хотите обычный Flash — $4,99/месяц за AI Plus.
Хотите Pro — $19,99/месяц за AI Pro.

📢 Bard & Gemini


GPT-6.1 Astra или другая мощная модель OpenAI может выйти уже на следующей неделе

На новый релиз активно намекают Тибо Соттио и другие разработчики OpenAI. Сам Тибо в одном из ответов прямо написал: «Вы не знаете, что мы выпускаем на следующей неделе».

Что именно готовят, пока неизвестно.

📢 Bard & Gemini


Tavus представила Griffin модель для видеодиалогов, которая генерирует лицо и голос в реальном времени и при этом постоянно следит за собеседником.

Даже когда Griffin говорит сама, она продолжает видеть и слышать человека и каждые доли секунды решает: говорить дальше, замолчать, кивнуть, поддакнуть или перебить. Для теста людей отправляли на минутный видеозвонок, якобы с другим участником. На самом деле их собеседником была Griffin-Lite.

Результат: 26 из 54 человек 48% решили, что разговаривали с настоящим человеком. У предыдущей модели Tavus таких было всего 2,4%.

📢 Bard & Gemini


ChatGPT может создать вам логотип.

А теперь ещё и перевести его в вектор. Прямо в чате. Для этого сделали плагин: Vectorize

📢 Bard & Gemini


Шварценеггер предложил Figure расплавить старых роботов

Figure выводит из эксплуатации поколение Figure 02 после появления Figure 03. Когда выяснилось, что вручную разбирать весь парк слишком долго, глава компании спросил подписчиков, как от него избавиться.

В комментарии пришёл сам Арнольд Шварценеггер и предложил просто их расплавить. Дальше шутка вышла из-под контроля.

Роботов отправили в Финляндию, где они сами шагнули в расплавленную сталь и показали большой палец, практически покадрово повторив финал «Терминатора 2».

Hasta la vista, железяки 💪

📢 Bard & Gemini


Полезное для вайбкодеров: визуальный конструктор дизайн-систем для AI-агентов

Выбираете цвета, шрифты, кнопки, скругления и другие параметры или стартуете с готового пресета.

Initium превращает результат в DESIGN.md и STRATEGY.md, которые затем можно передать агенту, чтобы тот генерировал UI в едином стиле проекта.

Пробуем тут.

📢 Bard & Gemini


Google представила Gemini 4 Argon, ещё один монстр залетает в гонку флагманов

Это новый флагман Gemini с упором на кодинг и автономных AI-агентов. Google заявляет сильные результаты в своих тестах на программирование, длинный контекст, исследования и cybersecurity.

А теперь самое вкусное: $2 / $10 за миллион токенов + скидка 95% на кэш. Правда, праздник временный, позже базовый тариф планируют поднять до $4/$20.

📢 Bard & Gemini


Видео недоступно для предпросмотра
Смотреть в Telegram
OpenAI сделала из ChatGPT настоящего персонального ассистента

Встречаем «dots», это AI-помощники, которые живут прямо внутри ChatGPT и работают на персональных агентах Astra в облаке.

Dot запоминает контекст и приоритеты, ищет информацию, выполняет задачи и может работать, пока вы занимаетесь своими делами. Общаться с ним можно текстом или голосом, а ещё писать ему SMS и звонить как обычному человеку.

📢 Bard & Gemini


OpenAI выкатила GPT-6.1 Sol миллион токенов контекста и ещё больше автономности

Главный акцент обновления, кодинг и агентные задачи. Модель получила контекст на 1,05 млн токенов, умеет работать с браузером и компьютером, подключать MCP и Skills, запускать код и разбираться с файлами.

Отдельно OpenAI заметно прокачала возможности модели в cybersecurity и сложных задачах, где агенту приходится долго работать самостоятельно.

В API ценник $2/$10 за миллион входных/выходных токенов.

📢 Bard & Gemini


Что, если заменить аналитиков нейросетью?

Да ничего хорошего: результаты анализа получаются слишком общими, и половину работы потом всё равно приходится переделывать руками.

Хард-скилы дешевеют — SQL-запрос или кусок кода теперь может сгенерировать почти кто угодно. А вот доменная экспертиза и умение работать с агентом становятся ценнее: правильно задать вопрос, собрать контекст, проверить, что результат не искажён.

Три аналитика Авито на конкретных примерах рассказывают, как работает тандем аналитик + AI. Делятся кейсами:

➡️ как перенесли 200 витрин за полгода;
➡️ автоматизировали проверку работы сотрудников;
➡️ научили LLM анализировать метрики.

Подробнее в ролике:
📺 YouTube
🔵 ВК

Больше честных историй о работе аналитиков Авито — в «Коммуналке аналитиков».


Дженсен Хуанг признался, что не знает наизусть свой адрес и номер телефона

Глава Nvidia рассказал об этом, когда его спросили, не переживает ли он, что из-за развития ИИ школьники начнут терять базовые навыки - например, перестанут считать в уме или писать самостоятельно.

Хуанг сказал, что сам давно полагается на технологии и не видит в этом особой проблемы:

«А разве это имеет значение?»


📢 Bard & Gemini




Google на пять месяцев устроила AI-агента на настоящую работу. Коллеги в итоге начали прятаться от него в отдельных чатах

Агент работал в 20+ командах, читал документы, создавал баги и задачи, писал сотрудникам и участвовал в обсуждениях.

Технически помогал, но совершенно не чувствовал офисный контекст и негласные правила: путал актуальную и старую информацию, создавал лишнюю работу и периодически вмешивался туда, куда не стоило.

Пять месяцев понадобилось AI, чтобы освоить главное достижение корпоративной культуры - чат, где обсуждают коллегу без коллеги.

https://arxiv.org/html/2609.29901

📢 Bard & Gemini


Видео недоступно для предпросмотра
Смотреть в Telegram
Робот 140 лет играл в футбол против самого себя в симуляции. Теперь забивает голы людям в реальной жизни

Стартап Skild AI решил обучить своего гуманоидного робота по принципу self-play, похожий подход использовали Google при разработке AlphaGo.

Сначала модель S1 обучили базовым ударам и дриблингу, а затем отправили играть против предыдущих версий самой себя. За 140 симуляционных лет робот самостоятельно освоил обводки, перехваты, прикрывание мяча корпусом и новые способы бить по воротам.

Самое интересное: за отдельные футбольные приёмы его не награждали. Единственной целью было забить гол. Чтобы добиться этого, модель сама находила полезные тактики и движения.

В предварительных матчах с четырьмя агентами уже появляются пасы и командная координация. При этом модель 50 раз в секунду рассчитывает движения каждого сустава робота.

По сути, self-play превращается в учебную программу, которая усложняется сама по мере развития агента. В Skild AI рассчитывают перенести этот подход и на другие физические задачи, где можно задать цель и создать симулятор.

📢 Bard & Gemini


Учим любого AI-агента тратить меньше токенов одним промптом, разработчики Cursor поделились своими кейсами.

Внутри сразу несколько оптимизаций: более строгие инструкции, выборочная загрузка инструментов, улучшенное кэширование и более компактное чтение файлов. Всё это нужно, чтобы агент меньше забивал контекст и мог дольше работать над задачей без лишних затрат токенов.

Сам промпт получился огромным, поэтому вынесли его отдельно - забираем здесь.

А для тех, кому интересно разобраться, почему это вообще работает, у Cursor есть отдельный технический разбор - читаем тут.

📢 Bard & Gemini




Видео недоступно для предпросмотра
Смотреть в Telegram
BFL научила FLUX управлять роботами, вышла FLUX 3 Action

Black Forest Labs дообучила основу своей видеомодели на данных с реальных роботов: видео с камер синхронизировали с положением суставов и выполняемыми действиями. В результате 7B-модель одновременно учится предсказывать будущее видео и движения робота.

На вход она получает текстовую задачу, текущие кадры и состояние робота, а на выходе генерирует команды для суставов и захвата вместе с визуальным прогнозом результата. Робот выполняет часть действий, получает новые кадры - и цикл повторяется.

На симуляционном RoboLab-120 авторы заявляют 42,9% успешных выполнений против 36,8% у 16B Cosmos 3 Nano. Для переноса на конкретного робота модель всё ещё нужно дообучать.

Веса доступны под FLUX Community License, код Apache 2.0.

Техрепорт · Веса · Код

📢 Bard & Gemini


Один навык Claude Code, который нужен для создания таких видео.

Он анализирует ваш репозиторий и за один запуск собирает полноценный промо-ролик с анимированной графикой, звуковым оформлением и текстом для запуска.

https://github.com/latent-spaces/brag

📢 Bard & Gemini

Показано 20 последних публикаций.