Проще с AI 💡 Практические решения для бизнеса, госзакупок и повседневных задач.


Гео и язык канала: Россия, Русский
Категория: Технологии


Блог о практическом применении ИИ для жизни и работы. Испытанные решения, которые помогают оптимизировать задачи, развиваться и упрощать повседневные дела.
Запись на частные консультации @lexelence

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


Claude поселился прямо в Google Документах 🤯

Теперь нейросеть работает в боковой панели Docs, Sheets и Slides. И даже сама запускает Python для сложного анализа данных.

⚡ Что умеет новая фича:

📄 В Docs: правит выделенные куски текста, меняет тон и исправляет ошибки без пересборки всего документа.

📊 В Sheets: пишет формулы, строит сводные таблицы, чистит данные и генерит диаграммы. Для сложной обработки подключит Python и вернёт результат обратно в таблицу.

🎨 В Slides: верстает слайды в стиле текущей темы и сам ищет косяки — съехавшие элементы или нечитаемый текст.

🤖 Работать можно и в обратную сторону: создавать файлы Google прямо из чата Claude. По умолчанию ИИ просит подтверждать каждое действие, но можно врубить автопилот, чтобы он всё сделал сам.

🔥 Функция уже доступна в открытом тестировании для пользователей платных тарифов Claude.

Будешь юзать в работе или обычного чата хватает?

⚡ Понравился пост? Поставь 🔥!


Google выкатила EmbeddingGemma 2 для локального поиска по видео и коду 🔥

Пишешь текстовый запрос — и моментально находишь нужный кадр в видео или фрагмент в аудио. И всё это обрабатывается прямо на устройстве без отправки в облако.

⚡ Google выпустила EmbeddingGemma 2 — локальную модель, которая объединяет текст, код, изображения, видео и аудио в единое пространство числовых представлений. Никаких предварительных расшифровок файлов делать больше не нужно.

🧩 Главный плюс — модульная архитектура. Полная версия содержит 740 млн параметров, но лишние блоки можно не грузить. Текст и код требуют 270 млн параметров, связка с изображениями — 440 млн, а с аудио — 570 млн. На Pixel 11 Pro текстовый вариант занимает около 191 МБ активной памяти, а полный мультимодальный — около 567 МБ.

📊 И ещё пару важных цифр:
— Контекст для текста вырос до 8192 токенов
— Поиск в коде вырос на 14% по сравнению с EmbeddingGemma первого поколения
— Сжатие векторов с 768 до 128 измерений уменьшает объём индекса до шести раз

🔓 Всё открыто под лицензией Apache 2.0. Интеграция уже работает из коробки в Ollama, LM Studio, vLLM, MLX, Transformers и sentence-transformers.

Опробуешь поиск на смартфонах или локально на ПК?

✨ Узнал что-то новое?


Google выкатила Nano Banana 2.1 — ИИ-генератор и фотошоп 2-в-1 🎨

Детализация стала лучше, качество не портится при правках, а ценник упал в 2 раза. Google мощно вернулась в гонку визуала.

⚡️ Новая Nano Banana 2.1 умеет не просто генерить визуал с нуля, но и работать как полноценный фоторедактор. Главный плюс — картинка больше не «шакалится», сколько бы изменений ты ни вносил.

💰 И приятное: модель стала в два раза дешевле предшественницы, так что кошелёк скажет спасибо.

Оценить обнову можно в AI Studio.

Будешь тестировать или остаёшься на привычных сервисах?

💬 Есть вопросы? Пиши в комментарии!


Mistral представила Large 4 оказалась сильнее закрытых флагманов 🇪🇺

1 трлн параметров под капотом, но благодаря архитектуре MoE на каждый запрос уходит всего 49 млрд. Модель с кодовым именем Le Chonk изначльно мультимодальная и спокойно разбирает и текст, и картинки.

🔥 По совокупности бенчмарков это лучшая модель с открытыми весами из США и Европы. В распознавании изображений она обходит некоторые закрытые флагманские сетки, а отдельно хороша в задачах финансов, производства и кибербеза.

🛡 И главное для многих: весь цикл разработки и инфраструктура находятся строго в Европе.

⚡ Опробовать Large 4 уже можно через API и Mistral Cloud. Открытые веса обещали выложить в конце октября, а блок кибербезопасности пока тестируют с партнёрами в закрытом режиме.

Сможет европейский опенсорс составить реальную конкуренцию закрытым гигантам?

💬 Есть вопросы? Пиши в комментарии!


Видео недоступно для предпросмотра
Смотреть в Telegram
Двойные стандарты больше не работают 🔄

📢 Поделись с друзьями!


Claude оказался в 5 раз выгоднее ChatGPT 🔥

SemiAnalysis подсчитали объём токенов в подписках — и OpenAI жёстко проигрывает. Anthropic отсыпает в 5 раз больше вычислений за те же деньги.

📊 Аналитики сравнили стоимость ресурсов по API:
— Claude Opus 5.5 выдаёт в 5 раз больше вычислительных ресурсов, чем GPT-6.1 Sol на аналогичном тарифе.
— OpenAI затягивает пояса: подписку за $200 сократили вдвое. Новичкам срезали сразу, а для старых пользователей лимиты упадут 29 октября.
— Новый тариф за $500 даёт всего на 21% больше ресурсов для GPT-6 Astra, чем прежняя подписка за $200.

💰 Подписки приносят Anthropic около 10% выручки, но сжигают более 40% всех мощностей. Компании фактически продают доступ ниже рынка. Правда, у Claude есть 5-часовое ограничение, так что весь месячный объём выжать не всегда выйдет. Разбор читатель найдёт Исследование SemiAnalysis.

Платишь за ChatGPT или пора переходить на Claude? 🤔

💬 Есть вопросы? Пиши в комментарии!


Видео недоступно для предпросмотра
Смотреть в Telegram
AI-агент теперь сам монтирует видео по текстовому описанию 🎬

Описываешь ролик текстом — и нейросеть собирает готовый видеоряд. Попробовать инструмент можно в HyperFrames StudioHyperFrames Studio.

🛠 Результат легко докрутить: хочешь — правь вручную, хочешь — давай новые указания агенту. Можно прямо обвести объект на кадре, оставить коммент и отправить на доработку. Не охота писать промпты? Просто кликаешь на текст или картинку и меняешь цвет, шрифт или медиа руками.

📂 Прошлые проекты легко использовать повторно: упоминаешь нужный исходник в запросе, и ИИ всё подтянет. Или просто импортируешь папку HyperFrames и продолжаешь с того же места.

🎨 Внутри завезли кучу готовых элементов: титры, переходы, эффекты, анимации, графики, интерфейсы и даже 3D-сцены.

💻 Редактор уже работает как отдельное приложение на macOS и Linux, а релиз для Windows будет совсем скоро.

Готовый ИИ-монтажёр — топовая тема или пока баловство?

👍 Ставь лайк, если интересно!


Расшифровка речи за 100 мс: Microsoft выкатила новинку ⚡

Текст появляется прямо во время разговора, и ждать паузы больше не нужно. Майки выпустили мощный инструмент для работы со звуком.

🎙 Новая MAI-Transcribe-2-Streaming расшифровывает 60 языков в реальном времени и сама их определяет. На тестах Artificial Analysis модель заняла первое место по точности как промежуточной, так и финальной расшифровки. Первые варианты выдаёт всего за 100 мс, а слова появляются примерно в два раза быстрее ближайшего конкурента. Для голосовых агентов — просто находка.

🔊 Заодно представили генерацию речи: MAI-Voice-2.1 на 23 языках и быструю MAI-Voice-2.1-Flash. Последняя выдаёт 45 секунд аудио с задержкой всего около 150 мс.

💰 До конца года ценник держится на уровне $0.54 за час аудио. Опробовать модель можно доступна через Microsoft Foundry и MAI Playground.

Голосовые агенты теперь реально заменят кол-центры?

🔥 Полезно? Жми огонь!


DeepSeek выпустили десктопный Harness для macOS и Windows 🔥

Это открытый аналог Claude Code и Codex, который превращает модели компании в автономных ИИ-агентов.

💻 Чем полезен софт:
— Пишет и тестирует код без постоянных подсказок
— Работает напрямую с файлами и терминалом
— Справляется с долгими и сложными задачами
— Поддерживает плагины, так что инструмент легко настроить под себя

Забрать программу и почитать все подробности можно тут.

Будешь тестировать или остаёшься на Claude?

📢 Поделись с друзьями!


Бесшумный ввод: Lipflow читает текст по губам через камеру 🤫

Диктовать сообщения в людных местах и не издавать ни звука — теперь реальность. Эми создала инструмент, который понимает тебя без слов.

💡 Все началось с желания наговаривать текст так, чтобы окружающие ничего не слышали. В итоге она навайбкодила Lipflow сделала — сервис, распознающий речь по губам через обычную камеру.

⏱ При первом запуске программа около 8 минут учится на лице юзера, подстраиваясь под мимику. Вся расшифровка идет через локальную нейронку, так что данные не улетают на сторонние сервера.

📥 Попробовать инструмент в деле и бесплатно скачать можно здесь.

Протестируешь бесшумную диктовку или печатать руками надежнее?

🎯 Пригодится в работе?


Ideogram 4.5 не портит качество даже после десятка правок 🎨

Экс-разработчики из Google выкатили нейросеть Ideogram 4.5. И это буквально полноценный ИИ-фотошоп без привычных косяков.

🔥 Главный плюс — точечное редактирование. Модель меняет только тот объект, на который ты укажешь, а остальную часть кадра вообще не трогает. В отличие от GPT Image и Nano Banana, исходная чёткость картинки сохраняется даже после серии глубоких изменений.

✨ Что умеет Ideogram 4.5:
— Перекрашивать и подменять любые предметы
— Настраивать реалистичный свет и тени
— Аккуратно удалять или добавлять надписи
— Пошагово реставрировать архивные фото

💡 Погонять генератор уже можно на сайте Ideogram, а чуть позже разработчики обещали выложить модель в опенсорс.

Попробуешь затестить или привычный софт всё равно надежнее?

💡 А ты уже пробовал?


FLUX 3 Image генерит 4K с точной расстановкой объектов 🎨

10 референсов в один кадр и полный контроль над координатами. Black Forest Labs выпустила выкатила FLUX 3 Image.

📐 Точный макет. Теперь можно заставлять нейросеть ставить объекты строго на свои места. Встроенная LLM сама переводит описание в блоки с координатами, а ты можешь двигать их перед генерацией.

👗 Сборка из 10 референсов. Передаёшь отдельно одежду, обувь, персонажа и фон — модель сама соберёт всё в одну сцену и подгонит масштаб каждого элемента.

🔍 Нативные 2K и 4K. Картинка создаётся сразу в высоком разрешении без апскейла. На демо показали кадр 5456 × 3072 пикселей (около 16,8 Мп) с чёткими мелкими деталями. Точечное редактирование тоже прокачали — меняй нужную область без перерисовки остальных частей.

⚡️ Модель уже доступна в Playground и через API Black Forest Labs.

Будешь тестить такой контроль над кадром?

🎯 Пригодится в работе?


Видео недоступно для предпросмотра
Смотреть в Telegram
Google меняет Gems на Skills в Gemini ⚡

Повторяющиеся задачи в Gemini теперь можно упаковать в быстрые навыки и вызывать через слэш /. Причём их разрешили комбинировать между собой.

💡 Главные фишки обновления:
— Инструкции для стилей письма или проверки идей создаются прямо из текущего чата
— К навыкам можно прикреплять PDF, картинки и текстовые файлы
— Gemini умеет сам применять их, когда запрос подходит под сценарий

📅 Старые Gems уходят в прошлое. Для личных аккаунтов отключение начнётся с ноября 2026 года, бизнес и Workspace отключат с марта 2027 года, а образовательные профили — с июня 2027 года. Все наработки Google обещает перенести автоматически.

🌍 Инструмент уже появляется в Gemini по всему миру, а в Google Workspace приедет в ближайшие недели.

Пользуешься готовыми инструкциями или каждый раз пишешь промпт заново?

⚡ Понравился пост? Поставь 🔥!


Gemini 4 Argon поставила рекорд в бенчмарках ⚡

91,9% в Vibe Code и 77,9% в DeepSWE v1.1. Google выпустили флагманскую Gemini 4 Argon, и цифры выглядят действительно мощно.

🎯 Модель заточили под хардкорные задачи, огромный контекст, бизнес и кибербезопасность. В тестах она обходит или идет наравне с Astra и Fable.

🔒 Правда, прямо сейчас Argon дают пощупать только исследователям по кибербезу. Но массовый релиз обещают уже скоро.

Ждём открытый доступ или Astra пока хватает?

💬 Есть вопросы? Пиши в комментарии!


GPT-6.1 Sol и агенты dots: главное с OpenAI DevDay 🔥

OpenAI провела DevDay и привезла больше двадцати новинок. Выбрал самые интересные штуки, которые реально меняют работу.

🤖 Агенты dots — теперь ИИ работает фоном. У каждого бота есть облачный ПК, браузер и доступ к 4000+ сервисов через Slack, Teams и ChatGPT. Dot сам ищет задачи: например, заметит невыставленный счёт и подточит черновик. Первый dot уже входит в Pro и Business без доплаты. Но на старте есть баги с доступами и вылетами, так что важные задачи пока лучше проверять.

👥 ChatGPT Space — общее пространство для команды, где чат можно на лету превратить в рабочую страницу или презентацию.

⚡ Модель GPT-6.1 Sol — в коде практически догнала Astra, но обходится в 5 раз дешевле ($2 за 1M входных токенов и 10 центов за кэш). В ChatGPT работает в режиме Работа и в Codex. А для хардкорных пользователей добавили уровень за $500 с режимом Ultrafast, который отвечает до 8 раз быстрее.

🛠 Ещё завезли plugin extensions с просмотром файлов прямо в чате и MCP events для автоматизаций. Все подробности тут.

Подписка за $500 и фоновые боты — оправданный шаг или перебор?

👍 Ставь лайк, если интересно!


GPT-6.1 Sol догнала Astra, но дешевле в 5 раз 🚀

Только привыкли к GPT-6 Sol, как выкатили обновление — прошел всего один 7-дневный отрезок!

⚡ По возможностям свежая модель почти дотягивает до флагманской Astra, а ценник ниже в 5 раз.

🧠 Что прокачали по сравнению с прошлой версией Sol:
— Кодинг: лучше пишет и фиксит баги
— Аналитика: точнее разбирает документы
— Автономность: увереннее управляет ИИ-агентами

Доступ уже открыли для всех подписчиков.

Уже тестировал или пока на Astra сидишь?

❤️ Сохрани, чтобы не потерять!


ИИ-агенты теперь сами кликают по кнопкам на ПК 💻

Claude Code, Cursor и Codex выходят за пределы терминала. Опенсорсный проект Cua дает им прямой доступ к обычным приложениям на macOS, Windows и Linux.

🤖 Теперь нейросети буквально видят интерфейс, заходят в браузер, жмут на кнопки и разбирают файлы. Инструментарий мощный: Cua Driver управляет софтом, Lume запускает локальные виртуалки macOS и Linux на Apple Silicon, а Cua Fleets поднимает пачку облачных столов для массовой работы.

🧪 Для тестов сделали Cua Bench — он фиксирует весь путь действий агента. А мелкую рутину вроде ввода данных в формы отдают спецмоделям CUA-S1, пока главный ИИ строит глобальный план.

⭐ Вышла отличная база. Проект распространяется выложен под лицензией MIT и набрал уже около 27 тысяч звезд на GitHub.

Доверил бы нейросети полный доступ к своему рабочему столу?

✨ Узнал что-то новое?


Видео недоступно для предпросмотра
Смотреть в Telegram
Manus 2.0 превратился превратился в полноценную рабочую среду 🔥

Экономия токенов на 23,2%, скорость выше на 28,2%, а стоимость упала на 32%. Сервис больше не просто ИИ-агент, а полноценная система для задач.

⚡ Движок Cascade подключает инструменты только по необходимости. Главная фишка — Manus Studio, где в одном проекте собираются документы, таблицы, презентации, сайты, видео и код.

🎬 В Video Editor добавили привычный таймлайн. Кадры, музыку и анимацию можно править вручную без полной перегенерации ролика. A Game Dev позволяет создавать игры и запускать мультиплеер через Cloud Computer.

🤖 Автоматизации теперь реагируют на события вроде писем или сообщений в Slack. Плюс появился Computer Use для управления файлами на ПК прямо с телефона и сервис Cue, где агентам дают собственные почту, номер телефона и кошелёк.

Попробуешь в деле или остаёшься на стандартных нейросетях?

💡 А ты уже пробовал?


Видео недоступно для предпросмотра
Смотреть в Telegram
Kling 4.0 генерит 30 секунд видео за один заход 🎬

Seedance официально получил мощного соперника. Kling 4.0 выйдет уже в октябре, а Flash-версию уже начинают раскатывать для подписчиков Ultra Yearly.

🎬 Главная фича — генерация целых роликов до 30 секунд за раз и полноценное управление сценой через 10 ключевых кадров. Больше никакой нарезки и склейки длинных сцен по частям.

⚙️ По качеству тут полный порядок: картинка в 4K, 10-bit HDR, стереозвук, подтянутый липсинк и стабильное движение. А Omni Reference расширили до 15 мультимодальных референсов, так что персонажи, стиль и объекты теперь не теряются между кадрами.

🎙 Также добавили продление готовых видео и поддержку разных языков, акцентов и диалектов.

Seedance всё еще лидер или Kling 4.0 заберёт топы?

💡 А ты уже пробовал?

Показано 19 последних публикаций.