AI Гид


Гео и язык канала: Россия, Русский
Категория: Технологии


Промты, ИИ и многое другое

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


GPT-6 и Intelligent UI теперь доступны всем в ChatGPT

OpenAI начала глобальный запуск GPT-6 для пользователей ChatGPT. На Plus, Pro, Business и Enterprise будет работать GPT-6 Sol, а на Free и Go с 8 октября появится GPT-6 Luna.

Но главное нововведение Intelligent UI. Теперь модель может сама решать, как лучше ответить на запрос. Вместо обычного текста она способна собрать интерактивную схему, график, форму, калькулятор, карту или другой мини-инструмент прямо внутри чата.

Например, можно попросить объяснить устройство велосипеда и получить схему с переключаемыми компонентами. Или попросить калькулятор накоплений, разделить счет в ресторане либо создать простую игру. Для обычного вопроса GPT-6 при этом по-прежнему может ответить просто текстом.

Для этого OpenAI создала библиотеку готовых интерфейсных компонентов и специальный компилятор. Модель сама выбирает структуру и элементы, а интерфейс появляется постепенно прямо во время генерации ответа.

Изменился и сам процесс ответа. GPT-6 умеет начинать показывать результат еще до завершения рассуждения и постепенно дополнять его. В запросах с веб-поиском GPT-6 Instant в среднем начинает отвечать на 44% быстрее GPT-5.6 Instant.


Anthropic выпустила Claude Haiku 5.5, свою самую дешевую и быструю модель нового поколения

Модель рассчитана на задачи, которые запускаются тысячи и миллионы раз. Классификация, краткие выжимки, поддержка пользователей, работа в браузере и простые задачи внутри ИИ агентов. В среднем запуск Haiku 5.5 обходится примерно на 75% дешевле Haiku 4.5.

При этом Anthropic заметно подтянула возможности модели в кодинге, работе с компьютером и обычных рабочих задачах. Haiku 5.5 можно использовать как дешевого субагента рядом с Opus 5.5 или Sonnet 5.5, отдавая ему простую часть большой задачи.

В Haiku впервые появился регулируемый уровень effort. Можно снизить глубину рассуждений ради скорости и цены или дать модели больше ресурсов, когда задача сложнее.

На запросах короче 100 тысяч токенов Anthropic заявляет снижение стоимости на токен до 90% относительно Haiku 4.5. Именно такие запросы составляли около 90% обращений к предыдущей модели.

Модель уже доступна через Claude Platform, AWS, Google Cloud и Microsoft Azure.


Видео недоступно для предпросмотра
Смотреть в Telegram
Новые эксперименты: Google запустила Playground

Это экспериментальная платформа, где можно создавать собственные игры без навыков программирования.

Достаточно описать идею игры обычным текстом. Playground превращает её в игровой проект, который можно сразу запустить и попробовать.

По факту это вайбкодинг ля игр. Вместо движка, кода и долгой настройки пользователь начинает с идеи и собирает игру через ИИ.

Пока Playground доступен только пользователям старше 18 лет в США.


💭 Мысли на коже

Создаём атмосферный портрет, где светящиеся фразы, символы и формулы проецируются прямо на ваше лицо и тело по этому промпту:

A cinematic, ultra-realistic close-up portrait of a young woman with wet, tousled dark hair and luminous skin, staring directly into the camera with an intense, introspective expression. Glowing cyan handwritten text and symbols are projected across her face, neck, and shoulders, resembling poetic phrases, equations, and abstract handwriting. The light reflections shimmer on her damp skin, creating a futuristic, cyber-poetry aesthetic. Dark, moody background with soft shadows, shallow depth of field, sharp focus on the eyes, high contrast lighting, teal and blue color palette, hyper-detailed skin texture, photorealistic, dramatic atmosphere, cyberpunk meets fine-art portrait photography, 8K quality, cinematic lighting.






😀😀😀😀😀


🚀 Новый вирусный тренд в VeoSeeBot

Ваша детская версия в костюме рыцаря встречает вас взрослого.

Заходите в VeoSeeBot → раздел «Идеи» → выбираете шаблон Детская и взрослая версия (РЫЦАРЬ ТРЕНД ⚔️) → загружаете туда:

1) Детское фото (в хорошем качестве)
2) Взрослое фото в костюме рыцаря
3) Фото любой игрушки 🧸

👉🏻 ПОВТОРИТЬ ВИДЕО

Жми "Повторить видео", чтобы создать такое трендовое видео 🚀


Минус еще десяток стартапов: ChatGPT теперь сам ведет заметки со встреч и превращает договоренности в задачи

OpenAI запустила Meetings, плагин для настольного приложения ChatGPT на Mac. Он слушает онлайн или очную встречу, а после сохраняет конспект и список следующих действий в ChatGPT Space.

Во время разговора можно добавлять свои заметки и задавать вопросы. ChatGPT также подтягивает контекст из подключенных документов, файлов и рабочих сервисов.

После встречи пункты из списка задач можно сразу отправлять как запросы в ChatGPT, например попросить написать письмо или обновить план проекта.

Отдельного бота на встречу добавлять не нужно. Аудио после обработки удаляется.

Функция доступна в тестовом режиме для Pro и Business на macOS. Enterprise получит доступ позже.


Видео недоступно для предпросмотра
Смотреть в Telegram
Claude теперь работает внутри Google Docs, Sheets и Slides

В документах Claude открывается в боковой панели и видит текущий файл. Можно выделить текст и попросить переписать его, сократить, изменить тон или поправить отдельный фрагмент без переделки всего документа.

В Google Sheets Claude умеет писать формулы, строить сводные таблицы и диаграммы, создавать новые вкладки, чистить данные и работать с отдельными диапазонами. Для более сложной обработки он может использовать Python, а затем вернуть результат обратно в таблицу.

В Google Slides Claude создает новые слайды на основе уже существующей темы и макетов. После генерации он может проверить презентацию и найти наложившиеся элементы, объекты за границами слайда и плохо читаемый текст.

По умолчанию Claude просит подтвердить каждое изменение. Но можно включить режим, в котором он сам выполняет всю задачу и применяет правки без подтверждения на каждом шаге.

Работает и в обратную сторону. Из самого Claude можно открыть или создать файл Google Docs, Sheets или Slides и редактировать его прямо из чата.

Функция уже доступна в открытом тестировании на платных тарифах Claude.


OpenAI опубликовала большой архив математических результатов

В репозитории сейчас 722 рукописи, объединённые в 372 группы.

Для каждой работы опубликованы исходники, файлы для сборки, инструкции по цитированию и дополнительные материалы.

При этом OpenAI отдельно предупреждает, что формализация есть пока не у всех результатов и в непроверенных работах могут оставаться ошибки.

Отдельно компания выложила 10 сокращённых разборов того, как модель пришла к решениям. Среди тем есть оценка иррациональности числа π, гипотеза Малера, формула Мезара-Паризи, изоморфизм свободных групповых факторов и трёхмерная система Власова-Максвелла.

Всего модели дали около 4 000 открытых исследовательских задач. После отбора и объединения связанных результатов получился нынешний каталог. В среднем на один опубликованный результат уходило вычислительных ресурсов примерно столько же, сколько на три часа усиленного режима рассуждений в ChatGPT Pro.

Есть и отдельный репозиторий с полностью формализованными доказательствами десяти заметных результатов. Среди них улучшенные границы для упаковки сфер в пространствах высокой размерности, новые оценки для двоичных кодов, построение не-софической группы и контрпример к гипотезе Конна.

Модель, которая получила эти результаты, OpenAI пока публично не выпускает. Компания говорит, что работает над её отдельным релизом и параллельно будет обновлять репозиторий новыми формализациями и исправлениями.


🖼️ Съемка нулевых

💥 Хочешь такое же? Жми кнопку — и получишь свой вариант за пару секунд!


Google выпустила EmbeddingGemma 2, локальную модель для поиска сразу по тексту, коду, изображениям, видео и аудио

Модель превращает все эти данные в единое пространство числовых представлений. Благодаря этому можно, например, написать запрос словами и найти подходящий момент в видео, фотографию, фрагмент кода или аудиозапись без предварительной расшифровки каждого формата.

Полная EmbeddingGemma 2 содержит 740 млн параметров, но архитектура модульная. Только текст и код требуют 270 млн параметров, текст с изображениями 440 млн, текст с аудио 570 млн. Ненужные части модели можно вообще не загружать в память.

На Pixel 11 Pro текстовая версия занимает около 191 МБ активной памяти, полная мультимодальная около 567 МБ. Данные при этом можно обрабатывать полностью на устройстве без отправки в облако.

Контекст для текста вырос до 8192 токенов. По поиску в коде новая версия набирает на 14% больше EmbeddingGemma первого поколения, а размер векторов можно уменьшать с 768 до 128 измерений, сокращая объём индекса до шести раз.

Модель открыта под Apache 2.0 и уже работает через sentence-transformers, Transformers, MLX, Ollama, LM Studio, vLLM и другие популярные инструменты.


🌊 Над океаном

Создаём сюрреалистичный кадр, застрявшего человека посреди океана, по этому промпту:

Use my uploaded face and body type as the reference. Create a vertical cinematic photo of me sitting sideways on the edge of a narrow white diving board/platform, suspended above a deep dark-blue ocean with large waves and white foam. I am in profile, looking forward calmly, legs hanging down, hands resting near my knees. Bright daylight, realistic shadows, windy sea atmosphere, deep blue color grading, dramatic lonely mood. Add large white serif text “SOS” at the top center. Hyper-realistic editorial photography, vertical 9:16, natural proportions, sharp subject, detailed ocean background.



⭐ Повторить в


😀😀😀😀😀


Видео недоступно для предпросмотра
Смотреть в Telegram
Gamma полностью переделала сервис для презентаций и поставила ИИ агента в центр продукта

Компания выпустила Gamma 5, крупнейшее обновление за всю историю платформы. Главная идея в том, чтобы презентации больше не выглядели как типичный одинаковый ИИ контент.

Новый агент сначала может уточнить цель презентации и аудиторию, затем показать план и только после этого собирать саму работу. Он же помогает менять структуру, дизайн и отдельные элементы уже готовой презентации.

Сильно переработали визуальную часть. Gamma 5 умеет подстраиваться под стиль бренда или собирать полностью новый дизайн, используя современные модели для генерации текста и изображений.

Появился полноценный импорт PowerPoint. Готовый файл можно загрузить в Gamma, изменить через агента, применить новый визуальный стиль и затем снова экспортировать с сохранением форматирования.

Также добавили коннекторы к Notion, Slack и HubSpot. Агент может подтягивать оттуда контекст и использовать его при создании презентации.

Старые проекты никуда не исчезают. Gamma Classic остается доступной, а существующие презентации продолжают храниться в аккаунте.


Видео недоступно для предпросмотра
Смотреть в Telegram
🔥 AI уже сам монтирует ролики

Вышел HyperFrames Studio - и это тот случай, когда ты не просто генеришь отдельные куски видео, а буквально объясняешь агенту, какой ролик хочешь получить.

HyperFrames Studio

Пишешь, например:
«Сделай динамичный ролик на 20 секунд, добавь титры, графику и переходы в стиле techno» — и агент сам собирает монтаж.

А дальше самое интересное 👇

Можно прямо обвести объект в кадре, написать рядом комментарий и сказать агенту, что изменить.

Не хочется писать промпт? Тоже окей. Кликаешь по тексту или картинке и руками меняешь шрифт, цвет, размер или медиа.

Причём можно возвращаться к старым проектам. Просто говоришь, что взять из конкретного проекта и что переделать. Можно даже импортировать существующую папку HyperFrames и продолжить работу с того же места.

Внутри уже есть целая библиотека готовых элементов: переходы, титры, эффекты, анимации, графики, интерфейсы и 3D-сцены.

Пока работает на macOS и Linux, Windows обещают добавить позже.

Короче, это уже больше похоже не на «AI для монтажа», а на AI-монтажёра, которому ты ставишь задачу 😮‍💨

🔥 И да, этому подходу я как раз учу у себя на обучении.

Мы разбираем, как использовать AI не просто для генерации красивых картинок, а для создания контента, роликов, визуалов и автоматизации работы с блогом.

Если хотите попасть на обучение и узнать подробности — пишите мне в личку.


🍌 Nano Banana 2.1 официально вышла

Google наконец выкатила стабильную версию Nano Banana 2.1, и теперь это уже не просто «потыкать в Gemini», а полноценная модель с API.

Что интересного 👇

🔥 Картинки стали детальнее
Лучше работает с мелкими деталями, текстом и, что особенно важно, сохраняет персонажей при последовательных правках.

🔥 Панорамы наконец без странных повторов
Для широких форматов 1:4, 4:1, 1:8 и 8:1 Google исправила эффект повторяющихся плиток. Причём это работает в 2K и 4K.

🔥 До 14 референсов
Можно загрузить сразу пачку изображений и использовать их для создания результата.

🔥 Google Search внутри генерации
Модель может подтягивать актуальную информацию через поиск Google.

🔥 Можно выбирать уровень размышления
То есть управлять тем, насколько глубоко модель будет «думать» перед генерацией.

И теперь самое интересное для тех, кто использует API 💸

1K — $0,0336
2K — $0,0504
4K — $0,0756

Текст и входные данные оплачиваются отдельно. Бесплатного API-тарифа для Nano Banana 2.1 нет.

Модель уже появляется в Gemini, Flow и AI Studio.

Короче, Nano Banana продолжает превращаться из забавной «нейронки для картинок» в довольно серьёзный инструмент для продакшена 😮‍💨

Я уже тестирую 2.1. Скоро покажу, что она реально умеет и где у неё пока остаются косяки.


В Claude завезли русский язык

Не прошло и года или прошло? Ребята из Anthropic перевели интерфейс на русский язык.

Обновление раскатывают постепенно, скоро будет доступно всем пользователям. У меня уже на русском.


Google выпустила Nano Banana 2.1

Улучшили визуальный дизайн, редактирование отдельных областей через маски, сохранение внешности персонажей и общую естественность изображений. Есть вывод в 4K.

Отдельный акцент сделали на многошаговом редактировании. Модель должна лучше сохранять детали и согласованность изображения, даже если пользователь несколько раз подряд вносит изменения.

Генерация стоит $30 за миллион выходных токенов. Изображение 1K обходится примерно в $0,034, 2K в $0,050, а 4K в $0,076.

Уже разворачивается в Gemini, Google AI Studio и API.


🚝 В центре движения

Создаём атмосферный кадр в метро по этому промпту:

Cinematic editorial portrait of a young person standing motionless at the center of a moving crowd. Melancholic eyes staring directly into the camera, sharp jawline, fair skin with warm undertones, slightly parted lips. He wears a dark charcoal herringbone tweed blazer with subtle vertical pinstripes layered over an olive-green button-up shirt with the collar unbuttoned. Surrounding him, blurred silhouettes of commuters caught in heavy radial motion blur — heads, shoulders, hair streaking outward from the frame edges — while only he remains in perfect razor-sharp focus. Dimly lit underground subway station setting, atmospheric haze drifting through the air, moody desaturated teal-green color grade with warm amber highlights on his face. Deep crushed shadows, strong vignette around the corners, shallow depth of field, 35mm film aesthetic with subtle grain, cinematic overhead lighting. Mood of isolation, introspection, melancholy. Hyper-realistic photographic quality, fashion editorial style, vertical composition, no AI artifacts, zero plastic skin texture.






😀😀😀😀😀


Mistral представила Large 4

Модель под кодовым названием Le Chonk получила 1 трлн параметров, но благодаря MoE-архитектуре на каждый запрос активирует только 49 млрд. Она изначально мультимодальная и работает с текстом и изображениями.

По данным Mistral, Large 4 стала лучшей моделью с открытыми весами из США и Европы по совокупности бенчмарков.

Компания отдельно выделяет задачи кибербезопасности, производства и финансов, а в визуальном понимании модель обходит некоторые закрытые флагманские модели.

Весь цикл разработки и инфраструктура находятся в Европе. Large 4 уже доступна через API и Mistral Cloud, а открытые веса компания обещает выпустить в конце октября.

Для задач кибербезопасности Mistral пока работает с партнёрами в закрытом режиме.


Вот это я точно забираю себе в закладки 👀

VFlow — огромная библиотека для тех, кто делает AI-видео: около 9000 видео с готовыми промптами.

И самое удобное здесь даже не количество, а то, как всё организовано.

Можно искать по технике: жанр, движение камеры, освещение, настроение и другим параметрам. Не нужно читать огромные промпты и пытаться понять, что именно сработало. Ключевые элементы уже собраны в понятную таблицу.

Нашёл похожий референс → посмотрел промпт → адаптировал под свою задачу.

Я сам постоянно использую подобные библиотеки, когда нужно быстро найти идею или разобраться, как повторить конкретный визуальный эффект в AI-видео.

А если хотите не просто сохранять такие инструменты в закладки, а научиться использовать ИИ в работе с блогом и контентом, у меня как раз есть обучение.

Показываем, как с помощью ИИ генерировать идеи, создавать контент, работать с визуалом и видео и выстраивать весь процесс быстрее.

По обучению пишите мне в личку 👋



Показано 20 последних публикаций.